HoldToType

Vergleich

HoldToType neben den Alternativen.

Die Programme, mit denen man uns am häufigsten vergleicht, in einer Tabelle. Ehrlich, auch da, wo wir verlieren. Preise und Funktionen sind das, was jeder Hersteller veröffentlicht.

HoldToTypeHandyWispr FlowDragonWhisper FlowDictaFlowTypeless
Signierte BuildsNoch nichtJaJaJaJaJaJa
PreisKostenlosKostenlos12 $ / Monat699 $ einmaligAb 9 $ / Monat7 $ / Monat12 $ / Monat
Abo oder CreditsKeineKeineAboEinmallizenzCreditsAboAbo
KontoKeinsKeinsNötigNötigNötigNötigNötig
Audio verlässt den RechnerNeinNeinJaNeinJaJaJa
Läuft offlineJaJaNeinJaNeinBezahloptionNein
Open SourceMITMITNeinNeinNeinNeinNein
Sprachen9999100+7100+90+100+
Live-Text beim SprechenJaNeinNeinJaNeinNeinJa
Übersetzung7 SprachenNeinNeinNeinNeinNeinJa
Bearbeitung durch ein lokales ModellJaNeinCloudNeinCloudCloudCloud
Wahl des Sprachmodells9 Modelle, eines pro SpracheWhisper-Größen und ParakeetNein, nur ihresNein, nur ihresNein, nur ihresNein, nur ihresNein, nur ihres
Eigene SprachmodelleJede Whisper-GGML-Datei oder jedes sherpa-onnx-Modell im Ordner modelsNeinNeinNeinNeinNein
Modelle mit Text beim SprechenNemotron 3.5NeinNeinEigene EngineNeinNeinEigene Engine
Nachbearbeitung durch ein ModellJaNeinJaNeinJaJaJa
Wo die Nachbearbeitung läuftAuf Ihrer Platte oder einem Server Ihrer WahlDeren CloudDeren CloudDeren CloudDeren Cloud
Wahl des Editor-ModellsJedes GGUF von Hugging Face oder jede APINeinNeinNeinNeinNeinNein
Eigene PromptsJa, Ketten, jede mit TastenkürzelNeinEingebaute StileNeinEingebaute Korrekturen
Erkennungsserver auf einem anderen RechnerJaNeinNeinNeinNeinNeinNein
Selbst definierte SprachbefehleJaNeinNur eingebauteJaNur eingebaute
Wo der Diktatverlauf liegtAuf Ihrer Platte, standardmäßig ausAuf Ihrer PlatteDeren ServerDeren ServerDeren ServerDeren Server, Option auf dem Gerät
Sprachen der Oberfläche8EnglischMehrere
Eigener WortschatzJaNeinJaJaJaJaJa
Portabler OrdnerJaNeinNeinNeinNeinNeinNein

Preise und Funktionen, wie von jedem Hersteller im September 2026 veröffentlicht. Ein Strich heißt, der Hersteller sagt es nicht.

Wo wir verlieren

Kein Mac und kein Telefon. Die Builds sind noch nicht signiert, also warnt Windows einmal. Es gibt keinen Cloud-Abgleich zwischen Ihren Rechnern: Einstellungen und Verlauf liegen im Ordner, und Sie kopieren sie selbst.

Wo es unentschieden steht

Die Genauigkeit bei Alltagssprache liegt überall nah beieinander: unter den meisten dieser Programme stecken dieselben offenen Modelle. Eigener Wortschatz ist verbreitet. Die Bezahlprogramme liefern ein poliertes Onboarding, das ein Ein-Personen-Projekt nicht bieten kann.

Wo wir gewinnen

Nichts zu zahlen und nirgends anzumelden. Das Audio verlässt den Rechner nie. Der Quellcode ist offen unter MIT. Ein Modell pro Sprache, Live-Text beim Sprechen, Übersetzung in sieben Sprachen, ein Editor-Modell, das auf Ihrer Platte läuft, und ein portabler Ordner für den Stick.

Nicht in der Tabelle

Die Windows-Spracheingabe, das eingebaute Werkzeug hinter Win+H, ist kostenlos und braucht keine Installation, schickt aber für die meisten Sprachen das Audio an Microsoft und hat kein Wörterbuch für Ihre eigenen Wörter. Reine Mac-Programme wie VoiceInk, FluidVoice oder HoldType, das mit dem ähnlichen Namen, bleiben draußen, weil HoldToType für Windows ist. Vibe und andere Dateitranskribierer machen eine andere Arbeit: sie transkribieren Aufnahmen, nicht das, was Sie am Cursor sagen.

HoldToType herunterladen