HoldToType

documentazione

Scegli un modello vocale per la tua lingua

La procedura ne sceglie uno sensato, e si può cambiare in qualsiasi momento in Lingue e modelli. Cosa decide davvero questa scelta:

Se voletePrendetePerché
una scelta sicura per qualsiasi lingua

Whisper Medium q5

Copre tutto e traduce da sé — in inglese per bene, nelle altre lingue dell'interfaccia in via sperimentale. Circa 1,5 GB.

la latenza più bassa

un modello stretto per la vostra lingua

GigaAM v3 ha trasformato una frase di 11 secondi in testo in 0,47 s contro gli 11,6 s di Whisper, con un terzo della memoria.

il testo mentre parlate

Nemotron 3.5 in streaming

Il testo parziale compare sulla targhetta più volte al secondo, 40 lingue.

una macchina modesta

Whisper Base o Moonshine

Piccoli e rapidi; meno precisi sulle frasi lunghe.

Il catalogo mostra quanta memoria ogni modello occuperà davvero, misurata su quella libera in questo momento, e dice chiaramente se sa tradurre.

Cosa offre il catalogo

I modelli si scaricano su richiesta, dagli archivi qui sotto, e ogni file viene confrontato con uno SHA-256 pubblicato prima di essere usato. Nessuno è incluso nel programma.

ModelloA cosa serve
Whisper Base, Small, Medium, Turbo

La scelta di partenza per qualsiasi lingua, e i modelli che reggono la traduzione: in inglese con il loro compito di traduzione, nelle altre lingue dicendo loro che il parlato è già nella lingua d'arrivo. Le versioni quantizzate portano la sigla q5.

GigaAM v3

Un modello monolingua che mette da sé la punteggiatura. Su una frase di 11 secondi ha impiegato 0,47 s contro gli 11,6 s di Whisper Medium, e 277 MB di memoria contro 814 MB.

GigaAM v2

La generazione precedente dello stesso modello: la stessa velocità, senza la punteggiatura.

Parakeet TDT 0.6B v3

25 lingue europee in un solo modello stretto, mette la punteggiatura da sé.

Nemotron 3.5 Streaming

Scrive mentre parlate: testo parziale sulla targhetta, 40 lingue, punteggiatura compresa.

Canary 180M Flash

Inglese, tedesco, spagnolo e francese, e traduce fra loro senza Whisper.

Qwen3 ASR

Una trentina di lingue, il più pesante e il più preciso del catalogo.

Moonshine

Piccolo e rapido, per una lingua alla volta su macchine modeste.

Qualsiasi modello editor GGUF

La post-elaborazione fa girare qualsiasi modello GGUF gli indichiate, cercato e scaricato da Hugging Face dentro il programma.

I tuoi modelli

Il catalogo non è una recinzione. Metti un file di modello Whisper (ggml-*.bin) o una cartella di modello sherpa-onnx nella cartella models accanto al programma, e compare nell'elenco con il suo nome, segnato come trovato in locale. Lo stesso vale per l'editor: la post-elaborazione esegue qualsiasi file GGUF a cui la punti, e la ricerca dentro il programma ne prende uno da Hugging Face.

Come funziona la traduzione

Whisper traduce in inglese con il suo compito di traduzione, e nelle altre lingue dell'interfaccia dicendogli che il parlato è già nella lingua di destinazione. Canary traduce da solo tra inglese, tedesco, spagnolo e francese. I modelli specifici si limitano a trascrivere: quando uno di loro serve la tua lingua, il programma tiene pronto il miglior Whisper installato, e la targhetta propone di passargli una frase.

Dove si imposta il modello di ogni lingua e come funzionano le righe è nella guida Lingue e modelli.