documentazione
La procedura ne sceglie uno sensato, e si può cambiare in qualsiasi momento in Lingue e modelli. Cosa decide davvero questa scelta:
Whisper Medium q5
Copre tutto e traduce da sé — in inglese per bene, nelle altre lingue dell'interfaccia in via sperimentale. Circa 1,5 GB.
un modello stretto per la vostra lingua
GigaAM v3 ha trasformato una frase di 11 secondi in testo in 0,47 s contro gli 11,6 s di Whisper, con un terzo della memoria.
Nemotron 3.5 in streaming
Il testo parziale compare sulla targhetta più volte al secondo, 40 lingue.
Whisper Base o Moonshine
Piccoli e rapidi; meno precisi sulle frasi lunghe.
Il catalogo mostra quanta memoria ogni modello occuperà davvero, misurata su quella libera in questo momento, e dice chiaramente se sa tradurre.
I modelli si scaricano su richiesta, dagli archivi qui sotto, e ogni file viene confrontato con uno SHA-256 pubblicato prima di essere usato. Nessuno è incluso nel programma.
La scelta di partenza per qualsiasi lingua, e i modelli che reggono la traduzione: in inglese con il loro compito di traduzione, nelle altre lingue dicendo loro che il parlato è già nella lingua d'arrivo. Le versioni quantizzate portano la sigla q5.
Un modello monolingua che mette da sé la punteggiatura. Su una frase di 11 secondi ha impiegato 0,47 s contro gli 11,6 s di Whisper Medium, e 277 MB di memoria contro 814 MB.
La generazione precedente dello stesso modello: la stessa velocità, senza la punteggiatura.
25 lingue europee in un solo modello stretto, mette la punteggiatura da sé.
Scrive mentre parlate: testo parziale sulla targhetta, 40 lingue, punteggiatura compresa.
Inglese, tedesco, spagnolo e francese, e traduce fra loro senza Whisper.
Una trentina di lingue, il più pesante e il più preciso del catalogo.
Piccolo e rapido, per una lingua alla volta su macchine modeste.
La post-elaborazione fa girare qualsiasi modello GGUF gli indichiate, cercato e scaricato da Hugging Face dentro il programma.
Il catalogo non è una recinzione. Metti un file di modello Whisper (ggml-*.bin) o una cartella di modello sherpa-onnx nella cartella models accanto al programma, e compare nell'elenco con il suo nome, segnato come trovato in locale. Lo stesso vale per l'editor: la post-elaborazione esegue qualsiasi file GGUF a cui la punti, e la ricerca dentro il programma ne prende uno da Hugging Face.
Whisper traduce in inglese con il suo compito di traduzione, e nelle altre lingue dell'interfaccia dicendogli che il parlato è già nella lingua di destinazione. Canary traduce da solo tra inglese, tedesco, spagnolo e francese. I modelli specifici si limitano a trascrivere: quando uno di loro serve la tua lingua, il programma tiene pronto il miglior Whisper installato, e la targhetta propone di passargli una frase.
Dove si imposta il modello di ogni lingua e come funzionano le righe è nella guida Lingue e modelli.