HoldToType

docs

Elige un modelo de voz para tu idioma

El asistente elige uno sensato, y se puede cambiar cuando quiera en Idiomas y modelos. Lo que esa elección decide en realidad:

Si quiereElijaPor qué
una opción segura para cualquier idioma

Whisper Medium q5

Cubre todo y traduce por sí mismo — al inglés en condiciones, a los demás idiomas de la interfaz de forma experimental. Unos 1,5 GB.

la menor espera

un modelo estrecho para su idioma

GigaAM v3 convirtió una frase de 11 segundos en texto en 0,47 s frente a los 11,6 s de Whisper, con un tercio de la memoria.

texto mientras habla

Nemotron 3.5 en flujo

El texto parcial aparece en la barra varias veces por segundo, 40 idiomas.

una máquina modesta

Whisper Base o Moonshine

Pequeños y rápidos; menos precisos en frases largas.

El catálogo muestra la memoria que cada modelo ocupará de verdad, medida contra la que hay libre ahora mismo, y dice con claridad si sabe traducir.

Qué ofrece el catálogo

Los modelos se descargan a petición, desde los repositorios de abajo, y cada archivo se compara con un SHA-256 publicado antes de usarse. Ninguno viene con el programa.

ModeloPara qué sirve
Whisper Base, Small, Medium, Turbo

La opción por defecto para cualquier idioma, y los modelos que sostienen la traducción: al inglés por su propia tarea de traducción, a los demás idiomas diciéndoles que el habla ya está en el idioma de destino. Las versiones cuantizadas llevan la marca q5.

GigaAM v3

Un modelo de un solo idioma que puntúa por sí mismo. En una frase de 11 segundos tardó 0,47 s frente a los 11,6 s de Whisper Medium, y 277 MB de memoria frente a 814 MB.

GigaAM v2

La generación anterior del mismo modelo: la misma velocidad, sin la puntuación.

Parakeet TDT 0.6B v3

25 idiomas europeos en un solo modelo estrecho, puntúa por sí mismo.

Nemotron 3.5 Streaming

Escribe mientras habla: texto parcial en la barra, 40 idiomas, con puntuación.

Canary 180M Flash

Inglés, alemán, español y francés, y traduce entre ellos sin Whisper.

Qwen3 ASR

Unos 30 idiomas, el más pesado y el más preciso del catálogo.

Moonshine

Pequeño y rápido, para un idioma a la vez en equipos modestos.

Cualquier modelo editor GGUF

El posprocesado ejecuta cualquier modelo GGUF que le indique, buscado y descargado desde Hugging Face dentro del programa.

Tus propios modelos

El catálogo no es una valla. Deja un archivo de modelo Whisper (ggml-*.bin) o una carpeta de modelo sherpa-onnx en la carpeta models junto al programa, y aparece en la lista con su propio nombre, marcado como encontrado en local. Lo mismo vale para el editor: el posprocesado ejecuta cualquier archivo GGUF al que apuntes, y la búsqueda dentro del programa trae uno de Hugging Face.

Cómo funciona la traducción

Whisper traduce al inglés con su propia tarea de traducción, y a los demás idiomas de la interfaz diciéndole que el habla ya está en el idioma de destino. Canary traduce por sí mismo entre inglés, alemán, español y francés. Los modelos específicos solo transcriben: cuando uno de ellos atiende tu idioma, el programa mantiene listo el mejor Whisper instalado, y la placa ofrece pasarle una frase.

Dónde se establece el modelo de cada idioma y cómo funcionan las filas está en la guía Idiomas y modelos.