⚠️ MODO DE PRUEBA — los pagos no son reales. Sitio en pruebas.
100% local · Sin nube · Sin envio de audio
¿Funcionará en tu equipo?
Entrada de voz de Cortility — totalmente sin conexión, dos motores a elegir, tres niveles de hardware desde portátil de oficina hasta workstation con GPU. Esta pagina te dice exactamente que necesitas.
2
Motores
6
Modelos
99
Idiomas (Whisper)
0
Llamadas a la nube
Auto-comprobación
¿En qué nivel estoy?
Tres clics — y sabrás que motor, que modelo y que ruta de aceleración encajan con tu equipo. Recomendación en tiempo real.
Entrada
Describe tu equipo
Los valores actualizan el resultado al instante.
Resultado
Nivel: Recomendado
CPU
RAM — 8 GB
481632
Suficiente hasta Whisper Medium
GPU
→ Lo que puedes usar
Recomendación heurística — la app vuelve a verificar el hardware al activar la entrada de voz y habilita las rutas adecuadas.
01 — Motor
¿Qué motor te conviene?
Ambos se ejecutan localmente. Ambos son seleccionables libremente. Elige según la cobertura de idiomas y el hardware disponible.
Por defecto
Whisper
Whisper.net 1.9.0 — ggml
Maxima cobertura de idiomas. Mayor precisión.
🌍99 idiomas compatibles
📐Cinco tamanos de modelo — Tiny hasta Large v3 Turbo
⚡Aceleración NVIDIA CUDA opcional
🛡Motor de código abierto ampliamente probado
CPUVulkanCUDA
Recomendado para maxima cobertura de idiomas y hardware NVIDIA
Opcional
Parakeet
sherpa-onnx 1.12.38 — ONNX
Baja latencia. Independiente de la GPU.
🇪🇺25 idiomas europeos, detección automática
⚡Baja latencia, apto para streaming
🎮Funciona en cualquier GPU DX12 sin problemas de drivers
🆕Generación actual de NVIDIA NeMo
CPUDirectML
Recomendado para GPUs AMD/Intel y minima latencia
02 — Hardware
Tres niveles. Elección clara.
Desde portátil de oficina hasta workstation con GPU. Busca la tarjeta que mejor se ajuste a tu equipo.
Nivel 1
Requisitos minimos
Lo justo para que funcione
CPU
x86-64 (fallback pre-AVX solo Whisper-CPU)
RAM
4 GB
GPU
— (con CPU basta)
Almacenamiento
100 MB + tamano del modelo
OS
Windows 10 build 19041 (mayo 2020) o Windows 11
p. ej. portátil de oficina, notas ocasionales
Sweet Spot
Nivel 2
Recomendado
Uso diario comodo
CPU
x86-64 con AVX2 (Intel desde Haswell, AMD desde Excavator)
NVIDIA ≥ 4 GB VRAM (CUDA) o GPU moderna ≥ 6 GB VRAM (Smart Modes)
Almacenamiento
hasta 10 GB
OS
Windows 10/11 actualizado + driver de GPU reciente
p. ej. usuario avanzado con workstation GPU
03 — Modelos
Seis modelos. Whisper & Parakeet.
Whisper
OpenAI · 5 modelos · 99 idiomas
CPUVulkanCUDA
Tiny
39 M~75 MB
Notas muy rápidas, precisión más baja
DEFAULT
Base
74 M~142 MB
Todo terreno solido para equipos solo-CPU
Small
244 M~466 MB
Buena precisión, aún viable en CPU
Medium
769 M~1,5 GB
Alta precisión, GPU recomendada
Large v3 Turbo
809 M~1,6 GB
Mejor precisión, GPU muy recomendada
Parakeet
NVIDIA NeMo · 1 modelo · 25 idiomas
CPUDirectML
DEFAULT
parakeet-tdt-0.6b-v3
~2,4 GB4 archivos
25 idiomas europeos con detección automática — DE, EN, ES, FR, IT, PT, NL, PL entre otros. Baja latencia, apto para streaming.
04 — Smart Modes · Opcional
LLMs locales, cuando el dictado quiera tomar forma.
Opcionalmente, un modelo de lenguaje local limpia, formatea o reestructura el texto transcrito — «redactar como correo», «convertir en puntos».
Aviso: Los Smart Modes no tienen fallback en CPU y requieren una GPU DX12 con suficiente VRAM. Sin ella permanecen desactivados — la entrada de voz sigue funcionando sin cambios.
Llama 3.2 3B Instruct
INT4
Tamano
~3 GB
VRAM
≥ 4 GB
Backend
DirectML
Mistral 7B Instruct
v0.3 INT4
Tamano
~4,3 GB
VRAM
≥ 6 GB
Backend
DirectML
Privacidad
Tu voz no sale de este equipo.
🔒
Totalmente local
Todos los modelos se ejecutan en tu dispositivo. Sin procesamiento externo.
☁
Sin nube
Los datos de audio y texto no salen de tu equipo.
⬇
Descarga única
Los modelos se descargan una vez del CDN de Menterium — luego funcionan sin conexión.
05 — Preguntas frecuentes
Respuestas en una frase.
Cortility usa automáticamente Vulkan. Sin error, sin interrupción.
Sí. Whisper Tiny y Base funcionan solo con CPU. El fallback pre-AVX solo existe para Whisper-CPU.
Aplicación 100 MB más los modelos activados. Whisper Base es el predeterminado (142 MB). Quien use todo en paralelo debería dejar 10 GB libres.
No. Los modelos se descargan una sola vez del CDN de Menterium. Las actualizaciones llegan con la siguiente versión de la app, no en segundo plano.
AVX2 — conjunto de instrucciones de CPU moderno. DirectML — API GPU de Microsoft para ML. CUDA — API de calculo GPU de NVIDIA.
Descargar ahora.
14 días gratis. Los modelos se descargan una vez al activar la entrada de voz.