MacWhisper se ha convertido en una de las aplicaciones para Mac más comentadas en el ámbito de las herramientas de IA. Sin embargo, con 8105 impresiones y una tasa de clics de tan solo el 0,16 %, muchas personas la buscan y no encuentran las respuestas que necesitan.
Aquí tienes la respuesta honesta, basada en datos, tras 30 días de uso diario.
Qué probamos y cómo.#
Utilizamos MacWhisper Pro (última versión, con el modelo Whisper Large-v3 habilitado) como herramienta principal durante 30 días con dos participantes de prueba con diferentes casos de uso.
Participante A: Productor de podcasts: transcribe de 3 a 5 horas de audio grabado por semana. Participante B: Desarrollador de software: necesita principalmente un reemplazo de teclado en vivo para Slack, comentarios de código y correo electrónico.
Esta distinción es crucial, ya que MacWhisper ofrece servicios completamente diferentes para estos dos tipos de usuarios.
Rendimiento de MacWhisper: Datos#
Transcripción de archivos de audio (Participante A: Productor de podcasts)#
| Métrica | MacWhisper Pro (Large-v3) | MacWhisper Free (Base) |
|---|---|---|
| WER — Inglés estándar (audio claro) | 3,1% | 7.4% |
| WER — Vocabulario técnico | 6,2% | 14.1% |
| WER — Hablante no nativo de inglés (acento moderado) | 8.3% | 21.7% |
| Tiempo de procesamiento (1 hora de audio en M3 Max) | 8.4 min | 3.2 min |
| Tiempo de procesamiento (1 hora de audio en M1 Air 8GB) | 22,1 min | 9,8 min |
| RAM durante el procesamiento | 1,1 GB | ~280 MB |
Desliza para ver todas las columnas
Para la transcripción de archivos de audio, MacWhisper Pro es realmente excelente. Su tasa de error de palabras (WER) del 3,1 % en inglés estándar es comparable a la de los mejores servicios de transcripción en la nube. El salto en el tiempo de procesamiento del M1 Air frente al M3 Max pone de manifiesto la dependencia del hardware: el modelo Large-v3 exige un hardware potente.
Veredicto del Participante A después de 30 días: "MacWhisper reemplazó inmediatamente mi suscripción de 150 $/mes al Otter.ai. La precisión del contenido de mi podcast (dos hablantes nativos de inglés en un estudio silencioso) es casi perfecta. Edito unos 30 segundos de errores por hora de audio."
Dictado en directo (Participante B — Desarrollador)#
Aquí es donde la evaluación honesta diverge notablemente.
| Métrica | MacWhisper (En vivo) | LumeVoice (En vivo) |
|---|---|---|
| Tiempo de escritura tras hablar | 2400 ms | 310 ms |
| Flujo de trabajo para uso en directo | Manual: grabar → transcribir → copiar → pegar | Automático: hablar → aparece en el cursor |
| Interrupción del flujo de escritura | ⚠️ Significativo | Ninguno |
| RAM mientras está activo | 1,1 GB | 210 MB |
| Integración con la aplicación activa | ❌ Se requiere pegado manual | ✅ Superposición del sistema nativo |
| Eliminación de palabras de relleno | ❌ Ninguno (transcripción literal) | ✅ Automático |
Desliza para ver todas las columnas
Veredicto del Participante B después de 30 días:: "Probé MacWhisper durante 4 semanas para la escritura en tiempo real. No puedo usarlo. El retraso de 2,4 segundos no es un inconveniente menor; interrumpe por completo mi forma de pensar mientras escribo. Para cuando aparece el texto, ya he pensado en las siguientes tres frases y he perdido el hilo. MacWhisper fue diseñado para la transcripción de archivos y para eso es para lo único que debería usarse."
La filosofía de diseño principal de MacWhisper#
Para entender por qué el MacWhisper funciona como lo hace en uso real, es necesario comprender su arquitectura.
El MacWhisper fue diseñado como un Aplicación de transcripción de archivos. El flujo de trabajo en torno al cual se construyó es el siguiente:
- Grabar audio (teléfono, computadora o grabación de Zoom/Meets)
- Guardar como archivo de audio (MP3, M4A, WAV)
- Arrastrar el archivo al MacWhisper
- Esperar a que se procese
- Exportar como texto, SRT o VTT
Todo en MacWhisper está optimizado para este flujo de trabajo:
- La carga del modelo se realiza una vez por trabajo de transcripción (tiempo de espera aceptable al procesar un archivo de 1 hora).
- Se prioriza la precisión sobre la velocidad (el procesamiento puede tardar minutos, pero el modelo Large-v3 logra excelentes resultados).
- No se requiere integración en todo el sistema (el texto transcrito existe en la ventana de MacWhisper, no en el cursor).
Al intentar usar MacWhisper para la sustitución de teclado en tiempo real, se le está pidiendo a un procesador de archivos por lotes que se comporte como un sistema de transmisión en tiempo real. Nunca fue diseñado para esto, y la experiencia lo refleja.
Características de MacWhisper Pro: Análisis completo#
Qué ofrece la versión Pro frente a la versión gratuita#
| Función | MacWhisper Gratis. | MacWhisper Pro |
|---|---|---|
| Whisper Modelo pequeño | ✅ | ✅ |
| Modelo base Whisper | ✅ | ✅ |
| Modelo mediano Whisper | ❌ | ✅ |
| Whisper Grande-v2 | ❌ | ✅ |
| Whisper Grande-v3 (máxima precisión) | ❌ | ✅ |
| Procesamiento por lotes (varios archivos) | ❌ | ✅ |
| Grabación de audio del sistema | ❌ | ✅ |
| Exportación de subtítulos SRT | ❌ | ✅ |
| Exportación de subtítulos VTT | ❌ | ✅ |
| Diarización de oradores | ❌ | ✅ |
| Traducir al inglés | Limitado | ✅ Completo |
Desliza para ver todas las columnas
Prueba de identificación de interlocutores#
Probamos específicamente la identificación de interlocutores (quién dijo qué) de MacWhisper en la grabación de una conversación con tres participantes:
- Precisión con 2 hablantes:: 91,3 % de precisión en la atribución
- Precisión con 3 hablantes:: 79,6 % de precisión en la atribución
- Rendimiento con voz superpuesta:: Rendimiento significativamente reducido: presenta dificultades cuando los interlocutores hablan simultáneamente
Para productores de podcasts con uno o dos interlocutores que se escuchan con claridad en condiciones de audio nítidas, la identificación de interlocutores funciona correctamente. Para grabaciones de reuniones con varias personas y frecuentes interrupciones, genera más trabajo del que ahorra.
MacWhisper en tu flujo de trabajo: 5 escenarios de decisión#
Escenario 1: Produces un podcast y necesitas transcripciones para las notas del programa. → ✅ Compra MacWhisper Pro. Es la mejor herramienta para este trabajo. Alta precisión, salida SRT para subtítulos de YouTube, compra única.
Escenario 2: Entrevistas a clientes o fuentes y necesitas transcribir grabaciones. → ✅ Compra MacWhisper Pro. Inserta el archivo de audio y obtén el texto en minutos. La diarización de oradores facilita conversaciones claras entre dos personas.
Escenario 3: Quieres escribir más rápido en Slack, correo electrónico y tu editor de código. → ❌ No compres MacWhisper. Obtén LumeVoice. MacWhisper te frustrará con retrasos de 2,4 segundos y un flujo de trabajo de copiar y pegar.
Escenario 4: Quieres reemplazar un servicio de transcripción en la nube de $150/mes. → ✅ Compra MacWhisper Pro. Por 59 € (pago único), recuperas la inversión frente a Otter.ai Pro en aproximadamente 2 semanas.
Escenario 5: Necesitas dictado en tiempo real Y transcripción ocasional de archivos. → Considera ambas opciones. LumeVoice ($249 de por vida o $79.99 Pro anual) para escritura en vivo + MacWhisper gratis para transcripción ocasional de archivos.
¿Es seguro MacWhisper? Análisis de privacidad#
MacWhisper procesa todo el audio localmente mediante el Neural Engine de Apple. No se transmite nada a servidores externos. Esta es una de las ventajas más significativas de MacWhisper frente a los servicios de transcripción en la nube.
Propiedades de privacidad verificadas:
- ✅ No se transmite audio a servidores externos
- ✅ No se requiere cuenta ni autenticación
- ✅ El audio procesado permanece en el dispositivo
- ✅ No se realizan análisis de uso del contenido de audio
- ✅ Funciona completamente sin conexión una vez descargados los modelos
Para profesionales con requisitos de confidencialidad (legales, sanitarios, gubernamentales), la arquitectura local de MacWhisper es adecuada para su uso con audio sensible.
Nota: Los archivos del modelo se descargan de los servidores de OpenAI en el primer uso. Tras la descarga, no se requiere conexión a internet.
Veredicto: ¿Merece la pena MacWhisper en 2026?#
SÍ: compra MacWhisper Pro si:
- Transcribe archivos de audio pregrabados (podcasts, entrevistas, grabaciones)
- Produce contenido de vídeo y necesita archivos de subtítulos SRT/VTT
- Actualmente paga por la transcripción en la nube (Otter, Rev, etc.)
- Necesitas procesar varios archivos de audio por lotes.
- La privacidad y el procesamiento local son requisitos indispensables.
NO — no compre MacWhisper si:
- Quieres reemplazar tu teclado para escribir en tiempo real.
- Quieres dictar en Slack, Gmail, VS Code o cualquier aplicación en vivo.
- Necesitas compatibilidad multiplataforma (MacWhisper solo es compatible con macOS).
- Quieres funciones de IA modernas como la eliminación de palabras de relleno y la adaptación al contexto.
El precio de MacWhisper es: cuesta aproximadamente 59 € (unos 65 USD). A este precio, ofrece una excelente relación calidad-precio para la transcripción de audio, función para la que fue diseñado.
El precio de LumeVoice para dictado en vivo es: $249 licencia de por vida de pago único, o $79.99/año en Pro Anual. Todas las cuentas comienzan con 3000 palabras gratis, sin tarjeta.
Para escribir en tiempo real, MacWhisper no es la herramienta adecuada.
MacWhisper es excelente en lo que se creó: transcripción de archivos de audio.
LumeVoice está diseñado para lo que probablemente deseas: escribir 3 veces más rápido en todas las aplicaciones de tu Mac, ahora mismo, en tu cursor.
- Latencia de 310 ms — no 2400 ms
- 1,2 % WER — inferior al 3,1% de MacWhisper
- En todo el sistema — Slack, Gmail, VS Code, Notion, todo
- Duración de $249 — propiedad para siempre, herramienta completamente diferente
Para macOS 13 o posterior (se recomienda Apple Silicon)



