Guías

Transcripción offline y privada en el Mac con Whisper

Hay conversaciones que no deberían transmitirse a ningún sitio: una consulta médica, una reunión con un abogado, un consejo de administración antes de un anuncio. En ellas la cuestión no es lo bueno que sea el modelo en la nube, sino si el audio tiene que salir del equipo. En un Mac con Apple silicon, no tiene por qué.

3 min de lectura · Actualizado 2026-09-23

Qué se ejecuta en local

En un Mac con Apple silicon, la app puede descargar dos modelos y ejecutarlos en el propio equipo: Whisper Large v3 Turbo para la transcripción y Qwen 3 8B para las respuestas. Una vez descargados, funcionan en el Mac, para sesiones cuyo audio no debe salir de la sala.

Elegir entre procesamiento en la nube y modelos locales es una decisión por caso de uso. Una reunión diaria y una consulta con una abogada no necesitan el mismo trato, y no tienes por qué elegir uno para todo.

Qué va adónde, según el modo

«Privado» se usa a menudo de forma vaga, así que conviene ser preciso.

  • Sesión en la nube: el audio del micrófono —y en el Mac, opcionalmente, el audio del sistema y la pantalla capturada— se transmite a la Realtime API de OpenAI para producir la transcripción y las respuestas. Los adjuntos se envían como contexto.
  • Sesión local en el Mac: los modelos descargados procesan el audio y el texto en el equipo.
  • En ambos casos, transcripciones, respuestas, sesiones, tareas y notas se guardan en el dispositivo, sin sincronización en la nube.
  • El backend de la app guarda cuentas, compras, saldo de créditos y registros de uso. No recibe ni guarda audio, transcripciones, respuestas ni adjuntos.

Las contrapartidas, con sinceridad

Un modelo que cabe en un portátil es más pequeño que uno que funciona en un centro de datos. Las respuestas de un modelo de ocho mil millones de parámetros bastan para muchas cosas —sacar decisiones, explicar un término, redactar un seguimiento—, pero en conocimiento amplio o razonamientos largos son claramente menos capaces que un gran modelo en la nube.

La descarga ocupa varios gigabytes y, mientras funcionan, los modelos usan de verdad memoria y potencia. En un Mac con Apple silicon reciente va bien; en uno antiguo, más lento. También por eso es una función del Mac: un teléfono no tiene margen para ello.

En iPhone y iPad

Los grandes modelos locales son solo para el Mac. En iPhone y iPad, la transcripción puede hacerla igualmente el reconocimiento de voz de Apple en el dispositivo en lugar de los modelos de OpenAI. Las respuestas siguen viniendo del modelo en la nube: la transcripción de tus palabras ocurre en el teléfono, la ayuda no.

Privado también se refiere a quienes están en la sala

Mantener el audio en el equipo lo protege de terceros. No cambia que estás recogiendo lo que dicen otras personas. Tienen derecho a saberlo y, en muchos lugares, la ley también lo exige; la guía sobre grabar y transcribir a otras personas explica qué decir.

¿En qué Mac funcionan los modelos locales?

En los Mac con Apple silicon. Los modelos se descargan una vez y se ejecutan en el equipo; los Mac más recientes van más rápido.

¿Los modelos locales funcionan en el iPhone?

No. En iPhone y iPad la transcripción puede hacerla el reconocimiento de voz de Apple en el dispositivo, pero el modelo local de respuestas es solo para el Mac.

¿Los servidores de la app ven alguna vez mis transcripciones?

No. El backend gestiona cuentas, compras y créditos; las transcripciones y respuestas se guardan en tu dispositivo.

Transcripción offline y privada en el Mac con Whisper