
Un prompt no tiene por qué ser un discurso
Cuenta el cambio, el error o el caso límite en voz baja. El resto de la oficina no necesita enterarse.
HECHO PARA PROGRAMAR EN ESPACIOS COMPARTIDOS
Acerca el iPhone y mantén pulsado para hablar. Puedes bajar la voz: el Mac transcribe en local y coloca el texto justo donde ya está el cursor.

01 / UNA IDEA MUY SIMPLE
Desde lejos, el micrófono del MacBook recoge teclado, aire acondicionado y conversaciones junto con tu voz. Al acercarlo a la boca, tu voz llega primero y con más fuerza. Así puedes hablar más bajo sin pedirle al modelo que arregle una grabación deficiente.
IPHONE → MAC / ASÍ SE USA
El iPhone capta tu voz de cerca. El audio cifrado llega al Mac enlazado, se reconoce allí mismo y se inserta en el cursor activo.
ScenicRouteRanker.swift

Cuenta el cambio, el error o el caso límite en voz baja. El resto de la oficina no necesita enterarse.

Acercar el micro no silencia la oficina. Hace que tu voz destaque antes de que empiece el reconocimiento.
El foco permanece en Codex, Claude Code, Xcode, Terminal o el navegador. La transcripción llega al cursor.
02 / LO QUE IMPORTA EN LA MESA
Esto es lo que cambia el día a día: la distancia al micrófono, adónde va el audio y cuántos pasos quedan después de hablar.
El iPhone puede estar a centímetros de tu boca mientras el MacBook sigue a 50–80 cm.
Estimación basada solo en distancia. La sala, el ángulo y cada micrófono cambian el resultado real.
El reconocimiento se ejecuta en el Mac. Con el modelo preparado, el uso local no necesita internet público.
El audio se procesa en memoria y se descarta, sin archivos en el iPhone ni en el Mac.
Sin otra app, sin viajes por el portapapeles y sin perder el contexto.
El historial del Mac conserva una hora por defecto y puede desactivarse por completo.
03 / MODELOS E IDIOMAS
undervoice usa paquetes ajustados por idioma en lugar de prometer que un único modelo sirve igual para todo. En español, alemán, francés, chino, japonés o coreano puedes decir nombres de librerías, variables y comandos en inglés con naturalidad. También hay un modo solo en inglés.
Un modelo bilingüe genera la vista previa; Paraformer o FireRedASR2 CTC produce el texto final y la puntuación en local.
NVIDIA Parakeet TDT 0.6B v3 impulsa los paquetes de inglés, alemán, francés y español ajustados para el producto.
Kotoba Whisper Bilingual v1.0 se entrenó para japonés, inglés y el cambio natural entre ambos.
Whisper Large v3 Turbo cubre frases en coreano y el vocabulario técnico inglés que contienen, con tiempos razonables en local.
En WER y CER, menos es mejor. El 6,34 % y el 9,3–16,8 % proceden de pruebas publicadas de los modelos base completos. No son una nota global de undervoice con audio cercano del iPhone, modelos cuantizados e idiomas mezclados. Métricas y conjuntos distintos no forman una clasificación justa.
04 / IPHONE FRENTE AL MICRO DEL MACBOOK
Ambas opciones pueden usar el mismo modelo local en el Mac. La diferencia está en el origen: a centímetros de la boca o al otro lado de la mesa.
| En oficina compartida | iPhone cerca | Micrófono del MacBook |
|---|---|---|
| Distancia boca–micro | 5–10 cm | 50–80 cm |
| Al hablar bajo | Tu voz llega primero | Voz, teclado, climatización y conversaciones llegan juntas |
| Volumen necesario | Puedes mantener la voz baja | A distancia suele tocar hablar más alto |
| Dónde se reconoce | En local, en tu Mac | En local, en tu Mac |
| Ideal para | Oficinas abiertas y mesas compartidas | Habitaciones privadas o contenido no sensible |
La estimación de 14–24 dB usa la relación de campo libre 20 × log10(r₂/r₁) para 5–10 cm frente a 50–80 cm. Los reflejos, la colocación y la dirección de la voz cambian el resultado.
05 / SEGURIDAD Y RED
undervoice no tiene un relé de voz. En la misma red, el iPhone conecta directamente con el Mac; entre redes, puedes usar tu propio Tailscale. La autenticación y el cifrado de la app siguen activos en ambos casos.
Instalación y permisos →Compartir Wi-Fi no basta. Un iPhone nuevo debe enlazarse de forma explícita.
Audio, transcripciones y control se autentican y cifran de extremo a extremo.
Cada reconexión deriva una clave de sesión distinta.
La grabación vive en memoria. Los diagnósticos no contienen audio ni texto transcrito.
En la red local, el audio va directo del iPhone al Mac y el modelo se ejecuta allí.
Para otra Wi-Fi o datos móviles, usa tu Tailscale sin perder el cifrado de undervoice.
06 / ESCRIBE EN CUALQUIER PARTE
«Mantén la API pública, cambia los reintentos a espera exponencial y añade tres pruebas de casos límite.»
escuchandoAl empezar, el Mac recuerda la app y la selección activas. Si cambia el foco, la inserción se pausa. Los campos de contraseña y los controles con Secure Keyboard Entry nunca reciben texto.
HABLA CON TU MAC, NO CON TODA LA SALA
Instala el modelo en el Mac, escanea el código de enlace con el iPhone y mantén pulsado para hablar.