Casos de uso para profesionales AEC
Tanto si estás inspeccionando a pie de obra, redactando el acta de una reunión de proyecto o dictando un correo entre tareas, Open Speech Studio funciona en cualquier lugar, incluso sin conexión.
Inspecciones a pie de obra
Dicta las observaciones directamente en Open Field Studio mientras haces fotos. Sin quitarte los guantes, sin teclear en una pantalla diminuta. Solo habla y listo.
Actas de reunión
Transcripción en tiempo real de reuniones de proyecto in situ. Todo se procesa localmente: sin preocupaciones de privacidad por nombres de clientes, precios o datos confidenciales del proyecto en la nube.
Correos rápidos en obra
Dicta en Outlook o Gmail entre tareas. Manos libres cuando tienes las manos sucias, llevas guantes de seguridad o sujetas una escalera.
Redacción de prompts de IA
Dicta un prompt para Claude o ChatGPT mucho más rápido que escribiendo. Hablar es ~3 veces más rápido y a menudo te expresas con más naturalidad: ideal para prompts largos y detallados.
Comentarios de código y commits
Dicta explicaciones de código, docstrings y mensajes de commit directamente en tu IDE o terminal. Funciona sin problemas en VS Code, Cursor, Neovim: en cualquier lugar donde puedas introducir texto.
Accesibilidad
Para personas con lesiones por esfuerzo repetitivo, con discapacidades motoras o lesiones temporales. Maneja todo tu ordenador sin teclado, conforme al RGPD y sin suscripciones.
¿Por qué local?
El reconocimiento de voz en la nube envía tu voz a servidores de terceros. Open Speech Studio lo hace todo en tu propio PC: más rápido, más seguro y sin costes mensuales.
Privacidad
Tu voz nunca sale de tu ordenador. Conforme al RGPD de forma automática: sin necesidad de contratos de encargo de tratamiento con proveedores externos, sin riesgo de filtraciones de datos.
Sin suscripción
Otter.ai cobra ~20 €/mes. Dragon NaturallySpeaking ~500 € en un pago único. Open Speech Studio es gratuito para siempre: código abierto LGPL-3.0.
0 € para siempreSin límites de uso
Dicta 10 horas al día si quieres. Sin cuotas de API, sin 'política de uso justo', sin facturas sorpresa. Tu hardware es el único límite.
| Característica | Open Speech Studio | Dragon NaturallySpeaking | Otter.ai |
|---|---|---|---|
| Precio | €0 (open source) | ~€500 one-time | ~€20/maand |
| 100 % local | Sí | Sí | No (nube) |
| Conforme al RGPD sin contrato de encargo | Sí | Sí | No |
| Idiomas | 99 talen (Whisper) | ~6 talen | ~10 talen |
| Aceleración GPU (CUDA) | Sí | No | N/D (nube) |
| Código abierto | Ja (LGPL-3.0) | No | No |
Funciones: ¿qué puede hacer?
Open Speech Studio es más que una herramienta de dictado. Es una suite completa de voz a texto con transcripción de archivos de audio, grabación de reuniones, varios modelos Whisper y exportación a formatos de subtítulos estándar.
Dicta en cualquier lugar
Dicta texto directamente en cualquier aplicación mediante una superposición a nivel de sistema. Funciona en Outlook, Word, Chrome, VS Code, Slack, Teams: literalmente en cualquier parte de tu sistema operativo.
Transcripción de archivos de audio
Transcribe archivos de audio (.mp3, .wav, .m4a, .ogg) con procesamiento en paralelo. Varios archivos a la vez, rápido y preciso.
Transcripción de reuniones en tiempo real
Graba reuniones de proyecto y observa cómo la transcripción aparece en tiempo real. Actas automáticas, incluso sin conexión a pie de obra.
Aceleración GPU con CUDA
Aceleración GPU con CUDA para resultados más rápidos. En una GPU moderna, Whisper Large funciona casi en tiempo real: uso óptimo de tu hardware.
Atajos de teclado
CTRL+Win para la superposición, CTRL+SHIFT+Espacio como alternativa. Sin clics de ratón ni búsquedas por menús: el dictado arranca en <100 ms.
Modelos Whisper AI
5 modelos: tiny, base, small, medium, large. Elige entre velocidad (tiny) o precisión (large). Uso de memoria de 1 a 10 GB según el modelo.
99 idiomas
Whisper es compatible con 99 idiomas: neerlandés, inglés, alemán, francés, español, polaco, árabe, chino mandarín y muchos más. Detección automática de idioma.
Superposición estilo Spotify
Interfaz de superposición elegante y minimalista con visualización de forma de onda en directo. No estorba y desaparece automáticamente tras insertar el texto.
Historial
Historial completo de transcripciones: consultable y reutilizable. Todo se guarda localmente, tú mantienes el control.
Exportación a TXT, SRT, VTT
Exporta transcripciones como texto plano (.txt) o como subtítulos (.srt, .vtt) para contenido de vídeo con marcas de tiempo.
Integración con el portapapeles
Integración automática con el portapapeles: dicta y pega directamente, o deja que el texto se inserte automáticamente en la posición del cursor.
100 % local
Todo se ejecuta localmente en tu propio ordenador. Tus datos nunca salen de tu PC. Sin nube, sin suscripción, sin límites. Conforme al RGPD desde el primer momento.
Atajos de teclado
Inicia la conversión de voz a texto en cualquier parte de tu sistema operativo:
Configurable en los ajustes: elige tu propio atajo si entra en conflicto con otro software.
Stack tecnológico
Open Speech Studio está construido sobre un stack moderno y de alto rendimiento. OpenAI Whisper para un reconocimiento de voz de última generación. Rust para un backend ligero y rápido (sin necesidad de runtime de Python). Tauri 2 para la aplicación de escritorio, mucho más ligera que Electron (~10 MB en lugar de 200 MB). TypeScript + Svelte para la interfaz. Totalmente de código abierto bajo LGPL-3.0.
Descárgalo ahora - instalación en 30 segundos
1 archivo instalador (.exe), sin registro, sin cuenta, sin tarjeta de crédito. Listo para dictar en <1 minuto. Funciona en Windows 10 y Windows 11.


