OpenSuperWhisper
starmel and OpenSuperWhisper contributors · Aplicación gratuita y de código abierto de dictado y transcripción de audio para Mac con Apple silicon que usa modelos Whisper y Parakeet descargados localmente.
Descripción
Traducción con IAVer originalOpenSuperWhisper graba audio y lo transcribe en un Mac con Apple silicon. Es adecuado para quienes buscan dictado activado mediante el teclado, transcripción de grabaciones existentes y control sobre los modelos de voz descargados localmente. El editor describe los motores Whisper y FluidAudio Parakeet, en lugar de un servicio obligatorio de transcripción alojado en servidores.
Grabación y transcripción
Inicia o detén la grabación con un atajo de teclado global, una tecla modificadora o un botón de ratón compatible. El modo de mantener pulsado para grabar se detiene al soltar el activador. Elige un micrófono integrado, externo, Bluetooth o de Continuidad de Apple desde la barra de menús. Arrastra archivos de audio a la aplicación para ponerlos en cola de transcripción y busca en el historial resultante.
La versión 0.1.0 permite abrir archivos de audio desde Finder y mejora el manejo de contenedores MP4. La detección automática del idioma y el espaciado opcional de los signos de puntuación facilitan el dictado, pero el reconocimiento de voz sigue siendo imperfecto. Revisa nombres, números, puntuación y términos técnicos antes de enviar una transcripción. El README aún incluye la transcripción en tiempo real como tarea futura; la grabación y el procesamiento posterior no deben presentarse como un motor de texto en tiempo real plenamente implementado.
Instalación y requisitos verificados del editor
Copia la aplicación del DMG oficial a Aplicaciones o utiliza brew install --cask opensuperwhisper. El DMG 0.1.0 comprobado ocupa 11,671,615 bytes. Esa versión concreta indica que requiere macOS 14.0 Sonoma o posterior y Apple silicon ARM64. La compatibilidad con Intel figura como tarea pendiente en el repositorio y no debe darse por supuesta. La inspección de solo lectura confirma la versión 0.1.0, la compilación 13, un mínimo de macOS 14.0 y un ejecutable arm64.
Descarga los archivos de modelos desde los ajustes de modelos de la aplicación; sus necesidades de espacio en disco y memoria se suman a la pequeña descarga de la aplicación. Los modelos más grandes pueden usar mucha más memoria y tardar más. El README también describe cómo añadir manualmente archivos de modelos Whisper y un modelo ajustado para hebreo. Las licencias de los modelos son independientes de la licencia MIT de la aplicación. Las herramientas para compilar desde el código fuente, como CMake, Rust y Ruby, son requisitos de desarrollo, no requisitos generales para la aplicación publicada.
Permisos, cuenta y red
El permiso de micrófono es necesario para grabar audio. Los activadores globales y la inserción de texto dictado en otra aplicación pueden requerir permisos de entrada o accesibilidad de macOS; concede solo el acceso pertinente para las funciones que actives. Elegir un micrófono de entrada no implica grabar cualquier audio del sistema. Los archivos importados requieren acceso de lectura. Otras aplicaciones pueden recibir el texto insertado y tratarlo según sus propias políticas.
El editor describe modelos locales descargables y no exige una cuenta ni una suscripción de OpenSuperWhisper. El acceso a la red se utiliza para obtener modelos, versiones y documentación. La transcripción local no equivale a afirmar que todos los actualizadores, las descargas de modelos o las aplicaciones externas funcionen sin conexión. FluidAudio, Whisper y los proveedores de modelos pueden tener avisos y condiciones independientes.
Licencia y riesgos para los datos
El proyecto es gratuito y de código abierto bajo la licencia MIT. Esta aplicación es independiente del producto comercial Superwhisper y no proporciona la cuenta ni la suscripción de ese producto. El historial de audio y transcripciones puede contener conversaciones privadas, registros de clientes y credenciales. Obtén permiso para grabar a otras personas, revisa el historial conservado y elimina los ejemplos con información sensible de los informes de errores. Borrar todo es una acción del usuario, no una prueba de que todos los archivos, copias de seguridad o copias de diagnóstico se eliminen de forma segura.
Conserva la grabación original cuando la precisión sea importante. Los retrasos de conexión Bluetooth, un micrófono incorrecto o los errores de transcripción pueden provocar la pérdida de información importante. Comprueba el indicador de grabación antes de hablar y revisa la transcripción final antes de la inserción automática.
Fuentes: Repositorio oficial, README actual, Versiones concretas.
Novedades Novedades de 0.1.0 7 oct · Editado por OpenNavo · Traducción por IA
- CambiosAñade espacios opcionales después de los signos de puntuación.