Créditos

Créditos de código abierto

El software y los modelos de código abierto que se ejecutan en tu navegador en este sitio, con sus licencias y dónde conseguir su código fuente.

whisper.cpp y ggml

whisper.cpp es el programa de reconocimiento de voz que escribe tus subtítulos. Lo compilamos a WebAssembly, con una pequeña interfaz propia, y se ejecuta en la pestaña de tu navegador. ggml, la biblioteca de aprendizaje automático que lleva dentro, es de los mismos autores y tiene la misma licencia. Copyright (c) 2023-2026 The ggml authors.

Código fuente: github.com/ggml-org/whisper.cpp, versión 1.9.4. Con licencia MIT.

Pesos del modelo Whisper

Whisper es el modelo de reconocimiento de voz. OpenAI publicó su código y sus pesos; este sitio ofrece dos de sus tamaños, base (el modelo pequeño) y small (el grande), en los archivos ggml cuantizados que publica el proyecto whisper.cpp. Copyright (c) 2022 OpenAI.

Código fuente: github.com/openai/whisper; los archivos ggml: huggingface.co/ggerganov/whisper.cpp. Con licencia MIT.

Silero VAD

Silero VAD es el detector de voz que marca los tramos con habla, para que el modelo dedique su tiempo a la voz. Copyright (c) 2020-present Silero Team.

Código fuente: github.com/snakers4/silero-vad, versión 5.1.2, en el archivo ggml de huggingface.co/ggml-org/whisper-vad. Con licencia MIT.

JSON for Modern C++

Esta biblioteca de Niels Lohmann va compilada dentro del motor, donde lee los ajustes que envía la página y devuelve los resultados. Copyright (c) 2013-2022 Niels Lohmann.

Código fuente: github.com/nlohmann/json, versión 3.11.2, tal como la incluye whisper.cpp. Con licencia MIT.

El entorno de ejecución de Emscripten

Emscripten es el compilador que convierte el motor en WebAssembly. Partes de su entorno de ejecución van dentro de cada versión del motor: el código JavaScript de enlace y las bibliotecas estándar de C y C++.

emdawnwebgpu y webgpu-headers

Estos dos solo van en la versión WebGPU del motor, que la página descarga únicamente si tu navegador ofrece un adaptador gráfico que pasa la comprobación de la página. Conectan el motor con el WebGPU de tu navegador.

Mediabunny

Mediabunny lee el archivo que eliges, por partes, dentro de tu navegador, y decodifica su sonido con los decodificadores del propio navegador. Copyright (c) 2026-present, Vanilagy y colaboradores.

Código fuente: github.com/Vanilagy/mediabunny, versión 1.59.1, usado sin cambios. Con licencia Mozilla Public License 2.0; el código fuente de cada archivo que usamos está en ese repositorio, en esa versión.