Transcribe any audio using Whisper AI — runs entirely in your browser. Private, free, no sign-up, no upload to servers.
Whisper — самая мощная open-source модель транскрипции. Исторически это означало Python, GPU и командную строку — совершенно недоступно большинству пользователей. Whisper в браузере переворачивает это: перетащите аудио, транскрибируйте, скачайте SRT или TXT. Без установки, без аккаунта, без кода.
Приватность — ключ. Клиентский Whisper означает, что аудио никогда не покидает устройство. Интервью, медицинская диктовка, юридические показания, конфиденциальные встречи — любое аудио, которое нельзя загружать в чужой API, теперь можно транскрибировать без риска.
Компромисс размера модели: tiny/base — самая быстрая, точность средняя, для чистого аудио. small/medium — практический баланс, справляется с акцентами, шумом, терминами. large — максимальная точность, но медленно — около 30 секунд вычислений на минуту аудио.
Чистое аудио важнее большой модели. Модель tiny на чистой записи превосходит large на мутном аудио. Если можете контролировать запись, используйте приличный микрофон, минимизируйте фоновый шум, пишите близко. Очень длинные файлы (2+ часа) могут упереться в память браузера — разделите на куски по 30 минут любым аудиоредактором и транскрибируйте отдельно.
Да — веса модели идентичны. Единственная разница — скорость вычислений, зависящая от вашего устройства, а не качества модели.
MP3, WAV, M4A, MP4, WebM, OGG, FLAC — всё, что браузер декодирует через Web Audio API. Видеофайлы тоже поддерживаются; извлекается аудиодорожка.
Работает — после однократной загрузки модели (кэшируется в браузере) транскрипция идёт полностью офлайн. Отлично для перелётов или изолированных устройств.
Whisper поддерживает 99 языков. Оставьте Автоопределение для незнакомого аудио; явно указывайте язык для чуть более быстрых и точных результатов.
Нет. Аудио декодируется и транскрибируется полностью в браузере через WebAssembly. Никаких загрузок, хранения, логов.