Transcribe any audio using Whisper AI — runs entirely in your browser. Private, free, no sign-up, no upload to servers.
Whisper는 현재 최강의 오픈소스 전사 모델입니다. 과거에는 Python, GPU, 커맨드라인이 필요해 일반 사용자에게는 접근 불가능했습니다. 브라우저 Whisper는 오디오 드롭 → 전사 → SRT 또는 TXT 다운로드로 바꿉니다 — 설치 없이, 계정 없이, 코드 없이.
프라이버시가 결정적입니다. 클라이언트 사이드 Whisper는 오디오가 절대 기기 밖으로 나가지 않는다는 뜻. 인터뷰 녹음, 의료 구술, 법적 증언, 기밀 회의 — 제3자 API에 올릴 수 없는 오디오도 안전하게 전사 가능.
모델 크기 절충: tiny/base는 가장 빠르지만 정확도 보통, 깨끗한 오디오용. small/medium은 실용적 스위트 스팟, 억양·잡음·전문 용어를 무난히 처리. large는 최고 정확도지만 느림 — 오디오 1분당 약 30초 연산 시간.
깨끗한 오디오가 큰 모델보다 중요합니다. tiny 모델도 깨끗한 녹음이면 large가 탁한 오디오를 처리하는 것보다 결과가 낫습니다. 녹음을 제어할 수 있다면 좋은 마이크, 배경 소음 억제, 근접 마이크 사용. 초장시간 파일(2+시간)은 브라우저 메모리에 걸릴 수 있음 — 오디오 편집기로 30분 청크로 나누고 각각 전사.
네 — 모델 가중치가 완전히 동일합니다. 차이는 계산 속도뿐이며 모델 품질이 아닌 기기에 달려있습니다.
MP3, WAV, M4A, MP4, WebM, OGG, FLAC — 브라우저가 Web Audio API로 디코딩할 수 있는 모든 것. 비디오 파일도 지원, 오디오 트랙 추출.
작동합니다 — 모델을 한 번 다운로드(브라우저에 캐시)하면 전사는 완전 오프라인. 비행기 안이나 에어갭 기기에서 유용.
Whisper는 99개 언어 지원. 알 수 없는 오디오에는 자동 감지; 알려진 언어는 명시하면 약간 더 빠르고 정확한 결과.
아니요. 오디오는 브라우저 내부에서 WebAssembly로 디코딩·전사됩니다. 업로드, 저장, 로그 없음.