설명
Whisper Web은 OpenAI의 Whisper AI 모델을 기반으로 한 브라우저 기반 음성 인식 플랫폼입니다. 이 플랫폼은 WebGPU와 WebAssembly를 사용하여 브라우저 내에서 오디오를 로컬로 처리하며, 다운로드, 설치 또는 서버 업로드 없이 음성-텍스트 전사를 제공합니다. 무료 모드에서는 오디오가 장치를 떠나지 않으며, 첫 방문 시 모델이 로드되면 전사는 완전히 오프라인으로 작동합니다.
이 도구는 100개 이상의 언어를 자동으로 감지하여 지원하므로 수동 선택이 필요하지 않습니다. 마이크 입력, 파일 업로드 또는 URL에서 전사가 가능하며, 결과를 TXT, JSON, SRT 및 VTT 형식으로 내보낼 수 있습니다. 처리 과정이 로컬에서 이루어지기 때문에 Whisper Web은 계정이 필요 없으며 데이터를 수집하지 않습니다.
무료 플랜에서는 최대 200MB 및 20분의 파일을 전사할 수 있으며, 전사 횟수에 제한이 없습니다. Whisper Web Unlimited는 최대 10시간 및 5GB의 대용량 파일을 위한 선택적 안전한 클라우드 워크플로우를 추가하며, 한 번에 50개의 파일을 배치 업로드하고 장치 간 전사 동기화를 지원합니다. 요금은 월 20달러 또는 연간 청구 시 월 10달러입니다. 클라우드 파일은 전사 후 삭제됩니다.
Whisper Web의 핵심 기능
OpenAI Whisper 기반의 브라우저 기반 음성-텍스트 변환
무료 모드에서 업로드 없이 개인 정보 보호를 우선시하는 로컬 처리
자동 감지가 가능한 100개 이상의 언어
WebGPU 및 WebAssembly 가속
마이크, 파일 업로드 및 URL 입력 지원
TXT, JSON, SRT 및 VTT로 내보내기
모델 로드 후 오프라인 전사
대용량 파일 및 배치 업로드를 위한 선택적 클라우드 모드
Whisper Web 사용 방법은?
Whisper Web 열기: 브라우저에서 사이트를 로드하며, 계정이 필요하지 않습니다.
모델 선택: 기본 Base 모델을 사용하거나 느린 장치를 위한 Tiny 모델을 선택합니다.
오디오 로드: MP3, WAV, M4A 또는 비디오 파일을 드래그 앤 드롭하거나 마이크 또는 URL을 사용합니다.
전사: 시작 버튼을 클릭하여 브라우저 내에서 AI 모델을 로컬로 실행합니다.
내보내기: TXT, JSON, SRT 또는 VTT 형식으로 전사본 또는 자막을 다운로드합니다.
Whisper Web의 사용 사례
- 개인 전사
- 자막 생성
- 짧은 클립
- 대용량 파일 전사







