회의, 강연, 인터뷰 등 음성 파일을 구조화된 Markdown 문서로 변환합니다.
WAV, MP3, FLAC 오디오를 입력하면 시간 기반으로 파트가 나뉜 깔끔한 전사본을 생성합니다.
오디오 파일만 지정하면 플랫폼 감지부터 전사, 후처리까지 자동으로 진행됩니다.
주요 기능
Apple Silicon Mac 감지 시 mlx-whisper로 무료 로컬 전사 (인터넷 불필요, 모델 다운로드는 인터넷 필요)
그 외 환경에서는 OpenAI Whisper API 자동 전환 (25MB 초과 시 자동 분할)
한국어 Whisper 특유의 반복 환각 자동 제거 (짧은 단어부터 긴 문장까지)
5분 단위 시간 파트로 분할된 Markdown 출력
지원 플랫폼
macOS (Apple Silicon): mlx-whisper 로컬 + OpenAI API
macOS (Intel) / Linux / Windows: OpenAI API
기본 언어는 한국어이며, --language 옵션으로 다른 언어도 지정할 수 있습니다.
단, 환각 제거는 한국어에 적용되어 있습니다.