대용량 오디오 배치 처리하기

중급약 25분3단계

여러 오디오 파일을 자동으로 처리해 텍스트로 변환하는 배치 파이프라인을 구축합니다.

같은 일을 더 자세히 다룬 글: OpenAI Whisper로 음성·영상 텍스트 변환하기

따라 하기

1단계 / 3

파일 목록 처리 스크립트

  1. 폴더의 모든 MP3 파일을 glob으로 찾고 반복문으로 각각 Whisper API를 호출합니다.
  2. ›파일명과 같은 이름의 .txt 파일로 결과를 저장합니다.
Whisper 열기

이해를 돕는 예시 그림이에요. 실제 화면과 다를 수 있어요.

openai.com/research/whisper
Whisperby OpenAI
음성을 텍스트로 변환
98개 언어 지원, 높은 정확도의 음성 인식 AI
오디오 파일을 드래그하거나 클릭MP3, MP4, WAV, M4A 지원 (최대 25MB)
한국어
English
日本語
中文

누를 위치 glob.glob(*.mp3)›반복›transcriptions.create()›txt 저장

팁 API 레이트 리밋을 고려해 요청 사이에 time.sleep(1)을 추가하세요.