실시간 음성 인식 구현하기
마이크 입력을 실시간으로 캡처해 Whisper로 전사하는 실시간 음성 인식 앱을 구현합니다.
같은 일을 더 자세히 다룬 글: OpenAI Whisper로 음성·영상 텍스트 변환하기따라 하기
1단계
마이크 스트리밍 설정
pyaudio 또는 sounddevice 라이브러리로 마이크 오디오를 실시간 버퍼에 캡처합니다.
3~5초 단위로 청크를 나눠 처리합니다.
openai.com/research/whisper
누를 위치 pyaudio 설치›마이크 스트림 열기›청크 캡처›버퍼 저장
팁 pyaudio 설치 시 portaudio 의존성이 필요합니다(Mac: brew install portaudio).