언제 쓰면 좋음
- 녹음 파일을 텍스트 초안으로 바꿀 때
- 음성 기록 후 사람이 다시 고칠 원문이 필요할 때
- 회의 녹음을 메모 초안으로 받을 때
- 인터뷰 파일의 구간별 텍스트가 필요할 때
GitHub 설명이 대규모 약지도 학습을 사용한 음성 인식 모델이라고 소개합니다. 소프트웨어는 MIT이며, 실행에 필요한 계산 자원은 따로 듭니다.
설치 방법은 https://github.com/openai/whisper README를 기준으로 확인하세요.설치 명령은 프로젝트 릴리스에 따라 달라질 수 있으므로 공식 문서를 최종 기준으로 사용합니다.
이 카드에 재생할 파일을 넣어 두지 않았습니다. 동작은 공식 문서에서 확인하세요.
여러 종류의 모델을 로컬 엔진으로