Audio

Whisper

음성 파일을 텍스트로

GitHub 설명이 대규모 약지도 학습을 사용한 음성 인식 모델이라고 소개합니다. 소프트웨어는 MIT이며, 실행에 필요한 계산 자원은 따로 듭니다.

소프트웨어 MIT · 연산 비용은 별도MITOpen Source지원 OS는 공식 문서에서 확인
</>WhisperSOURCE AVAILABLE
WHEN TO USE

언제 쓰면 좋음

  • 녹음 파일을 텍스트 초안으로 바꿀 때
  • 음성 기록 후 사람이 다시 고칠 원문이 필요할 때
  • 회의 녹음을 메모 초안으로 받을 때
  • 인터뷰 파일의 구간별 텍스트가 필요할 때
WORKFLOW

어떻게 사용하나요?

1README의 설치 방법 확인
2오디오 길이와 포맷 확인
3텍스트 초안 생성
4사람이 고유명사를 교정
INSTALL

설치하기

설치 방법은 https://github.com/openai/whisper README를 기준으로 확인하세요.

설치 명령은 프로젝트 릴리스에 따라 달라질 수 있으므로 공식 문서를 최종 기준으로 사용합니다.

FEATURES

주요 기능

✦음성 인식
✦MIT 라이선스
✦정확도는 오디오와 언어에 따라 달라짐
DEMO

데모

NO DEMO FILE Whisper 사용 영상은 아직 없습니다

이 카드에 재생할 파일을 넣어 두지 않았습니다. 동작은 공식 문서에서 확인하세요.

RELATED

관련 도구

</> Local AI

LocalAI

↗

여러 종류의 모델을 로컬 엔진으로

소프트웨어 MIT · 모델 비용은 별도 Open Source
언제 쓰면 좋음로컬 모델을 OpenAI 스타일 API처럼 붙이고 싶을 때
자세히 보기 →