Whisper란?
AI 활용 분야에서 OpenAI가 2022년에 공개한 오픈소스 음성 인식 모델로, 다국어 음성을 텍스트로 변환하거나 영어로 번역해 자막·전사·음성 비서 기반 기능을 제공합니다.
CARD NEWS · 모델·서비스
SNS·수업 자료·발표 슬라이드에 붙여 쓰기 좋은 4장 세트입니다. 화면을 캡처하거나 브라우저의 인쇄 기능으로 PDF를 저장해 공유할 수 있습니다.
AI 활용 분야에서 OpenAI가 2022년에 공개한 오픈소스 음성 인식 모델로, 다국어 음성을 텍스트로 변환하거나 영어로 번역해 자막·전사·음성 비서 기반 기능을 제공합니다.
강의 녹음 파일을 그대로 받아 적어 주는 속기사라고 생각하면 됩니다. 조별 과제에서 1시간짜리 인터뷰를 한 줄씩 옮겨 적느라 새벽까지 앉아 있던 경험이 있다면, Whisper는 그 작업을 몇 분 만에 끝내 주는 도구예요. 영어·한국어·일본어 등 99개 언어를 알아듣고, 한국어로 말한 내용을 영어로 바꿔 주기도 합니다.
케이스 1: OpenAI 공개 — 68만 시간 학습, MIT 라이선스 오픈소스 2022년 9월 21일 OpenAI는 Whisper를 GitHub에 MIT 라이선스로 공개했습니다.[1][2] 웹에서 수집한 68만 시간의 다국어 음성-텍스트 쌍으로 학습한 인코더-디코더 트랜스포머이며, 같은 시점 OpenAI 블로그와 arXiv 논문(2212.04356)에 따르면 기존 지도 학습 모델 대비 강한…
카드를 캡처하거나 브라우저 인쇄 → PDF로 저장하면 인스타·수업 자료에 쓸 수 있습니다. CC BY-SA 4.0에 따라 출처(AI for Everyone by Percent · ai.percent.ac)와 라이선스를 표시하면 상업적으로도 이용할 수 있습니다. 내용을 바꿨다면 그 사실을 밝히고 같은 라이선스로 공유해 주세요.