Inference란?
AI 모델 운영 분야에서 쓰이는 용어로, 이미 학습이 끝난 모델이 실제 입력을 받아 결과를 계산해 돌려주는 단계를 가리키며, 사용자가 ChatGPT 같은 서비스에서 답을 받는 순간이 모두 추론입니다.
CARD NEWS · 기본
SNS·수업 자료·발표 슬라이드에 붙여 쓰기 좋은 4장 세트입니다. 화면을 캡처하거나 브라우저의 인쇄 기능으로 PDF를 저장해 공유할 수 있습니다.
AI 모델 운영 분야에서 쓰이는 용어로, 이미 학습이 끝난 모델이 실제 입력을 받아 결과를 계산해 돌려주는 단계를 가리키며, 사용자가 ChatGPT 같은 서비스에서 답을 받는 순간이 모두 추론입니다.
공부는 끝낸 친구가 시험장에 들어가 실제 문제를 풀어 답을 내놓는 그 순간이 바로 추론이에요. 학습이 한 학기 내내 교재를 외우는 단계라면, 추론은 그 친구가 시험지를 받아 한 문제씩 답을 적어 내려가는 단계입니다. ChatGPT에 질문을 보냈을 때 답이 한 글자씩 흘러나오는 그 몇 초 동안 GPU 안에서 일어나는 일이 추론이에요.
000085갤런을 소비한다고 공개했습니다 [2]. 오븐을 1초 켜는 정도지만, 주간 활성 사용자 8억 명이 던지는 수십억 건이 누적되면 OpenAI의 추론 운영비는 GPT-4 학습 비용을 분기마다 추월한다는 분석이 나옵니다. 알트먼은 같은 글에서 "주어진 지능 수준을 쓰는 비용이 12개월마다 약 10배씩 떨어지고 있다"고 밝혔습니다 [2].
카드를 캡처하거나 브라우저 인쇄 → PDF로 저장하면 인스타·수업 자료에 쓸 수 있습니다. CC BY-SA 4.0에 따라 출처(AI for Everyone by Percent · ai.percent.ac)와 라이선스를 표시하면 상업적으로도 이용할 수 있습니다. 내용을 바꿨다면 그 사실을 밝히고 같은 라이선스로 공유해 주세요.