CARD NEWS · 기본

Inference 4장 카드뉴스

SNS·수업 자료·발표 슬라이드에 붙여 쓰기 좋은 4장 세트입니다. 화면을 캡처하거나 브라우저의 인쇄 기능으로 PDF를 저장해 공유할 수 있습니다.

1/4
기본

Inference란?

AI 모델 운영 분야에서 쓰이는 용어로, 이미 학습이 끝난 모델이 실제 입력을 받아 결과를 계산해 돌려주는 단계를 가리키며, 사용자가 ChatGPT 같은 서비스에서 답을 받는 순간이 모두 추론입니다.

2/4
쉬운 풀이

이렇게 이해하면 쉬워요

공부는 끝낸 친구가 시험장에 들어가 실제 문제를 풀어 답을 내놓는 그 순간이 바로 추론이에요. 학습이 한 학기 내내 교재를 외우는 단계라면, 추론은 그 친구가 시험지를 받아 한 문제씩 답을 적어 내려가는 단계입니다. ChatGPT에 질문을 보냈을 때 답이 한 글자씩 흘러나오는 그 몇 초 동안 GPU 안에서 일어나는 일이 추론이에요.

3/4
활용 사례

누가·언제 쓰나?

000085갤런을 소비한다고 공개했습니다 [2]. 오븐을 1초 켜는 정도지만, 주간 활성 사용자 8억 명이 던지는 수십억 건이 누적되면 OpenAI의 추론 운영비는 GPT-4 학습 비용을 분기마다 추월한다는 분석이 나옵니다. 알트먼은 같은 글에서 "주어진 지능 수준을 쓰는 비용이 12개월마다 약 10배씩 떨어지고 있다"고 밝혔습니다 [2].

4/4
더 알아보기

ai.percent.ac
/word/inference

AI for Everyone by Percent · CC BY-SA 4.0
← 원문 페이지

카드를 캡처하거나 브라우저 인쇄 → PDF로 저장하면 인스타·수업 자료에 쓸 수 있습니다. CC BY-SA 4.0에 따라 출처(AI for Everyone by Percent · ai.percent.ac)와 라이선스를 표시하면 상업적으로도 이용할 수 있습니다. 내용을 바꿨다면 그 사실을 밝히고 같은 라이선스로 공유해 주세요.