CATEGORY · 49개 용어

모델·서비스

GPT·Claude·Gemini, 주요 모델의 정체성

왜 알아야 하나

모델은 이름이 비슷해도 잘하는 일과 비용이 다릅니다. 같은 업무를 어떤 모델에 맡기느냐에 따라 결과의 품질과 월 지출이 함께 달라집니다. 이 주제는 지금 쓸 수 있는 주요 모델과 서비스가 각각 무엇을 위해 만들어졌는지를 정리합니다. 도구를 고르기 전에 읽으면 비교의 기준이 생깁니다.

TERMS

이 카테고리의 49개 용어

Gemma
젬마
Gemma는 구글 딥마인드가 가중치를 공개하는 경량 오픈 웨이트 모델 제품군입니다. Gemini와 같은 연구·기술을 바탕으로 만들어졌고, 노트북이나 워크스테이션, 사내 서버에서 직접 실행할 수 있습니다 [1]. 첫 공개는 2024년 2월 2B·7B 두 종이었습니다 [1]. Gemma 1~3 계열은 OSI 오픈소스 정의를 충족하지 않는 Gemma 이용약관과 금지 사용 정책이 붙은 형태였습니다 [2]. 2026년 4월 공개된 Gemma 4부터는 Apache 2.0으로 바뀌었습니다 [4].
AI Mode
에이아이 모드
구글 검색에 들어온 대화형 AI 검색 기능입니다. 제미나이의 맞춤 버전을 기반으로 복잡한 질문을 한 번에 처리하고 후속 질문을 이어갈 수 있으며, 하나의 질문을 여러 검색으로 나눠 돌리는 쿼리 팬아웃 기술을 씁니다. 요약을 보여 주는 AI 오버뷰보다 한 단계 더 들어간 형태입니다. 2025년 9월 한국어 서비스가 시작됐고, 2026년 2분기 실적 발표 기준 월 사용자 10억 명을 넘어섰습니다.
Solar
솔라
국내 AI 스타트업 업스테이지가 개발하는 거대언어모델 시리즈입니다. 2023년 말 작은 모델을 쌓아 성능을 높이는 뎁스 업스케일링 기법의 솔라 10.7B로 이름을 알렸습니다. 2025년 7월 솔라 프로 2가 글로벌 평가기관 아티피셜 애널리시스의 프런티어 모델 10종에 국내 모델 최초로 선정됐고, 같은 해 8월 정부 독자 AI 파운데이션 모델 사업의 5개 정예팀에 뽑혔습니다. 2026년 7월에는 가중치를 공개한 솔라 오픈 2를 내놓았습니다. 작은 파라미터로 높은 성능을 내는 효율 중심 전략이 특징입니다.
AI Overviews
에이아이 오버뷰
구글 검색 결과 상단에 AI가 생성한 요약 답변을 먼저 보여 주는 기능입니다. 제미나이 모델이 여러 웹문서를 종합해 핵심을 제시하고 출처 링크를 함께 표시합니다. 2024년 5월 미국에서 정식 출시됐고, 같은 해 12월 한국어 서비스가 시작됐습니다. 2025년 2분기 실적 발표 기준 월 사용자 20억 명 규모입니다. AI 요약이 뜨면 이용자가 아래 링크를 누르는 비율이 낮아진다는 조사도 있어, 검색 유입에 의존해 온 콘텐츠·마케팅 실무에 직접 영향을 주는 변화로 꼽힙니다.
VLM
브이엘엠
인공지능 분야에서 쓰이는 Vision-Language Model(비전-언어 모델)의 약자로, 이미지와 텍스트를 함께 입력받아 텍스트로 답하는 멀티모달 모델입니다. 보통 이미지를 이해하는 비전 인코더, 두 표현을 정렬하는 프로젝터, 답을 생성하는 언어 모델을 이어 붙인 구조입니다. 2021년 OpenAI가 이미지-텍스트 쌍 4억 개로 학습한 CLIP으로 기반을 열었고, 2023년 GPT-4V 공개로 상용화가 본격화됐습니다. 문서 판독, 차트 해석, 화면을 보고 조작하는 에이전트의 눈 역할까지 활용 범위가 넓어지고 있습니다.
NotebookLM
노트북엘엠
구글이 만든 소스 기반(source-grounded) AI 리서치 도구입니다. 사용자가 올린 문서·슬라이드·영상 링크 등 지정한 자료 안에서만 근거를 찾아 요약·질의응답을 수행하고, 답변에 출처 표시를 붙입니다. 2023년 구글 I/O에서 프로젝트 테일윈드로 처음 공개된 뒤 NotebookLM으로 정식 출시됐고, 두 명의 AI 진행자가 자료를 팟캐스트처럼 풀어 주는 오디오 오버뷰로 주목받았습니다. 2026년 7월 제미나이 노트북(Gemini Notebook)으로 이름을 바꿨습니다.
TTS
티티에스
음성 AI 분야에서 쓰이는 Text-to-Speech(텍스트 음성 변환)의 약자로, 글로 된 문장을 사람 목소리 같은 음성으로 바꿔 주는 기술입니다. 음성을 텍스트로 옮기는 STT의 반대 방향입니다. 2016년 DeepMind의 WaveNet이 파형을 직접 생성하는 딥러닝 방식으로 품질을 크게 끌어올린 뒤, 지금은 몇 초 분량 샘플로 특정인의 목소리를 재현하는 수준까지 왔습니다. 내레이션·더빙·AI 상담·음성 에이전트에서 '입' 역할을 맡습니다.
EXAONE
엑사원
LG AI연구원이 개발한 대형 언어 모델(LLM) 계열의 브랜드로, 'EXpert AI for everyONE(모두를 위한 전문가 AI)'에서 이름을 따 왔습니다. 2021년 초거대 모델로 출발해 2025년 7월 추론을 결합한 국내 첫 하이브리드 모델 4.0(32B·1.2B)을 오픈 웨이트로 공개했고, 2026년 1월에는 MoE 구조의 K-EXAONE(총 2,360억·활성 230억 파라미터)으로 정부 독자 AI 파운데이션 모델 1차 평가 1위에 올랐습니다. 병리 진단 AI 'EXAONE Path' 등 산업·의료 특화 모델로 확장 중입니다.
HyperCLOVA X
하이퍼클로바 엑스
네이버가 개발한 한국어 중심 대형 언어 모델(LLM) 계열이자 이를 기반으로 한 생성형 AI 브랜드입니다. 2023년 8월 공개 이후 검색(AI 브리핑), 대화형 서비스(클로바 X), 기업용 클라우드 API로 확장됐고, 2025년에는 경량 모델 3종(SEED)을 상업용 오픈소스로, 추론 특화 모델 씽크(THINK)를 순차 공개했습니다. 한국어 데이터 비중이 높아 국내 언어·문화 맥락 이해에 강점이 있으며, 네이버 소버린 AI 전략의 핵심 자산입니다.
딥 리서치
Deep Research
AI 서비스 분야에서 쓰이는 용어로, 챗봇이 즉답하는 대신 수 분에서 수십 분간 수십~수백 개의 웹 문서를 스스로 검색·열람·교차검증한 뒤 출처를 단 보고서 형태로 결과를 내놓는 에이전트형 조사 기능을 가리킵니다. 2024년 12월 구글 제미나이가 처음 선보였고, 2025년 2월 OpenAI가 같은 이름의 기능을 내놓으며 업계 공통 명칭처럼 굳었습니다. 추론 모델이 조사 계획을 세우고 검색 도구를 반복 호출하는 구조로, 시장조사·경쟁분석·문헌조사 같은 사무 업무에 쓰입니다.
MoE
믹스처 오브 엑스퍼츠
모델 구조 분야에서 쓰이는 Mixture of Experts(전문가 혼합)의 약자로, 여러 전문가 하위망 중 입력마다 일부만 골라 활성화하는 신경망 구조입니다. '라우터'라 불리는 게이팅 신경망이 토큰마다 소수의 전문가만 선택합니다. 전체 파라미터 수는 크게 늘리되 실제 계산에는 일부만 쓰기 때문에, 같은 연산량으로 더 큰 모델급 성능을 노립니다. Mixtral, DeepSeek-V3 같은 최신 대형 모델이 이 구조를 채택했습니다.
Fireworks AI
파이어웍스
AI 인프라 분야에서 미국 Fireworks AI가 2022년에 창업해 운영하는 오픈모델 추론 서비스로, Llama·Mistral·Qwen 같은 모델을 자체 최적화 엔진으로 빠르고 저렴하게 호출할 수 있게 해줍니다.
Together AI
투게더
AI 인프라 분야에서 미국 Together AI가 2022년에 창업해 운영하는 오픈모델 추론·학습 클라우드로, Llama·Mistral·Qwen 같은 오픈웨이트 모델을 API 한 줄로 호출해 쓸 수 있게 해줍니다.
Groq
그록
AI 인프라 분야에서 미국 Groq Inc.가 2016년에 창업해 자체 설계한 LPU 추론 칩으로, Llama·Mistral 같은 오픈 모델을 초고속으로 실행하는 클라우드 추론 서비스를 함께 운영합니다.
Replicate
레플리케이트
AI 인프라 분야에서 미국 Replicate가 2019년에 창업해 운영하는 모델 호스팅 플랫폼으로, 오픈웨이트 LLM·이미지·영상 모델을 API 한 줄로 호출해 쓸 수 있게 해줍니다.
Hugging Face
허깅페이스
AI 개발도구 분야에서 2016년에 설립된 Hugging Face가 운영하는 모델·데이터셋 공유 플랫폼으로, 누구나 머신러닝 모델을 업로드하고 사용·파인튜닝할 수 있도록 라이브러리와 호스팅 인프라를 제공합니다.
Whisper
위스퍼
AI 활용 분야에서 OpenAI가 2022년에 공개한 오픈소스 음성 인식 모델로, 다국어 음성을 텍스트로 변환하거나 영어로 번역해 자막·전사·음성 비서 기반 기능을 제공합니다.
Udio
우디오
AI 활용 분야에서 미국 Uncharted Labs가 2024년에 공개한 텍스트 기반 음악 생성 서비스로, Google DeepMind 출신 팀이 만든 보컬·악기 사실성에 강점을 둔 Suno 경쟁 서비스입니다.
Suno
수노
AI 활용 분야에서 미국 Suno가 2023년에 공개한 텍스트 기반 음악 생성 서비스로, 한 줄 가사·스타일 설명만 입력하면 보컬·반주가 결합된 완성된 노래를 자동으로 만들어 줍니다.
ElevenLabs
일레븐랩스
AI 활용 분야에서 미국 ElevenLabs가 2022년에 공개한 텍스트 음성 합성 서비스로, 글로 입력한 문장을 사람처럼 자연스러운 목소리로 변환하고 다국어 더빙·복제 음성도 제공합니다.
Luma Dream Machine
루마 드림머신
AI 활용 분야에서 미국 Luma AI가 2024년에 공개한 텍스트·이미지 기반 영상 생성 모델로, 한 줄 설명이나 사진 한 장만 입력해도 사실적이고 카메라 워크가 살아 있는 단편 영상을 자동 생성합니다.
Kling
클링
AI 활용 분야에서 중국 Kuaishou(콰이쇼우)가 2024년에 공개한 텍스트 기반 영상 생성 모델로, 사실적인 인물 동작과 카메라 워크를 한 줄 설명만으로 자동 생성해 Sora·Runway·Veo와 경쟁합니다.
Veo
베오
AI 활용 분야에서 Google DeepMind가 2024년에 공개한 텍스트 기반 영상 생성 모델 시리즈로, 사용자가 한 줄 설명만 입력해도 사실적인 단편 영상을 1080p 해상도로 자동으로 만들어 줍니다.
Sora
소라
AI 활용 분야에서 OpenAI가 공개한 텍스트 기반 영상 생성 모델로, 한 줄 설명만 입력하면 사실적이고 영화 같은 단편 영상을 자동으로 생성합니다.
Ideogram
아이디오그램
AI 활용 분야에서 캐나다 Ideogram이 2023년에 공개한 텍스트 기반 이미지 생성 서비스로, 이미지 안에 한국어·영문 텍스트를 정확하게 그리는 능력에 강점을 둔 Diffusion 계열 도구입니다.
Recraft
리크래프트
AI 활용 분야에서 영국 Recraft가 2024년에 공개한 디자이너용 이미지 생성 서비스로, 벡터·일러스트·아이콘 스타일 일관성 유지와 브랜드 키트 적용에 강점을 둔 Diffusion 계열 도구입니다.
Flux
플럭스
AI 활용 분야에서 독일 Black Forest Labs가 공개한 오픈웨이트 텍스트 기반 이미지 생성 모델로, 손가락·텍스트 같은 디테일 정확도를 끌어올린 Diffusion 계열 최신 라인업입니다.
Stable Diffusion
스테이블 디퓨전
AI 활용 분야에서 영국 Stability AI가 2022년에 공개한 오픈웨이트 텍스트 기반 이미지 생성 모델로, 가중치를 공개해 누구나 로컬 컴퓨터에서 직접 실행하고 파인튜닝할 수 있게 한 Diffusion 계열 표준 모델입니다.
DALL·E
달리
AI 활용 분야에서 OpenAI가 공개한 텍스트 기반 이미지 생성 모델 시리즈로, 사용자가 한 줄 설명을 입력하면 사실적 또는 일러스트 스타일 이미지를 자동으로 생성하며 ChatGPT에 통합되어 제공됩니다.
Midjourney
미드저니
AI 활용 분야에서 미국 Midjourney사가 2022년에 공개한 텍스트 기반 이미지 생성 서비스로, 사용자가 한 줄 설명을 입력하면 일러스트·사진 스타일 이미지를 자동으로 생성합니다.
Meta AI
메타 AI
AI 활용 서비스 분야에서 Meta가 2023년에 공개한 대화형 AI 서비스로, Llama 계열 모델을 기반으로 Facebook·Instagram·WhatsApp·메신저에 통합되어 채팅·이미지 생성 기능을 제공합니다.
Copilot
Microsoft
AI 활용 개발도구 분야에서 GitHub과 OpenAI가 2021년 6월에 공개한 코드 자동완성·생성 도구로, 개발자가 IDE에서 주석이나 함수명을 입력하면 다음 줄을 LLM이 예측해 제안합니다.
Perplexity
퍼플렉시티
AI 활용 분야에서 2022년에 공개된 대화형 AI 검색 서비스로, LLM이 웹을 실시간으로 검색하고 근거 출처와 함께 한국어·영어로 답변을 정리해 보여줍니다.
Gemini
제미나이
AI 활용 서비스 분야에서 Google이 2023년 12월에 공개한 대화형 AI(Artificial Intelligence, 인공지능) 서비스로, Gemini 계열 모델을 채팅·검색·Workspace 환경에 통합 제공합니다.
Claude.ai
클로드
AI 활용 서비스 분야에서 Anthropic이 2023년 3월에 공개한 대화형 AI(Artificial Intelligence, 인공지능) 서비스로, Claude 계열 모델을 채팅·Projects·Artifacts·Cowork 인터페이스로 제공합니다.
ChatGPT
챗지피티
AI 활용 서비스 분야에서 OpenAI가 2022년 11월에 공개한 대화형 인공지능 서비스로, GPT(Generative Pre-trained Transformer, 생성형 사전 학습 변환기) 계열 모델을 채팅 인터페이스로 제공합니다.
GLM-5
지엘엠
AI 모델 분야에서 중국 칭화대 KEG 연구실에서 분사한 Zhipu AI가 공개한 GLM(General Language Model) 5세대 LLM으로, 한국어·중국어·영어 다국어 처리에 강점을 가진 오픈웨이트 모델 라인입니다.
Kimi K2
키미
AI 모델 분야에서 중국 Moonshot AI가 2025년에 공개한 Kimi 시리즈 2세대 LLM(Large Language Model, 거대 언어 모델)으로, 1M 컨텍스트와 추론·에이전트 작업에 강점을 가진 오픈웨이트 모델입니다.
Mistral
미스트랄
AI 모델 분야에서 프랑스 Mistral AI가 공개한 오픈웨이트 LLM(Large Language Model, 거대 언어 모델) 시리즈로, 유럽 데이터 보호 규제 환경을 고려한 가벼운·고성능 모델을 가중치 공개 형태로 제공합니다.
Qwen
큐웬
AI 모델 분야에서 중국 Alibaba가 공개한 오픈웨이트 LLM(Large Language Model, 거대 언어 모델) 시리즈로, 다국어·코딩·추론·멀티모달 기능을 갖춘 채로 가중치를 공개해 누구나 다운로드해 직접 운영할 수 있게 한 모델군입니다.
DeepSeek
딥시크
AI 모델 분야에서 중국 DeepSeek사가 2024~2025년에 공개한 LLM(Large Language Model, 거대 언어 모델) 시리즈로, 미국 플래그십 모델 수준 성능을 훨씬 적은 학습 비용으로 달성한 추론·코딩 특화 오픈웨이트 모델입니다.
Llama
라마
AI 모델 분야에서 Meta가 2023년부터 공개해 온 오픈웨이트 LLM(Large Language Model, 거대 언어 모델) 시리즈로, 가중치를 공개해 누구나 다운로드해 직접 운영할 수 있게 한 대표적 오픈모델군입니다.
Grok 4
그록
AI 모델 분야에서 미국 xAI가 공개한 Grok 시리즈 4세대 LLM(Large Language Model, 거대 언어 모델)으로, X(구 Twitter) 실시간 데이터를 학습·참조해 시사·검색 강점을 가진 추론 모델 라인입니다.
Gemini 3 Pro
제미나이
AI 모델 분야에서 Google이 2025년에 공개한 Gemini 3 시리즈 플래그십 LLM(Large Language Model, 거대 언어 모델)으로, 추론·멀티모달·1M+ 컨텍스트 처리를 한 모델에 통합한 차세대 라인업입니다.
GPT-5.5
지피티
AI 모델 분야에서 OpenAI가 2026년에 공개한 GPT(Generative Pre-trained Transformer, 생성형 사전 학습 변환기) 계열 5세대 후속 모델로, 추론·멀티모달·도구 호출이 통합된 플래그십 LLM입니다.
Claude Haiku 4.5
클로드 하이쿠
AI 모델 분야에서 Anthropic이 공개한 Claude 4 계열 경량 라인으로, 응답 속도와 토큰 단가를 최소화해 대규모 처리·실시간 응답 시나리오에 쓰이는 LLM(Large Language Model, 거대 언어 모델)입니다.
클로드 소네트 4.6
Claude Sonnet 4.6
AI 모델 분야에서 Anthropic이 2026년에 공개한 Claude 4 계열 중급 라인으로, 속도와 비용 균형을 맞춰 일상적인 채팅·코딩·문서 작업에 폭넓게 쓰이는 LLM(Large Language Model, 거대 언어 모델)입니다.
Claude Opus 4.7
클로드 오푸스
AI 모델 분야에서 Anthropic이 2026년에 공개한 Claude 4 계열 최상위 플래그십 모델로, 추론·코딩·에이전트 작업에 최적화된 대형 LLM(Large Language Model, 거대 언어 모델)입니다.
파인튜닝
Fine-tuning
AI 모델 학습 분야에서 쓰이는 용어로, 이미 사전 학습된 거대 모델을 특정 분야의 추가 데이터로 다시 학습시켜 도메인·말투·형식에 맞게 다듬는 학습 방법입니다.