AI 트렌드

NPU

엔피유

AI 반도체 분야에서 쓰이는 Neural Processing Unit(신경망 처리 장치)의 약자로, 신경망 연산을 저전력으로 빠르게 처리하도록 특화한 프로세서입니다. 범용 계산용 CPU, 병렬 그래픽 연산용 GPU와 달리 AI 추론 가속만을 노리고 설계됩니다. 성능은 초당 조 단위 연산 횟수인 TOPS로 표기합니다. 스마트폰·노트북의 온디바이스 AI부터 데이터센터용 AI 가속기까지 쓰임이 넓어지고 있습니다.

쉽게 말하면?

엔피유(NPU, Neural Processing Unit)는 AI 계산만 전담하는 반도체입니다. 회사로 치면 모든 일을 처리하는 총무팀(CPU), 대량 반복 작업에 강한 생산팀(GPU) 옆에 AI 업무 전담팀을 새로 둔 셈이에요. 전기를 적게 쓰면서 AI 추론을 빠르게 처리하는 게 특기라, 배터리로 움직이는 스마트폰·노트북에 특히 중요합니다. 최근에는 전력 효율을 앞세운 데이터센터용 NPU도 상용화되고 있습니다.

한 줄로 비유하면?

만능 직원(CPU) 옆에 앉은 AI 계산 전담 직원입니다. 다른 일은 못 하지만 그 일만큼은 적은 에너지로 빠르게 끝냅니다.

어디에 쓰이나?

케이스 1Microsoft — Copilot+ PC의 40 TOPS 기준선

Microsoft는 2024년 NPU 탑재를 전제로 한 Copilot+ PC 카테고리를 만들었습니다 [1]. 인증 요건으로 40 TOPS를 넘는 NPU를 명시했습니다 [1]. 실시간 번역·이미지 생성 같은 AI 기능을 기기 안에서 처리하는 것이 목적입니다 [1].
도입효과: NPU 연산 성능 요건 40+ TOPS(Copilot+ PC 인증 최소 기준, RAM 16GB 동반 요건) [1]

케이스 2삼성전자(한국) — 엑시노스 2500, 59 TOPS

삼성전자는 3나노 공정 플래그십 AP 엑시노스 2500에 59 TOPS NPU를 실었습니다 [3]. NPU 구성을 전작 17K MAC에서 24K MAC으로 키웠습니다 [3]. 2025년 갤럭시 Z 플립7에 지역 구분 없이 전량 탑재됐습니다 [8].
도입효과: NPU 성능 59 TOPS·온디바이스 AI 성능 전작 대비 39% 향상(엑시노스 2400 대비, 공식 제품 페이지 기준) [3]

케이스 3퓨리오사AI(한국) — LG AI연구원이 검증한 전력 효율

퓨리오사AI의 2세대 추론 칩 RNGD는 TDP 180W에 HBM3 48GB를 갖추었습니다 [4]. LG AI연구원이 자체 모델 엑사원 서빙용으로 도입을 발표했습니다(2025년 7월) [4]. 검증 결과 기존 GPU 대비 전력당 추론 성능이 앞섰습니다 [4].
도입효과: 와트당 LLM 추론 성능 2.25배(기존 GPU 대비, LG AI연구원 엑사원 검증 기준) [4]

케이스 4리벨리온(한국) — 국내 첫 AI칩 유니콘과 공공 클라우드 진출

리벨리온은 2024년 12월 사피온코리아와 합병해 국내 첫 AI칩 유니콘이 됐습니다 [5]. 차세대 칩 REBEL-Quad는 HBM3E 144GB를 탑재해 Hot Chips 2025에서 공개됐습니다 [5]. 2026년 6월 KT클라우드가 리벨리온 NPU 기반 공공기관 전용 서버 상품을 국내 CSP 최초로 출시했습니다 [6].
도입효과: 국내 서비스형 NPU(NPUaaS) 최초 클라우드 보안인증(CSAP) 획득(2026년 6월, 공공 클라우드 기준) [6]

주의할 점은?

오늘 바로 해보기
01. Windows 11 작업 관리자(Ctrl+Shift+Esc)의 성능 탭에서 내 노트북에 NPU 항목이 있는지 확인합니다.
02. Copilot+ PC 요건(NPU 40+ TOPS·RAM 16GB)과 내 기기 사양을 대조해 봅니다 [1].
03. Qualcomm의 4쪽짜리 공식 해설 PDF로 TOPS 단위의 뜻을 정리합니다 [2].
04. 스냅드래곤 X Elite 45, 엑시노스 2500 59 등 칩별 TOPS를 표로 만들어 비교합니다 [2][3].
05. AI 인프라를 검토하는 입장이라면 GPU 대비 NPU의 강점이 전력 효율이라는 점을 퓨리오사AI-LG 사례로 확인합니다 [4].

한계와 진화
NPU는 CPU·GPU를 대체하는 칩이 아닙니다. IBM은 NPU가 범용 프로세서를 대신하도록 설계되지 않았고, 8비트 이하 저정밀 연산에 특화돼 정밀 계산에는 맞지 않다고 설명합니다 [7]. 요건 논란도 있습니다. 40 TOPS NPU가 없으면 고성능 GPU를 갖춘 PC라도 Copilot+ 기능에서 제외되는 구조이기 때문입니다 [1]. 칩마다 소프트웨어 지원 수준이 달라, 개발 도구 성숙도가 실제 활용도를 좌우한다는 점도 도입 시 확인할 대목입니다.
진화는 양 끝에서 진행됩니다. 기기 쪽에서는 Copilot+ PC 요건화 [1]와 플래그십 스마트폰 AP의 NPU 강화 [3]로 온디바이스 AI가 기본값이 되고 있습니다. 데이터센터 쪽에서는 전력 효율을 앞세운 국산 NPU가 상용 단계에 들어섰습니다. 퓨리오사AI는 LG AI연구원 도입으로 와트당 성능 2.25배를 검증했고 [4], 리벨리온 NPU는 KT클라우드를 통해 공공 클라우드 상품이 됐습니다 [6]. AI 데이터센터의 전력 문제가 커질수록 전력 대비 성능을 앞세운 NPU의 자리도 넓어지는 흐름입니다.

참고 자료

  1. Copilot+ PCs developer guide — 공식 문서·Microsoft Learn·2024~2026 — https://learn.microsoft.com/en-us/windows/ai/npu-devices/
  2. What TOPS Means: Snapdragon X Series — 공식 기술 문서·Qualcomm·2024 — https://www.qualcomm.com/content/dam/qcomm-martech/dm-assets/documents/What-TOPS-Means-Snapdragon-X-Series.pdf
  3. 엑시노스 2500 제품 페이지 — 공식 제품 문서·삼성전자 반도체·2025 — https://semiconductor.samsung.com/kr/processor/mobile-processor/exynos-2500/
  4. LG AI Research Achieves 2.25× Better LLM Inference — 공식 블로그·FuriosaAI·2025 — https://furiosa.ai/blog/lg-ai-research-taps-furiosaai-to-achieve-2-25x-better-llm-inference-in-production-vs-gpus
  5. Rebellions and SAPEON Korea Complete Merger — 공식 뉴스룸·Rebellions·2024 — https://rebellions.ai/newsroom/rebellions-and-sapeon-korea-complete-merger-launching-koreas-first-ai-chip-unicorn/
  6. KT클라우드, 공공 전용 NPU 시장 연다 — 권위 매체·ZDNet Korea·2026 — https://zdnet.co.kr/view/?no=20260604102357
  7. What is a neural processing unit (NPU)? — 공식 해설·IBM·2026(접속 기준) — https://www.ibm.com/topics/neural-processing-unit
  8. 갤Z플립7, 전량 엑시노스 2500 채용 — 권위 매체·디지털데일리·2025 — https://www.ddaily.co.kr/page/view/2025071015411261513

대표 출처

공식 문서 (2024) · Microsoft, Copilot+ PCs developer guide