AI CPU
AI CPU 개념은 AI 가속기를 지휘하고 AI의 비행렬(non-matrix) 작업, 즉 스케줄링, 툴 호출, 검색, 데이터 이동을 처리하는 호스트·서버 CPU와 그 아키텍처를 다룬다. 에이전트 AI가 하나의 프롬프트를 수천 단계 작업으로 바꾸면서 CPU의 역할은 커지고 있고, 엔비디아의 Vera·Grace부터 AMD EPYC, 인텔 Xeon, Arm 아키텍처까지 아우른다.
| 분류 | Thematic / Semiconductors — CPU & agentic compute |
|---|---|
| 대표 기업 | 4 |
| 관련 ETF | KODEX 미국AI반도체TOP3플러스 ETF (0151S0) |
| 최종 업데이트 | 2026-06-15 |
- AI CPU 개념은 AI 가속기를 지휘하고 AI의 비행렬(non-matrix) 작업을 처리하는 호스트·서버 CPU와, 그 CPU가 올라타는 아키텍처를 다룬다.
- 에이전트 AI는 작업 구성을 바꾼다. 하나의 프롬프트가 추론·검색·툴 사용의 수천 단계를 일으키고, 그 상당수가 파이썬 런타임·샌드박스 코드·오케스트레이션 같은 CPU 작업이라 AI 시스템에서 CPU의 역할이 커진다.
- 엔비디아는 이제 GPU 세대마다 CPU를 짝짓는다. GB200 NVL72 랙은 Grace CPU 36개에 Blackwell GPU 72개를 쓰고, 엔비디아가 '에이전트를 위한 CPU'라 부르는 88코어 Vera CPU가 2026년 출하되는 Vera Rubin 플랫폼의 중심이다.
- Arm 아키텍처는 AI 호스트 CPU 전반의 공통분모다(엔비디아 Grace, AWS Graviton, 구글 Axion, 마이크로소프트 Cobalt). Arm의 데이터센터 로열티는 2026 회계연도 4분기에 전년 대비 두 배 넘게 늘었다.
- x86은 여전히 범용 서버를 떠받친다. AMD EPYC의 데이터센터 매출은 57% 늘어 58억 달러였고, 인텔 Xeon은 현직 호스트 CPU로 남아 있으며, 인텔은 미국에 본사를 둔 유일한 첨단 파운드리이기도 하다.
AI CPU 개념이란?
가속기 안이 아니라 그 옆에 있는 AI 연산의 한 층이다. 모든 AI 서버에는 시스템을 부팅하고, 작업을 스케줄링하고, GPU에 데이터를 먹이고, 행렬 연산이 아닌 부분을 돌리며, 점점 더 에이전트의 추론 루프를 끌고 가는 호스트 CPU가 필요하다. 이 개념은 그 층의 선두를 담는다. Arm은 대부분의 AI 호스트 CPU에 들어가는 아키텍처를 라이선스한다. AMD와 Intel은 x86 서버 CPU인 EPYC와 Xeon을 공급한다. 그리고 오랫동안 GPU 선두였던 NVIDIA는 이제 Arm 기반 Grace와 맞춤형 Vera를 가속기와 함께 출하하며 CPU 공급사이기도 하다.
에이전트 AI는 CPU의 역할을 어떻게 바꾸나?
에이전트는 단일 순전파가 아니기 때문이다. 엔비디아는 에이전트 AI를 하나의 프롬프트가 추론·검색·툴 사용·응답 생성의 긴 여정을 일으키는 새로운 종류의 워크로드로 설명한다. 그 상당수는 파이썬 런타임, 샌드박스 코드 실행, 오케스트레이션, 분석 같은 CPU 작업이다. 그래서 엔비디아는 에이전트를 위한 CPU, 즉 88코어 Vera를 만들었고, x86 대비 1.8배 빠른 작업 완료와 랙 단위에서 이전 Grace Blackwell 대비 10배의 에이전트 처리량을 내세운다 (NVIDIA, 2026년 5월 31일; NVIDIA, 2026년 5월 31일). 엔비디아 창업자 겸 CEO 젠슨 황은 그 베팅을 분명히 했다.
“AI 에이전트는 연산의 최대 사용자가 될 것이다. Vera는 그 미래를 위해 설계된 최초의 CPU로, 비범한 성능과 효율, 프로그래밍 가능성으로 하이퍼스케일에서 에이전트 AI를 돌리도록 만들어졌다.”
— 젠슨 황, 엔비디아 창업자 겸 CEO (NVIDIA, 2026년 5월 31일)
AI 랙의 CPU 대 GPU 비율은?
의도된 설계 선택이며, 엔비디아가 시스템마다 정한다. GB200 NVL72 랙은 Grace CPU 36개를 Blackwell GPU 72개에 연결하는 1:2 비율로, CPU 2개·GPU 4개로 된 컴퓨트 트레이 18개로 구성된다 (NVIDIA GB200 NVL72). 그 뒤를 잇는 Vera Rubin 플랫폼은 2026년 1월 CES에서 공개돼 2026년 본격 양산에 들어갔고, CPU를 랙의 중심에 두며 Vera와 Rubin을 1.8TB/s NVLink-C2C로 연결한다 (NVIDIA, 2026년 5월 31일). GPU 수가 여전히 압도하지만, 에이전트 워크로드가 오케스트레이션과 코드 실행을 더하면서 빠른 호스트 CPU의 가치가 커진다. 그래서 엔비디아·AMD·인텔·Arm이 그 소켓을 두고 경쟁한다.
누가 AI CPU를 고려할 만한가?
GPU보다 더 안정적이고 베타가 낮은 층에서 AI 구축에 노출되길 원하고, CPU가 랙에서 더 작은 항목임을 이해하는 투자자에게 맞는다. 매출은 실재하고 날짜가 박혀 있다. Arm은 데이터센터 로열티가 전년 대비 두 배 넘게 늘면서 20% 증가한 사상 최대 14.9억 달러의 2026 회계연도 4분기 매출을 보고했고 (Arm, 2026년 5월 6일), AMD의 데이터센터 매출은 57% 늘어 58억 달러였다 (AMD 8-K, 2026년 5월 5일).
단서는 같은 테마 안에서 아키텍처들이 서로 경쟁한다는 점이다. 하이퍼스케일러가 자체 Arm 기반 CPU를 점점 더 많이 설계하면서 Arm의 로열티 흐름은 커지지만 AMD·인텔의 범용 x86은 압박받을 수 있다. 개인 투자자에게는 더 넓은 칩 배분 옆의 위성으로, 기관에는 단일 GPU 집중을 줄이며 AI 구축을 담는 방식이 되며, 인텔의 9.9% 미국 정부 지분에서 오는 턴어라운드·정치 리스크를 예산화해야 한다 (인텔 8-K, 2026년 4월 23일).
AI CPU를 대표하는 기업은?
| 기업 | 섹터 | 사업 내용 |
|---|---|---|
| Arm Holdings (ARM) | Information Technology · Semiconductors (IP) | Arm은 대부분의 AI 호스트 CPU에 들어가는 CPU 아키텍처를 라이선스한다. 엔비디아 Grace, AWS Graviton, 구글 Axion, 마이크로소프트 Cobalt가 모두 Arm 기반이다. 2026 회계연도 4분기 매출은 20% 늘어난 사상 최대 14.9억 달러였고, 하이퍼스케일러가 Arm 호스트로 표준화하면서 데이터센터 로열티는 전년 대비 두 배 넘게 늘었다. |
| AMD (AMD) | Information Technology · Semiconductors | AMD의 EPYC는 선두 x86 서버 CPU이며 AI 시스템에서 Instinct 가속기와 짝을 이루는 헤드노드 프로세서다. 2026년 1분기 데이터센터 매출은 EPYC CPU와 Instinct GPU에 힘입어 57% 늘어난 58억 달러였고, AMD를 AI 연산의 믿을 만한 두 번째 공급원으로 만든다. |
| NVIDIA (NVDA) | Information Technology · Semiconductors | GPU를 넘어 엔비디아는 이제 가속기 세대마다 호스트 CPU를 함께 출하한다. Arm 기반 Grace와, Vera Rubin 플랫폼에서 '에이전트를 위한 CPU'라 부르는 맞춤형 88코어 Vera CPU다. GB200 NVL72 랙은 Grace CPU 36개와 Blackwell GPU 72개를 짝짓는다. |
| Intel (INTC) | Information Technology · Semiconductors & Foundry | 인텔의 Xeon은 대부분의 데이터센터에서 x86 현직 호스트 CPU이며, 인텔은 미국에 본사를 둔 유일한 첨단 로직 파운드리다. 2026년 1분기 매출은 136억 달러로 6개 분기 연속 자체 가이던스를 웃돌았고, 국가가 떠받치는 턴어라운드가 진행 중이다. |
AI CPU의 리스크는?
층은 견고하지만, AI를 담는 가장 높은 베타의 방식은 아니다.
- 시스템당 상승 여력 제한. CPU는 AI 랙 비용에서 GPU보다 작은 비중이라 시스템당 매출이 가속기에 의해 제한된다.
- 테마 내부의 아키텍처 경쟁. 하이퍼스케일러의 맞춤형 Arm CPU는 Arm 로열티를 키우지만 AMD·인텔의 범용 x86 점유율을 깎을 수 있다.
- 인텔의 실행·정책 리스크. 파운드리 턴어라운드는 대규모로 입증되지 않았고, 9.9% 미국 정부 지분이 상업 스토리에 정치 리스크를 더한다 (인텔 8-K, 2026년 4월 23일).
- 경기순환. 서버 CPU 수요는 AI가 구조적 추세를 끌어올리는 와중에도 여전히 데이터센터·기업 설비투자 사이클을 따라 움직인다.
관련 개념·종목·용어
- AI 인프라 (AI Infrastructure) 상위
- 미국 AI 반도체 연관
- AI 추론 인프라 연관
- AI 온디바이스 관련
- Arm 홀딩스 (ARM) 하위
- AMD (AMD) 하위
- 엔비디아 (NVDA) 하위
- 인텔 (INTC) 하위
- 에이전트 AI 하위
- AI 가속기 (AI accelerator) 관련
관련 지수·ETF
- KODEX US AI Semiconductor TOP3 Plus ETF (0151S0) · Samsung Asset Management Korea-listed ETF tracking the Akros US AI Semiconductor index; holds NVIDIA, AMD, Intel, and Arm among the CPU-relevant names.
- Akros U.S. AI Semiconductor Top 3 Plus Index (AUAIST3P) · Akros Technologies, Inc. The proprietary Akros index that the KODEX ETF tracks; spans GPUs, CPUs, memory, and foundry.
위 표시는 지수와 상품 간 추종 관계에 관한 사실의 적시이며, 특정 상품의 매수 권유가 아닙니다. 아크로스는 해당 지수의 산출기관으로서 운용회사로부터 지수 사용료를 수취할 수 있습니다. 투자 전 반드시 해당 상품의 투자설명서 또는 간이투자설명서를 확인하시기 바랍니다.
자주 묻는 질문
AI CPU 개념이란 무엇인가?
AI 가속기를 지휘하고, AI가 GPU에 넘길 수 없는 일(스케줄링, 툴 호출, 검색, 데이터 이동, 코드 실행)을 처리하는 호스트·서버 CPU와 그 아키텍처다. 바스켓은 대부분의 AI 호스트 CPU 아래에 있는 아키텍처 Arm(ARM), x86의 AMD EPYC(AMD)와 인텔 Xeon(Intel), 그리고 엔비디아 자체의 Grace·Vera CPU(NVIDIA)를 아우른다.
에이전트 AI는 CPU의 역할을 어떻게 바꾸나?
에이전트 AI는 작업당 여러 순차 단계를 돈다. 엔비디아는 에이전트 작업을 추론·검색·툴 사용·응답 생성의 사슬로 설명하는데, 그 상당수가 파이썬 런타임·샌드박스 코드 실행·오케스트레이션 같은 CPU 작업이다. 엔비디아는 이를 위해 88코어 Vera CPU를 만들었고, x86 대비 1.8배 빠른 작업 완료와 랙 단위에서 이전 Grace Blackwell 대비 10배의 에이전트 처리량을 내세운다 (NVIDIA, 2026년 5월 31일).
엔비디아 Vera CPU와 Vera Rubin 플랫폼은 무엇인가?
Vera는 엔비디아의 맞춤형 88코어 CPU로, 최대 1.2TB/s를 내는 LPDDR5X 메모리 서브시스템을 갖추고 1.8TB/s NVLink-C2C로 Rubin GPU와 연결된다. 엔비디아는 이를 '에이전트를 위한 CPU'라 부르며 Vera Rubin 플랫폼의 호스트 프로세서로 삼았다. 이 플랫폼은 2026년 1월 CES에서 공개돼 2026년 본격 양산에 들어갔다 (NVIDIA, 2026년 5월 31일; NVIDIA, 2026년 5월 31일).
AI 시스템의 CPU 대 GPU 비율은 바뀌고 있나?
이 비율은 엔비디아가 랙마다 정하는 설계 선택으로, 워크로드가 필요로 하는 비-GPU 작업의 양을 반영한다. GB200 NVL72 랙은 Grace CPU 36개에 Blackwell GPU 72개로 1:2 비율이다 (NVIDIA GB200 NVL72). 에이전트 워크로드가 오케스트레이션·검색·코드 실행을 더하면서, GPU 수가 압도하는 곳에서도 빠른 호스트 CPU의 가치가 커진다. 그래서 엔비디아·AMD·인텔·Arm이 호스트 CPU 소켓을 두고 경쟁한다.
AI CPU 개념을 대표하는 기업은 어디인가?
네 곳이다. 엔비디아 Grace·AWS Graviton·구글 Axion·마이크로소프트 Cobalt에 들어가는 아키텍처의 Arm(ARM), 선두 x86 서버 CPU EPYC의 AMD(AMD), x86 현직이자 미국 유일 첨단 파운드리를 운영하는 인텔(INTC), 그리고 Grace·Vera로 호스트 CPU 공급사가 된 엔비디아(NVDA)다. Arm의 데이터센터 로열티는 2026 회계연도 4분기에 전년 대비 두 배 넘게 늘었다 (Arm, 2026년 5월 6일).
AI CPU 테마의 주요 리스크는 무엇인가?
CPU는 AI 랙에서 더 작은 항목이라 GPU보다 베타가 낮은 AI 투자 방식이며, 시스템당 상승 여력이 GPU에 의해 제한된다는 절충이 있다. 아키텍처 간 경쟁도 치열하다. 하이퍼스케일러가 자체 Arm CPU를 설계해 Arm 로열티를 키우지만 AMD·인텔의 범용 x86을 압박할 수 있다. 인텔의 턴어라운드는 미국 정부의 9.9% 지분에서 오는 실행·정치 리스크도 안고 있다 (인텔 8-K, 2026년 4월 23일).
AI CPU 테마는 개인 투자자에게 적합한가?
순수 GPU 베팅과 다른 위험 프로파일로 AI에 노출되길 원하는 투자자에게 맞는다. CPU는 같은 구축의 더 안정적이고 베타가 낮은 층이기 때문이며, 위성 비중으로 잡는 게 좋다. 현금흐름은 날짜가 박혀 있다. AMD의 데이터센터 매출은 57% 늘어 58억 달러였고 (AMD 8-K, 2026년 5월 5일), Arm은 20% 늘어난 사상 최대 14.9억 달러의 2026 회계연도 4분기 매출을 보고했다 (Arm, 2026년 5월 6일). 투자 전에는 보수·보유 종목·위험을 늘 확인해야 한다.
AI CPU 개념을 담는 ETF가 있나?
CPU 전용 ETF는 없지만, KODEX 미국AI반도체TOP3플러스 ETF(0151S0)가 Akros 미국 AI반도체 지수를 추종하며 GPU·메모리와 함께 CPU 관련 종목인 엔비디아·AMD·인텔·Arm을 담는다 (삼성자산운용). 순수 CPU 플레이가 아니라 폭넓은 AI 칩 바스켓이다. 투자 전에는 보수·보유 종목·위험을 늘 확인해야 한다.
출처
- NVIDIA Unveils Vera, the CPU for Agents · NVIDIA Corporation (Newsroom), 2026-05-31
- NVIDIA Vera Rubin Ramps Into Full Production to Power Agentic AI Factories Worldwide · NVIDIA Corporation (Newsroom), 2026-05-31
- NVIDIA GB200 NVL72 (36 Grace CPUs, 72 Blackwell GPUs) · NVIDIA Corporation, 2026-01-05
- Arm Holdings plc Reports Results for the Fourth Quarter and Fiscal Year Ended 2026 · Arm Holdings plc, 2026-05-06
- AMD Reports First Quarter 2026 Financial Results (SEC 8-K, Exhibit 99.1) · Advanced Micro Devices, Inc. / SEC EDGAR, 2026-05-05
- Intel Reports First-Quarter 2026 Financial Results (SEC 8-K, Exhibit 99.1) · Intel Corporation / SEC EDGAR, 2026-04-23
- NVIDIA Announces Financial Results for First Quarter Fiscal 2027 · NVIDIA Corporation (Newsroom), 2026-05-20
- KODEX 미국AI반도체TOP3플러스 ETF (0151S0) — product page · Samsung Asset Management, 2026-01-13