Lounge›News & social
Naver Blog · 주절주절
AI 에이전트가 CPU를 부르는 이유 (feat. GPU 하나에 CPU 하나)
- Posted
- 2026.10.07 18:00
- Likes
- 77
- Comments
- 0
- Shares
- 10
공대인공대인 · Followers 7,312
View blogKey Points
AI summary- 01에이전트는 모델 호출 12회와 프로그램 실행 16회를 거치는 사례처럼 GPU 추론과 CPU 실행을 반복하며, 가상 작업 공간은 모델이 생각하거나 사용자가 다음 지시를 준비하는 동안에도 자리를 차지한다.
- 02메타는 2026년 4월 24일 아마존과 Graviton 코어 “수천만 개” 계약을 발표했고, 에이전트 AI의 CPU 집약적 작업에 사용한다고 밝혔다.
- 03인텔 CEO는 2026년 4월 23일 CPU:GPU 비율이 1:8에서 1:4로 바뀌었으며 1:1 이상도 가능하다고 했고, AMD CEO 리사 수도 2026년 5월 5일 1:1에 가까워진다고 말했다.
Summary
에이전트 확산으로 데이터센터의 CPU:GPU 구성이 1:4에서 1:1로 이동하면 GPU 증설 없이도 CPU 수요가 최대 4배 늘 수 있지만, 아직 출하량 증가는 제한적이다.
| 항목 | 값 | 비고 |
|---|---|---|
| 코딩 에이전트 1건 | GPU 약 8초, CPU 415초 | CPU 사용 시간이 약 50배 |
| CPU:GPU 비율 | 1:8 → 1:4 → 1:1 가능성 | 인텔·AMD 경영진 발언 |
| CPU 필요량 변화 | 최대 4배 | 비율이 1:4에서 1:1로 이동할 경우, GPU 수 고정 |
| 인텔 데이터센터 매출 | 63억 달러, 전년 대비 +59% | 2026년 2분기; 서버 판매가 +48%, 출하량 +9% |
| 삼성전기 패키지기판 증설 | 세종 4조 2,700억 원, 베트남 2조 5,100억 원 | 합계 약 6조 8천억 원, 완공 목표 2028년 상반기 |
| Vera CPU 메모리·랙 구성 | CPU당 최대 1.5TB, 랙당 CPU 256개 | 엔비디아는 CPU 전용 랙에서 독립 작업 환경 2만 2,500개 이상 동시 구동 가능하다고 발표 |
- 에이전트는 모델 호출 12회와 프로그램 실행 16회를 거치는 사례처럼 GPU 추론과 CPU 실행을 반복하며, 가상 작업 공간은 모델이 생각하거나 사용자가 다음 지시를 준비하는 동안에도 자리를 차지한다.
- 메타는 2026년 4월 24일 아마존과 Graviton 코어 “수천만 개” 계약을 발표했고, 에이전트 AI의 CPU 집약적 작업에 사용한다고 밝혔다.
- 인텔 CEO는 2026년 4월 23일 CPU:GPU 비율이 1:8에서 1:4로 바뀌었으며 1:1 이상도 가능하다고 했고, AMD CEO 리사 수도 2026년 5월 5일 1:1에 가까워진다고 말했다.
- CPU 증설은 FC-BGA 기판과 SOCAMM 메모리 모듈 수요로 이어질 수 있으며, SK하이닉스는 2026년 4월 20일 192GB SOCAMM2 양산을 시작했고 마이크론은 회계연도 4분기 관련 매출이 전분기 대비 2배 이상이라고 밝혔다.
- 투자 가설의 핵심 확인 시점은 2027년 1월 말 인텔·AMD의 2026년 4분기 실적발표이며, 서버 CPU 출하량과 CPU 전용 서버 배치, 기판 증설 진행, SOCAMM 채택처를 점검해야 한다.
시사점: CPU 수요가 에이전트 확산과 함께 GPU보다 빠르게 늘면 서버 CPU·패키지기판·메모리 모듈로 수혜가 확산될 수 있다. 다만 인텔의 2026년 2분기 서버 출하량 증가는 9%에 그쳐, 가격 효과를 넘어 실제 물량 증가가 확인되는지가 관건이다.