그록3 LPX 양산 — 삼성파운드리, 엔비디아 공급망 진입

엔비디아가 랙 단위 AI 추론 가속기 '그록3 LPX'를 본격 양산합니다. 그런데 이 제품을 만드는 곳이 그동안 엔비디아 AI 칩의 주요 생산을 맡아온 TSMC가 아니라 삼성전자 파운드리라는 점이 업계의 관심을 끌고 있습니다.
그록3 LPX, 어떤 제품인가
그록3 LPX는 추론 전용 언어처리장치(LPU) 256개를 하나의 랙(서버 장비 단위)으로 구성한 시스템입니다. 여기서 핵심은 '추론'에 특화됐다는 점입니다. AI 모델 개발에는 크게 '학습'(모델이 데이터를 익히는 과정)과 '추론'(학습된 모델이 실제 질문에 답하는 과정) 두 단계가 있는데, 그록3 LPX는 이 중 추론 과정, 즉 생성형 AI가 이미 학습한 정보를 바탕으로 실제 서비스에서 빠르게 답변을 만들어내는 작업에 최적화된 하드웨어입니다. 이 제품은 엔비디아의 차세대 플랫폼 '베라 루빈'과 결합돼, AI 모델이 답변을 생성하는 속도를 끌어올리는 역할을 합니다.
왜 삼성 파운드리가 만드나
그록3는 삼성전자 반도체 위탁생산(파운드리) 사업부가 4나노 공정으로 생산합니다. 그동안 엔비디아의 최첨단 AI 칩은 세계 최대 파운드리업체인 TSMC가 주요 생산을 맡아왔던 만큼, 이번 그록3 LPX 양산은 삼성 파운드리가 엔비디아의 공급망에 본격적으로 진입하는 계기로 평가받습니다. 파운드리 업계에서 '엔비디아 물량을 따냈다'는 건 그 자체로 기술력에 대한 검증이자, 향후 다른 고객사를 유치하는 데도 중요한 레퍼런스가 됩니다.
'베라 루빈'과 'AI 팩토리'의 큰 그림
이번 그록3 LPX는 엔비디아의 차세대 통합 플랫폼 '베라 루빈'의 일부입니다. 베라 루빈은 GPU뿐 아니라 CPU, 네트워킹, 추론 가속기까지 아우르는 통합 아키텍처로 알려져 있는데, 엔비디아는 이 플랫폼의 한 축인 에이전트 전용 CPU '베라'를 AI 기업 xAI에 공급한다고도 밝혔습니다. 개별 칩 하나하나가 아니라, 학습부터 추론까지 AI 파이프라인 전체를 아우르는 하드웨어 생태계를 구축하려는 엔비디아의 전략이 이번 발표에서도 확인됩니다.
파운드리 경쟁 구도에 미치는 영향
이번 사례는 파운드리 시장에서 TSMC의 독점적 지위에 균열이 생길 수 있다는 신호로도 읽힙니다. 최근 삼성전자는 AI 칩 수요 폭증에 힘입어 평택 4나노 생산라인이 풀가동되고 있고, 파운드리 가격도 인상한 바 있습니다. 이런 상황에서 엔비디아라는 최대 고객사의 물량 일부를 확보했다는 건, 삼성 파운드리 사업의 수익성과 경쟁력 모두에 긍정적인 신호로 해석할 수 있습니다.

AI 인프라 엔지니어가 참고할 지점
- 학습용 칩과 추론용 칩의 요구사항이 다르다는 점을 기억해야 합니다. 그록3 LPX처럼 추론에 특화된 하드웨어가 별도로 발전하고 있다는 건, AI 서비스를 운영하는 입장에서 학습 인프라와 추론 인프라를 구분해 설계해야 할 필요성이 커지고 있다는 뜻입니다.
- 파운드리 다변화는 공급망 리스크 관리와 직결됩니다. 특정 파운드리에만 의존하던 기존 구조에서 벗어나 복수의 생산처를 확보하는 흐름은, AI 하드웨어를 다루는 기업들이 공급 안정성을 어떻게 관리하는지 보여주는 사례입니다.
- 플랫폼 단위 경쟁이 심화되고 있습니다. 개별 칩 성능 경쟁을 넘어, GPU·CPU·네트워킹·추론 가속기를 통합한 플랫폼 단위로 경쟁하는 흐름은 향후 AI 인프라를 선택할 때 개별 부품이 아니라 생태계 전체를 고려해야 함을 시사합니다.
AI 반도체 경쟁이 단순히 "누가 더 빠른 칩을 만드느냐"를 넘어 "누가 학습부터 추론까지 아우르는 생태계를 구축하느냐"로 옮겨가고 있다는 걸, 이번 그록3 LPX 양산 소식이 잘 보여줍니다.