- 토큰 처리량 5·에너지 효율 4장문 추론 대응 인프라 제시

 

[GTC 2026] 엔비디아, 블루필드-4 STX 공개… 컨텍스트 메모리 기반 AI 스토리지 확장.jpg

엔비디아가 GTC 2026에서 블루필드-4 기반 STX 스토리지 아키텍처를 공개하고, 에이전틱 AI 환경에 대응하는 컨텍스트 메모리 중심 인프라를 제시했다. 긴 컨텍스트 기반 추론에서 발생하는 데이터 접근 지연과 GPU 활용 저하 문제를 스토리지 구조에서 해결하는 데 초점을 맞췄다.

 

컨텍스트 메모리 중심 스토리지 구조 전환

기존 데이터센터 스토리지는 대용량 저장에는 최적화돼 있지만, 여러 단계와 세션을 거치는 에이전틱 AI 워크로드에서는 응답성이 제한되는 구조였다. 대규모 컨텍스트를 기반으로 한 추론 환경에서는 데이터 접근 지연이 누적되면서 GPU 활용도가 떨어지고 처리 속도 저하로 이어진다. STXGPU 메모리를 확장하는 컨텍스트 메모리 계층을 중심으로 설계되며, 데이터 접근 경로를 단축해 추론 과정에서 필요한 데이터를 빠르게 공급하는 구조를 갖춘다.

 

CMX 플랫폼, 토큰 처리량 5배 확대

STX에는 랙 단위 구현을 위한 CMX 컨텍스트 메모리 스토리지 플랫폼이 포함된다. GPU 메모리를 확장하는 고성능 컨텍스트 레이어를 통해 기존 스토리지 대비 초당 최대 5배 수준의 토큰 처리량을 제공한다. 에이전틱 AI와 대규모 추론 환경에서 필요한 장문 컨텍스트를 안정적으로 처리할 수 있도록 설계됐다.

 

블루필드-4 기반 가속 스토리지 아키텍처

STX는 블루필드-4 프로세서를 중심으로 베라 CPU와 커넥트X-9 슈퍼NIC을 결합한 구조로 구성된다. 여기에 스펙트럼-X 이더넷과 도카, AI 엔터프라이즈 소프트웨어를 함께 적용해 스토리지, 네트워크, 컴퓨팅을 통합한 형태로 구성된다. 기존 CPU 기반 스토리지 대비 최대 4배 높은 에너지 효율을 확보하며, 엔터프라이즈 데이터 처리에서는 초당 2배 더 많은 페이지 처리가 가능하다.

 

클라우드·스토리지 파트너 공동 설계 확장

STX 아키텍처는 클라우디안, DDN, , 히타치 밴타라, HPE, IBM, 넷앱, 뉴타닉스, 바스트 데이터, 웨카 등 주요 스토리지 기업이 공동 설계에 참여한다. AIC, 슈퍼마이크로, QCT 등 제조 파트너가 시스템 구축을 맡으며, 코어위브, 크루소, 람다, 미스트랄 AI, 네비우스, OCI, 벌처 등 클라우드 및 AI 기업이 도입을 추진하고 있다.

 

엔비디아 젠슨 황 CEO에이전틱 AI는 방대한 컨텍스트 기반 추론을 요구하며, 이를 위해 새로운 스토리지 구조가 필요하다“STXAI 네이티브 인프라를 위한 모듈형 기반을 제공한다고 밝혔다.

 

STX 기반 플랫폼은 올해 하반기부터 파트너사를 통해 제공될 예정이다.

 

#GTC2026 #엔비디아 #STX #블루필드4 #AI스토리지 #컨텍스트메모리 #데이터센터 #AI인프라 #GPU #에이전틱AI

 

 
?

List of Articles
번호 분류 제목 글쓴이 날짜 조회 수
2323 [GTC 2026] 엔비디아, 오라클과 벡터 검색 가속…GPU 인덱싱 협력 확대 - cuVS·오라클 AI DB 결합, 대규모 데이터 검색·의료 AI 활용 속도 개선 엔비디아가 GTC 2026에서 오라클과 협력해 GPU 기반 벡터 인덱스 구축 기술을 실제 워크... file newsit 2026.03.19 49
2322 [GTC 2026] 엔비디아, 단백질 데이터셋 확장…170만 복합체·3,000만 구조 공개 - 딥마인드·EMBL 협력, 단백질 상호작용 분석·신약 연구 활용 확대 엔비디아가 GTC 2026에서 구글 딥마인드, EMBL-EBI, 서울대학교 연구진과 함께 알파폴드 단백... file newsit 2026.03.19 47
2321 [GTC 2026] 엔비디아, 한국 기업과 AI 협력 확대…메모리·자율주행 전방위 확장 - 삼성전자·SK하이닉스·현대차, AI 인프라부터 SDV까지 협력 사례 공개 엔비디아가 GTC 2026에서 삼성전자, SK하이닉스, 현대자동차그룹 등과의 협력 사례를 공개... file newsit 2026.03.19 34
2320 [GTC 2026] 엔비디아, 금융 AI 확산 가속…마스터카드·레볼루트·아디옌 도입 확대 - 트랜잭션 파운데이션 모델로 사기 탐지·신용 예측·결제 최적화 강화 엔비디아가 GTC 2026에서 글로벌 금융 기업들이 자사 기반 트랜잭션 파운데이션 모델을 도... file newsit 2026.03.19 47
2319 스플렁크, ‘스플렁크 고 2026 서울’ 개최… 에이전틱 AI 옵저버빌리티 전략 공개 - 시스코 데이터 패브릭 결합…AI 스택 전반 가시성·보안·제어 통합 스플렁크가 ‘스플렁크 고 2026 서울’을 개최하고 AI 스택 전반의 가시성과 보안·제어를 통합하... file newsit 2026.03.18 49
2318 NXP, 엔비디아와 로보틱스 솔루션 출시…피지컬 AI 데이터 처리 구조 통합 - 센서 융합·모터 제어 통합 제품 공개…저지연 데이터 처리·전송 기반 구축 NXP가 엔비디아와 협력해 로보틱스 솔루션을 출시하며 피지컬 AI 환경에서 요구되는 ... file newsit 2026.03.18 50
2317 [GTC 2026] SAP, 폭스콘과 ‘AI 팩토리’ 협력…제조·공급망 구조 통합 추진 - GTC 2026서 파트너십 발표…엔터프라이즈 AI·스마트 제조 결합 모델 구축 SAP가 폭스콘과 협력해 ‘AI 팩토리’ 기반 제조·공급망 통합 구조를 구축하며 아시아태... file newsit 2026.03.18 47
2316 알리바바, 에이전틱 플랫폼 ‘우콩’ 공개…기업용 AI 업무 자동화 구조 제시 - 멀티 에이전트 오케스트레이션 기반 업무 처리…딩톡 연동·보안 중심 설계 알리바바가 기업 업무에 특화된 AI 네이티브 에이전틱 플랫폼 ‘우콩’을 공개하며 멀티... file newsit 2026.03.18 45
2315 델, 엔비디아 기반 AI 데이터 플랫폼 확대…데이터 병목 해소·AI 처리 구조 통합 - 데이터 라이프사이클 자동화·초고성능 스토리지 결합…에이전틱 AI 워크로드 대응 델이 ‘엔비디아 기반 AI 데이터 플랫폼’을 확대하며 데이터 준비부터 추론까지... file newsit 2026.03.18 51
2314 마스터카드, AI 에이전트 ‘국내 첫 결제’…에이전틱 커머스 실증 - 공항 이동 서비스 예약부터 결제까지 전 과정 자동 수행 마스터카드가 AI 에이전트가 검색부터 결제까지 전 과정을 수행하는 실거래를 국내에서 처음 구현하며 ... file newsit 2026.03.17 40
목록
Board Pagination Prev 1 2 3 4 5 6 7 8 9 10 ... 237 Next
/ 237
CLOSE