- 토큰 처리량 5·에너지 효율 4장문 추론 대응 인프라 제시

 

[GTC 2026] 엔비디아, 블루필드-4 STX 공개… 컨텍스트 메모리 기반 AI 스토리지 확장.jpg

엔비디아가 GTC 2026에서 블루필드-4 기반 STX 스토리지 아키텍처를 공개하고, 에이전틱 AI 환경에 대응하는 컨텍스트 메모리 중심 인프라를 제시했다. 긴 컨텍스트 기반 추론에서 발생하는 데이터 접근 지연과 GPU 활용 저하 문제를 스토리지 구조에서 해결하는 데 초점을 맞췄다.

 

컨텍스트 메모리 중심 스토리지 구조 전환

기존 데이터센터 스토리지는 대용량 저장에는 최적화돼 있지만, 여러 단계와 세션을 거치는 에이전틱 AI 워크로드에서는 응답성이 제한되는 구조였다. 대규모 컨텍스트를 기반으로 한 추론 환경에서는 데이터 접근 지연이 누적되면서 GPU 활용도가 떨어지고 처리 속도 저하로 이어진다. STXGPU 메모리를 확장하는 컨텍스트 메모리 계층을 중심으로 설계되며, 데이터 접근 경로를 단축해 추론 과정에서 필요한 데이터를 빠르게 공급하는 구조를 갖춘다.

 

CMX 플랫폼, 토큰 처리량 5배 확대

STX에는 랙 단위 구현을 위한 CMX 컨텍스트 메모리 스토리지 플랫폼이 포함된다. GPU 메모리를 확장하는 고성능 컨텍스트 레이어를 통해 기존 스토리지 대비 초당 최대 5배 수준의 토큰 처리량을 제공한다. 에이전틱 AI와 대규모 추론 환경에서 필요한 장문 컨텍스트를 안정적으로 처리할 수 있도록 설계됐다.

 

블루필드-4 기반 가속 스토리지 아키텍처

STX는 블루필드-4 프로세서를 중심으로 베라 CPU와 커넥트X-9 슈퍼NIC을 결합한 구조로 구성된다. 여기에 스펙트럼-X 이더넷과 도카, AI 엔터프라이즈 소프트웨어를 함께 적용해 스토리지, 네트워크, 컴퓨팅을 통합한 형태로 구성된다. 기존 CPU 기반 스토리지 대비 최대 4배 높은 에너지 효율을 확보하며, 엔터프라이즈 데이터 처리에서는 초당 2배 더 많은 페이지 처리가 가능하다.

 

클라우드·스토리지 파트너 공동 설계 확장

STX 아키텍처는 클라우디안, DDN, , 히타치 밴타라, HPE, IBM, 넷앱, 뉴타닉스, 바스트 데이터, 웨카 등 주요 스토리지 기업이 공동 설계에 참여한다. AIC, 슈퍼마이크로, QCT 등 제조 파트너가 시스템 구축을 맡으며, 코어위브, 크루소, 람다, 미스트랄 AI, 네비우스, OCI, 벌처 등 클라우드 및 AI 기업이 도입을 추진하고 있다.

 

엔비디아 젠슨 황 CEO에이전틱 AI는 방대한 컨텍스트 기반 추론을 요구하며, 이를 위해 새로운 스토리지 구조가 필요하다“STXAI 네이티브 인프라를 위한 모듈형 기반을 제공한다고 밝혔다.

 

STX 기반 플랫폼은 올해 하반기부터 파트너사를 통해 제공될 예정이다.

 

#GTC2026 #엔비디아 #STX #블루필드4 #AI스토리지 #컨텍스트메모리 #데이터센터 #AI인프라 #GPU #에이전틱AI

 

 
?

List of Articles
번호 분류 제목 글쓴이 날짜 조회 수
2333 한국퀀텀컴퓨팅, 에어큐브와 PQC 기반 패스워드리스 인증 PoC 추진 - 양자내성암호와 IAM 결합해 NPE 키 관리 구조 검증 한국퀀텀컴퓨팅(KQC)이 에어큐브와 PQC(Post-Quantum Cryptography) 기반 패스워드리스 인증 모델 공동 검증... newfile newsit 2026.03.25 6
2332 넷앱, NVIDIA 기반 AI Data Engine 공개…메타데이터 중심 AI 데이터 파이프라인 구조 제시 - 글로벌 메타데이터 카탈로그 기반 데이터 탐색·거버넌스 통합, 에이전틱 AI 워크플로우 지원 넷앱이 NVIDIA AI Data Platform 레퍼런스 아키텍처와 결합한 AI ... file newsit 2026.03.24 33
2331 스트라타시스, TrueDent CE Class IIa 획득…3D 프린팅 의치 적용 범위 확대 - 모놀리식 다색 의치·임시 수복 적용, 유럽 디지털 보철 워크플로우 확장 스트라타시스 트루덴트(TrueDent) 레진이 CE Class IIa 의료기기 인증을 획득하며 3D ... file newsit 2026.03.24 35
2330 EDB, EPAS 네이티브 TDE로 WAL·임시파일까지 암호화 - 커널 I/O 레벨 통합 방식으로 인덱스·임시파일·WAL까지 보호 범위 확장 EDB가 PostgreSQL 커널 레벨에 통합된 네이티브 TDE(Transparent Data Encryption)를 적... file newsit 2026.03.23 22
2329 [GTC 2026] 레노버, AI 추론부터 AI 팩토리까지 확장…하이브리드 AI 전주기 실행 구조 공개 - 워크스테이션·엣지·데이터센터·AI 팩토리로 이어지는 추론 중심 인프라 구성 레노버가 GTC 2026에서 AI 추론부터 AI 팩토리까지 이어지는 하이브리드 AI 실행 ... file newsit 2026.03.20 44
2328 아웃시스템즈, G2 AI 에이전트 빌더 리더 선정…NPS 95점 기록 - 관리 편의성 100%·맥락 인식 95%, 엔터프라이즈 AI 에이전트 평가 상위권 확보 아웃시스템즈가 G2 ‘2026 Grid Report’에서 AI 에이전트 빌더 부문 리더로 선정... file newsit 2026.03.20 41
2327 지멘스, 에이전틱 AI 기반 반도체 검증 플랫폼 ‘퀘스타 원 에이전틱 툴킷’ 공개 - RTL 사인오프 가속, 설계·검증 워크플로우를 AI 기반으로 재구성 지멘스가 ‘퀘스타 원 에이전틱 툴킷’을 통해 반도체 설계 검증 전 과정을 에이전틱 AI 기반 워... file newsit 2026.03.20 34
2326 아비바-엔비디아, 기가와트급 AI 팩토리 디지털 트윈 공개…설계·운영 통합 구조 구축 - 옴니버스 DSX 기반 아키텍처, GPU 효율·토큰 처리 속도 동시 개선 아비바가 엔비디아와 협력해 기가와트급 AI 팩토리 구축을 위한 라이프사이클 디지털 트윈 아... file newsit 2026.03.20 25
2325 코헤시티, NH농협은행 클라우드 백업 구축…TCO 28억 절감·복구시간 94% 단축 - 퍼블릭 클라우드 기반 소산백업 전환, 자동화 검증으로 금융 데이터 보호 강화 코헤시티가 NH농협은행에 퍼블릭 클라우드 기반 원격 소산백업 시스템을 구축하... file newsit 2026.03.19 36
2324 [GTC 2026] HPE, 엔비디아와 AI 인프라 확장…GPU 128개 규모·인증 스토리지 적용 - 프라이빗 클라우드 기반 대규모 AI 처리 성능·운영 안정성 확보 HPE가 엔비디아와 협력해 최대 128개 GPU를 동시에 활용하는 대규모 AI 인프라를 공개했다. 엔... file newsit 2026.03.19 34
목록
Board Pagination Prev 1 2 3 4 5 6 7 8 9 10 ... 234 Next
/ 234
CLOSE