- AWS 트레이니움·인퍼런시아 기반 레드햇 AI로 프로덕션 AI 워크로드에 더 폭넓은 성능·유연성 확보

 

레드햇, AWS와 협업 확대.jpg

레드햇 매트 힉스 CEOAWS와의 협업을 확대해 AWS 전반에서 레드햇 AIAWS AI 실리콘을 결합한 엔터프라이즈 생성형 AI 지원을 강화한다고 밝혔다. 이번 협력은 기업이 기반 하드웨어와 무관하게 고효율·고성능 AI 추론을 대규모로 운영하도록 돕는 데 초점을 맞춘다.

 

AWS AI 칩 기반으로 강화된 레드햇 AI 인퍼런스 서버

레드햇은 vLLM 기반 레드햇 AI 인퍼런스 서버AWS 인퍼런시아2와 트레이니움3 칩에서 실행할 수 있도록 확장했다. 이를 통해 고객은 모든 세대의 생성형 AI 모델을 공통 레이어에서 운영할 수 있으며, 기존 GPU 기반 EC2 환경 대비 30~40% 향상된 가격 대비 성능을 확보할 수 있다. 고대역폭·저지연 추론 환경도 제공해 프로덕션 AI 배포의 효율성을 높였다.

 

오픈시프트 전반에 AWS 가속기 지원 확대

양사는 레드햇 오픈시프트, 오픈시프트 AI, ROSA에서 AWS 가속기를 활용할 수 있도록 ‘AWS 뉴런 오퍼레이터를 공동 개발했다. 이를 통해 고객은 AWS 인프라에서 AI 워크로드를 더 쉽게 배포·관리할 수 있는 실행 환경을 제공받는다. 레드햇은 또한 ‘amazon.ai 인증 앤서블 컬렉션을 출시해 오픈시프트 기반 워크로드에서 AWS AI 서비스를 자동화·오케스트레이션할 수 있도록 지원하고 있다.

 

접근성과 운영 유연성을 높이는 협업 구조

레드햇은 AWS 환경에서 필요한 대규모 AI 가속기에 대한 접근성을 강화하고, 고객 워크로드의 배포 용이성을 높이는 방향으로 지원을 확장한다. 두 회사는 AWS AI 칩 플러그인을 최적화하기 위해 vLLM 업스트림 개발에도 공동 기여하고 있으며, 이는 Red Hat OpenShift AI 3에서도 상업적으로 활용되고 있다.

 

하이브리드 클라우드 기반 AI 운영을 위한 지원 강화

레드햇과 AWS의 장기 협력은 데이터센터부터 엣지까지 이어지는 하이브리드 클라우드 전략을 기반으로 한다. 이번 협력 확대는 기업이 생성형 AI를 운영 환경에 통합하는 과정에서 필요한 성능 효율성, 확장성, 비용 절감 요구를 충족하도록 설계됐다.

 

AWS 뉴런 커뮤니티 오퍼레이터는 오픈시프트 및 ROSA 환경에서 바로 사용할 수 있다. AWS AI 칩 기반 레드햇 AI 인퍼런스 서버는 20261월 개발자 프리뷰로 제공될 예정이다.

 

#레드햇 #AWS #OpenShiftAI #트레이니움 #인퍼런시아 #레드햇AI #vLLM #AWSNeuron #Ansible #클라우드AI #엔터프라이즈AI

 

 
?

List of Articles
번호 분류 제목 글쓴이 날짜 조회 수
2129 알리바바 클라우드, 가트너 클라우드 DBMS 6년 연속 리더…실행 역량·비전 완성도 높게 평가 알리바바 클라우드는 2025년 가트너 매직 쿼드런트 클라우드 DBMS 부문에서 6년 연속 리더로 선정됐다고 밝혔다. 가트너 보고서는 클라우드 DBMS를 데이터 저장과... file newsit 2025.12.22 184
2128 레드햇, 2026년 엔터프라이즈 IT 전망 제시…AI 에이전트·IT 주권·추론 환경이 핵심 변수 - AI 에이전트 확산과 소버린 클라우드 수요, 가상화 시장 변동성 속에서 IT 리더의 전략적 선택 요구 레드햇(Red Hat)이 2026년 엔터프라이즈 IT 환경을 전망하... file newsit 2025.12.22 173
2127 티유브이슈드, 인덕과학기술고와 고전압 전기차 안전교육 협력…미래 모빌리티 인재 양성 - 독일 규격 기반 실무 교육으로 미래 모빌리티 인재 양성 강화 글로벌 시험·인증 기관 티유브이슈드(TÜV SÜD)는 인덕과학기술고등학교와 ‘고전압 전기차 안전교... file newsit 2025.12.22 174
2126 딥엘, “2026년, AI는 도구가 아니라 인프라가 된다” - 에이전트 AI 확산으로 기업 워크플로우와 운영 구조 전면 재편 글로벌 AI 언어 기술 기업 딥엘(DeepL)은 2026년을 기점으로 AI가 ‘활용 기술’에서 ‘기업 인프라... file newsit 2025.12.22 193
2125 매스로보틱스, AWS·엔비디아와 피지컬 AI 펠로우십 확대…2026년 코호트 모집 - 로보틱스·피지컬 AI 스타트업 대상 8주 가상 프로그램으로 기술·확장 지원 강화 매스로보틱스가 아마존웹서비스(AWS), 엔비디아 인셉션과 함께 피지컬 AI 펠로... file newsit 2025.12.19 158
2124 코헤시티, AWS와 전략적 협력 계약 체결…AI 기반 사이버 레질리언스 강화 - 대규모 데이터 보호·복구 고도화 및 백업 데이터를 AI 활용 자산으로 전환 코헤시티가 아마존웹서비스(AWS)와 전략적 협력 계약(SCA)을 체결하며, 대규모 AI 기... file newsit 2025.12.19 176
2123 사이냅소프트, 'HWP 원본 분석'으로 공공 문서 AI 데이터화 해법 제시 - 공문서 AI 학습 과정서 지적되는 PDF 재변환 비효율, 원본 분석으로 해소 정부가 AI 학습을 위한 공공 데이터 개방을 본격 추진하는 가운데, 공문서를 PDF로 변... file newsit 2025.12.19 134
2122 슈나이더 일렉트릭, AI·HPC 전용 CDU 2종 출시 - 고밀도 가속 컴퓨팅 환경 대응 위한 리퀴드쿨링 라인업 확대 슈나이더 일렉트릭이 고성능 컴퓨팅(HPC)과 인공지능(AI) 워크로드 확산으로 증가하는 데이터센터 ... file newsit 2025.12.19 130
2121 클루커스, 데이터·클라우드 산업 진흥 유공 장관표창 수상 - 미래선도·산업고도화 부문 선정…AI·클라우드 전환 성과 인정 데이터 및 인공지능 특화 클라우드 전문기업 클루커스가 과학기술정보통신부가 주최한 ‘2025 데이... file newsit 2025.12.18 173
2120 벡터코리아, DevOps 기반 SDV 테스트 자동화 플랫폼 공개 - 엔드투엔드 자동화·단일 개발 플로우로 SDV 개발 전환 가속 벡터코리아가 DevOps 기반 CI/CD와 엔드투엔드 테스트 자동화를 결합한 SDV(소프트웨어 중심 차량) ... file newsit 2025.12.18 167
목록
Board Pagination Prev 1 ... 16 17 18 19 20 21 22 23 24 25 ... 233 Next
/ 233
CLOSE