- 에이전틱 코딩·멀티모달 추론·음성·영상 통합 처리 기반 AI 실행 범위 확대

 Qwen3.5-Omni-Plus 상세 기능.jpg

알리바바(Alibaba)가 에이전틱 실행 기반 코딩 모델 Qwen3.6-Plus와 텍스트·음성·이미지·영상 데이터를 통합 처리하는 옴니모달 모델 Qwen3.5-Omni를 공개했다. 복합 작업을 단계적으로 수행하는 실행 구조와 멀티모달 처리 범위를 확장해 소프트웨어 개발 자동화와 실시간 상호작용형 AI 적용 영역을 동시에 넓혔다.

 

에이전틱 실행 구조와 옴니모달 모델 병행 공개

두 모델은 서로 다른 활용 목적에 맞춰 개발됐다. Qwen3.6-Plus는 코드 생성 이후 테스트와 반복 개선 과정을 이어가는 에이전틱 실행 흐름에 초점을 맞췄으며 Qwen3.5-Omni는 텍스트·음성·이미지·영상 입력을 단일 모델에서 함께 처리하는 옴니모달 구조를 사용한다. 인식·추론·행동 단계를 하나의 흐름으로 연결해 다단계 작업을 연속적으로 수행한다.

 

Qwen3.6-Plus, 저장소 단위 엔지니어링 작업 자동화

Qwen3.6-Plus는 저장소(repository) 단위 코드 분석과 실제 시각 환경 기반 문제 해결을 수행하는 에이전틱 실행 모델이다. 능력 루프(Capability Loop)는 인식·추론·행동 단계를 하나의 워크플로로 연결해 코드 생성 이후 테스트와 반복 개선 과정을 이어가며 최대 100만 토큰 컨텍스트를 지원해 장문 문서와 대규모 코드베이스를 함께 분석한다.

 

멀티모달 추론 기능은 고밀도 문서 파싱, 실제 환경 이미지 해석, 장편 영상 이해 작업을 포함한다. UI 스크린샷, 손그림 와이어프레임, 제품 프로토타입을 입력 데이터로 활용해 프론트엔드 코드 생성까지 이어지는 시각적 코딩 기능을 제공한다.

 

Model StudioQwen Chat에서 사용할 수 있으며 OpenClaw, Claude Code, Cline 등 외부 개발 도구와 연동된다. 일부 모델은 개발자 친화적 규모의 오픈소스 형태로 공개될 예정이다.

 Qwen3.5-Omni-Plus, 주요 벤치마크에서 최고 수준 성능 달성.png

Qwen3.5-Omni, 텍스트·음성·영상 통합 처리 모델

Qwen3.5-Omni는 텍스트, 음성, 이미지, 영상 데이터를 하나의 모델에서 함께 처리하는 옴니모달 AI 모델이다. 텍스트와 음성을 출력 형태로 제공하며 실시간 상호작용과 오프라인 분석 작업을 하나의 실행 흐름에서 수행한다. 라이브 스트리밍, 음성 비서, 영상 자막 생성과 같은 멀티모달 기반 서비스에 활용된다.

 Qwen3.6-Plus, 주요 벤치마크에서 경쟁 모델 대비 우수한 성능 입증.png

Plus·Flash·Light 세 가지 버전으로 제공되며 최대 256K 토큰 컨텍스트를 지원한다. Qwen3.5-Omni-Plus200개 이상의 벤치마크에서 상위 수준 결과를 기록했으며 음성 이해, 추론, 음성 인식, 다국어 번역 영역에서 성능 평가 범위를 넓혔다.

 

Hybrid-Attention Mixture-of-Experts 아키텍처를 기반으로 10시간 이상의 연속 오디오 입력을 처리하며 1억 시간 이상의 음성·영상 데이터를 포함한 학습 데이터를 활용했다. 음성 인식은 113개 언어와 방언, 음성 생성은 36개 언어를 지원한다.

 

장면 단위 분할과 타임스탬프 정렬을 통해 등장인물 관계와 맥락 정보를 포함한 구조화된 설명을 생성한다. Audio-Visual Vibe Coding 기능은 음성 설명과 스케치를 입력 데이터로 활용해 앱·웹 인터페이스 프로토타입 생성 흐름을 제공한다. ARIA(Adaptive Rate Interleave Alignment) 기술을 적용해 스트리밍 환경에서 음성 합성 안정성을 높였다.

 

#알리바바 #Qwen #Qwen36Plus #Qwen35Omni #에이전틱AI #옴니모달AI #멀티모달 #MixtureofExperts #AI코딩 #AudioVisualAI

 

 
?

List of Articles
번호 분류 제목 글쓴이 날짜 조회 수
» 알리바바, Qwen3.6-Plus·Qwen3.5-Omni 공개…에이전틱 실행과 옴니모달 처리 동시 확장 - 에이전틱 코딩·멀티모달 추론·음성·영상 통합 처리 기반 AI 실행 범위 확대 알리바바(Alibaba)가 에이전틱 실행 기반 코딩 모델 Qwen3.6-Plus와 텍스트·음성·이... file newsit 2026.04.06 25
2353 한국레노버, 산업용 AI 엣지 컴퓨팅 ‘씽크엣지’ 2종 출시…온디바이스 처리로 지연 최소화 - 씽크엣지 SE30n·SE60n, 최대 97 TOPS 기반 실시간 산업 데이터 분석 지원 한국레노버가 산업 환경에 최적화된 AI 엣지 컴퓨팅 솔루션 씽크엣지(ThinkEdge) 2종... file newsit 2026.04.06 24
2352 사이냅소프트, 문서 AI·RAG 기반 도서관 AX 전환 지원 - 문서 AI 4종으로 학술 데이터 지식화 및 검색 자동화 기능 공개 사이냅소프트가 제24차 한국학술정보협의회 콘퍼런스에서 문서 AI(Document AI) 기반 도서관 업... file newsit 2026.04.03 29
2351   EDB, 엔비디아 GPU 결합…Postgres 분석 최대 100배 가속 - Apache Spark용 NVIDIA cuDF 통합 확대, 3TB 이상 데이터 분석 50~100배 처리 향상 EDB가 엔비디아 GPU 가속 기술을 포스트그레스(Postgres) AI 플랫폼에 결합... file newsit 2026.04.03 32
2350 유아이패스, 구매-지급(P2P) 에이전틱 AI 솔루션 공개… 재무 워크플로우 자동화 적용 - AI 에이전트 기반 오케스트레이션… 구매 승인·청구서 검증·예외 처리 흐름 자동화 유아이패스가 구매부터 지급까지 이어지는 P2P(Purchase-to-Pay) 전 과정에 ... file newsit 2026.04.02 39
2349 사이냅소프트, OCR IX CPU 출시… GPU 없이 AI OCR 실행 지원 - 양자화 적용 모델 경량화…기존 서버에서 문서 인식 자동화 운영 사이냅소프트가 GPU 없이 실행 가능한 AI OCR 솔루션 ‘사이냅 OCR IX’ CPU 버전을 공개했다. 기... file newsit 2026.04.02 33
2348 AIWORKX, 생성형 AI 기반 비대면 기업카드 심사 자동화 프로젝트 수주 - OCR·LLM·RAG 적용 신청·심사·발급 전 과정 자동화 AIWORKX가 국내 주요 카드사의 비대면 기업카드 신청 및 심사 프로세스 고도화 프로젝트를 수주했다. 비대면 ... file newsit 2026.04.02 47
2347 데이터브릭스, 레이크하우스 기반 엔터프라이즈 AI 확산… 국내 비즈니스 100% 성장 - AI Days Seoul 개최… 3년간 데이터·AI 전문 인력 1만 명 양성 추진 데이터브릭스가 오프라인 컨퍼런스 ‘AI Days Seoul’을 개최하고 지난 회계연도 국내 비즈니... file newsit 2026.04.01 26
2346 티맥스소프트, 제우스 11 국내 최초 자카르타 EE 11 인증 획득 - 자바 21 기반 차세대 WAS… AI·클라우드 환경 대응 플랫폼 강화 티맥스소프트가 애플리케이션 서버 ‘제우스 11(JEUS 11)’으로 국내 최초 자카르타 EE 11 인증을 ... file newsit 2026.04.01 35
2345 레노버, 데이비드 베컴과 글로벌 파트너십 체결… AI 스포츠 혁신 협력 확대 - 2026 FIFA 월드컵 기술 파트너십 연계… 경기력·팬 경험 고도화 추진 레노버가 글로벌 스포츠 영향력을 보유한 데이비드 베컴(David Beckham)과 파트너십을 체결... file newsit 2026.04.01 34
목록
Board Pagination Prev 1 2 3 4 5 6 7 8 9 10 ... 236 Next
/ 236
CLOSE