한국정보기술진흥원2026 제7회 청소년 IT경시대회 개최안내

알리바바, 2.4조 매개변수 초거대모델 '퀜3.8-맥스' 정식 공개...다음 주 오픈웨이트 배포 예고, 코딩·멀티모달 성능 앞세워 프런티어 시장 정조준

알리바바 퀜팀이 2.4조 매개변수 규모의 초거대 AI 모델을 정식 공개했다.
[한국정보기술신문] 중국 알리바바의 인공지능 연구조직 퀜(Qwen)팀이 매개변수 2조4000억 개 규모의 초거대 언어모델 '퀜3.8-맥스(Qwen3.8-Max)'를 8월 3일 정식 공개했다. 지난 7월 19일 상하이에서 열린 세계인공지능대회(WAIC)에서 프리뷰 형태로 처음 선보인 지 약 보름 만이다. 알리바바는 공식 블로그를 통해 이번 모델을 "현재 이용 가능한 가장 강력한 모델 중 하나이며, 앤스로픽의 파블 5(Fable 5)에 이어 두 번째"라고 소개했다.
image.png
Qwen 제공

2.4조 매개변수 중 약 950억 개만 작동

퀜3.8-맥스는 전문가 혼합(MoE·Mixture-of-Experts) 구조를 채택한 모델이다. MoE는 모델 전체를 매번 사용하지 않고, 입력에 맞는 일부 전문가 신경망만 골라 작동시키는 방식이다. 전체 매개변수는 2조4000억 개에 이르지만, 실제 추론 과정에서 작동하는 매개변수는 약 950억 개 수준이라고 알리바바는 밝혔다. 알리바바는 이러한 구조가 추론 효율을 높이면서 코딩, 추론, 멀티모달 작업을 함께 지원하기 위한 것이라고 설명했다.
이 모델은 텍스트뿐 아니라 이미지와 영상을 입력받아 텍스트로 답변한다. 알리바바는 △저장소 규모의 코딩 작업 △장문 문서 기반 지식 검색 △장시간 영상 색인 △구조화된 데이터 추출 △다단계 연구 보조 등을 주요 활용 분야로 제시했다. 소프트웨어 개발, 법률·금융 문서 검토, 미디어·전자상거래 운영, 디자인 등 네 개 산업을 겨냥한다는 것이 회사 측 설명이다.

100만 토큰 문맥 처리...입력 100만 토큰당 2달러

기술 사양을 보면 퀜3.8-맥스는 최대 100만 토큰 규모의 문맥을 처리한다. 최대 입력은 99만1000 토큰이며, 추론 기능을 켜면 98만3000 토큰으로 줄어든다. 최대 출력은 두 경우 모두 13만1000 토큰, 최대 추론 예산은 26만2000 토큰이다. 분당 처리 한도는 200만 토큰, 1만5000건의 요청이다.
이용 가격은 입력 100만 토큰당 2달러, 출력 100만 토큰당 6달러다. 캐시된 입력을 다시 읽을 경우 100만 토큰당 0.25달러로, 새 입력보다 8배가량 저렴하다. 함수 호출, 구조화된 출력, 미세조정(파인튜닝) 등을 지원하며, 코드 실행과 웹 검색 등 5종의 내장 도구도 함께 제공된다. 응용프로그램인터페이스(API)는 오픈AI 및 알리바바 대시스코프(DashScope)와 호환돼, 주소와 모델명만 바꾸면 기존 시스템에 연동할 수 있다.

코딩·멀티모달 벤치마크서 강세...일부 항목은 파블 5에 뒤져

알리바바는 이번 공개와 함께 자체 성능 평가표를 내놨다. 터미널벤치 2.1에서 퀜3.8-맥스는 86.6점을 기록해, 각각 84.6점을 받은 클로드 오퍼스 4.8 및 클로드 파블 5를 앞섰다. 다만 88.8점을 받은 GPT-5.6 솔(Sol)에는 뒤졌다. 페이퍼벤치(93.0점)와 IF벤치(82.8점)에서는 선두를 기록했고, GPQA 다이아몬드는 92.6점으로 이전 모델인 퀜3.7-맥스(92.4점)보다 소폭 올랐다.
멀티모달과 에이전트 관련 항목에서 개선 폭이 두드러졌다. 화면 조작 평가인 OS월드-베리파이드는 86.1점, 도면 이해 평가인 파라메트릭 CAD 벤치는 91.5점, 문서 처리 평가인 옴니독벤치 1.5는 92.1점을 기록했다. 반면 소프트웨어 개발 능력을 평가하는 SWE-벤치 프로에서는 67.7점으로 파블 5(80.0점)에 뒤졌고, 프런티어SWE에서도 73.5점으로 파블 5(88.8점)에 미치지 못했다.

다음 주 오픈웨이트 공개...일부 수치는 미공개

알리바바는 퀜3.8-맥스의 가중치(오픈웨이트)를 다음 주 알리바바 클라우드 '모델 스튜디오'를 통해 공개하겠다고 밝혔다. 다만 2조4000억 개 규모의 모델은 여러 대의 데이터센터급 장비가 필요해, 실제 자체 구축이 가능한 것은 일반 GPU 환경에서도 돌릴 수 있는 소형 모델 '퀜3.8-27B'라는 분석이 나온다. 이 27B 모델 역시 오픈웨이트로 함께 공개될 예정이다.
성능 수치를 해석할 때 유의할 점도 있다. 멀티모달 평가표가 이전 세대의 최상위 모델(퀜3.7-맥스)이 아니라 하위 모델(퀜3.7-플러스)과 비교돼, 세대 간 개선 폭이 실제보다 커 보일 수 있다. 또 알리바바가 공개한 강화학습 성능 곡선은 훈련 환경이 약 4000개에 이르렀을 때 0.725로 정점을 찍은 뒤 0.719, 0.689로 하락했다. 이번 성능 수치는 알리바바가 자체적으로 산출한 것으로, 아직 제3자의 독립적인 검증은 이뤄지지 않았다. 파블 5에 이어 두 번째라는 평가 역시 회사 측의 자체 주장이다.
한국정보기술신문 인공지능분과 박연호 기자 news@kitpa.org

함께 읽으면 좋은 기사

2026 하계 대학생 IT논문경진대회 결과 발표...고려대 이동근 팀·대구한의대 조소혜 팀 대상, 우수 논문 16개 팀에 대상 2·금상 6·은상 8 수여

2026 하계 대학생 IT논문경진대회 결과 발표...고려대 이동근 팀·대구한의대 조소혜 팀 대상, 우수 논문 16개 팀에 대상 2·금상 6·은상 8 수여

교육 · 인공지능 · 디지털인문학 5
2026 하계 청소년 IT학술대회 본선 23개 팀 수상...충남과학고 성지원·고색고 최우석 대상, 초등 6학년부터 고3까지 참여

2026 하계 청소년 IT학술대회 본선 23개 팀 수상...충남과학고 성지원·고색고 최우석 대상, 초등 6학년부터 고3까지 참여

교육 · 인공지능 · 디지털인문학 5
SK하이닉스, FMS 2026서 '계층형 메모리' 기반 차세대 AI 인프라 해법 제시...샌디스크와 HBF 첫 표준 규격 공개, 375단 4D 낸드 웨이퍼도 첫선

SK하이닉스, FMS 2026서 '계층형 메모리' 기반 차세대 AI 인프라 해법 제시...샌디스크와 HBF 첫 표준 규격 공개, 375단 4D 낸드 웨이퍼도 첫선

반도체 4
SK하이닉스, 용인·청주 신규 팹에 54조원 투자 결정...7일 이사회 의결, 용인 Y2에 35조2000억원·청주 M17에 19조1000억원, D램과 낸드 생산 거점 동시 확충

SK하이닉스, 용인·청주 신규 팹에 54조원 투자 결정...7일 이사회 의결, 용인 Y2에 35조2000억원·청주 M17에 19조1000억원, D램과 낸드 생산 거점 동시 확충

반도체 4
네팔 정부, 유출 계정 조회 서비스 HIBP에 47번째로 합류...국가사이버보안센터, 정부 도메인 이메일 유출 상시 감시 나서

네팔 정부, 유출 계정 조회 서비스 HIBP에 47번째로 합류...국가사이버보안센터, 정부 도메인 이메일 유출 상시 감시 나서

정보보안 3
깃허브 액션 8시간 44분 장애 끝에 복구...웹훅 85% 차단하며 밀린 작업 처리했다...한국시간 7일 오전 0시 22분 시작, 오전 9시 6분 완화 선언, 러너에 만료된 작업이 배정되는 오류가 원인, 페이지스·코파일럿 서비스도 함께 영향

깃허브 액션 8시간 44분 장애 끝에 복구...웹훅 85% 차단하며 밀린 작업 처리했다...한국시간 7일 오전 0시 22분 시작, 오전 9시 6분 완화 선언, 러너에 만료된 작업이 배정되는 오류가 원인, 페이지스·코파일럿 서비스도 함께 영향

정보기술 4
미 NSF, 1억 달러 규모 'AI 인프라 허브' 사업 착수...엔비디아·AMD·인텔 등 민간 참여...최대 10개 지역 컨소시엄 선정, 대학 간 AI 연구 격차 해소 겨냥

미 NSF, 1억 달러 규모 'AI 인프라 허브' 사업 착수...엔비디아·AMD·인텔 등 민간 참여...최대 10개 지역 컨소시엄 선정, 대학 간 AI 연구 격차 해소 겨냥

인공지능 4
미 뉴멕시코 법원, 메타에 5억6700만 달러 추가 부담 명령...아동 정신건강 기금 조성하고 미성년자 이용 시간도 월 90시간으로 제한

미 뉴멕시코 법원, 메타에 5억6700만 달러 추가 부담 명령...아동 정신건강 기금 조성하고 미성년자 이용 시간도 월 90시간으로 제한

방송통신 5
삼성전자, 런던서 '갤럭시 커뮤니티 커넥트' 개최...17개국 고객 51명 언팩 현장 참관

삼성전자, 런던서 '갤럭시 커뮤니티 커넥트' 개최...17개국 고객 51명 언팩 현장 참관

정보기술 3
농촌진흥청, 세계식육과학기술대회 16년 만에 한국 개최...50개국 전문가 1,000여 명, 9~14일 대전서 AI 스마트공장·지속가능성 논의

농촌진흥청, 세계식육과학기술대회 16년 만에 한국 개최...50개국 전문가 1,000여 명, 9~14일 대전서 AI 스마트공장·지속가능성 논의

유관기관 3
AMD, AI 모델을 반도체에 새기는 스타트업 '탈라스' 인수...메모리 없이 가중치를 실리콘에 직접 각인, 초당 1만7000토큰 시제품으로 엔비디아 추론 시장 정조준

AMD, AI 모델을 반도체에 새기는 스타트업 '탈라스' 인수...메모리 없이 가중치를 실리콘에 직접 각인, 초당 1만7000토큰 시제품으로 엔비디아 추론 시장 정조준

반도체 · 인공지능 4
엔비디아, 개방형 '월드 모델'로 물리 AI 생태계 확장...로봇·자율주행·비전 AI 겨냥한 코스모스 3, 640억~40억 매개변수 3종으로 공개...삼성전자·LG전자·두산로보틱스 등 활용

엔비디아, 개방형 '월드 모델'로 물리 AI 생태계 확장...로봇·자율주행·비전 AI 겨냥한 코스모스 3, 640억~40억 매개변수 3종으로 공개...삼성전자·LG전자·두산로보틱스 등 활용

인공지능 · 반도체 · 정보통신 4