首页 / 财经 / 阿里巴巴发布Qwen3.8基座模型 参数量达2.4万亿

阿里巴巴发布Qwen3.8基座模型 参数量达2.4万亿

摸鱼不慌
摸鱼不慌

2023年8月3日,阿里巴巴正式推出新一代基座大模型Qwen3.8,总参数量为2.4万亿,主要提升在编程与专业办公领域的表现。此模型性能在今日发布的Arena三方榜单中,仅次于Claude系列,排名全球第一梯队。

性能改进详情

Qwen3.8针对代码生成和协作办公场景进行优化,使相关应用强度显著增强。这是阿里巴巴大模型系列的关键升级,适用于开发者和企业用户。

API服务与价格优势

该模型的API已接入千问AI平台,并支持Agent产品“千问办公”。定价方面,国内每百万Tokens输入为12元、输出为36元,隐式缓存命中仅1.5元,与国际价格相比具有高性价比的特性。

市场反馈

消息发布后,阿里巴巴在港股早盘交易中股价上涨近6%,反映市场对该技术进展的积极反响。

Qwen3.8-Max预计下周开源,同时27B版本也将对公众可用。
阿里巴巴发布Qwen3.8基座模型 参数量达2.4万亿  第1张

阿里Qwen3.8大模型发布参数达2.4T性能达到新突破

阿里云宣布推出其最新旗舰大模型Qwen3.8,这是千问大模型系列中首次实现参数量重大突破的型号,支持视觉理解和长达1M Tokens的上下文处理。

核心架构与参数创新

Qwen3.8采用了稀疏MoE(Mixture of Experts)架构与混合注意力机制的优化组合,这种设计首次将模型总参数量扩展至2.4T,并激活95B,显著提升了推理效率和速度。MoE架构是一种大规模专家混合模型,通过动态路由选择特定专家处理输入,限于素材提供的信息,未涉及专家网络的历史演变,此处仅限字面表述。

多维度性能评测

在指挥家(IF Bench)评测中,Qwen3.8获得82.8分;科学推理测试GPQA Diamond得分92.6分;视觉推理BabyVision榜单上,Qwen3.8-Max在无工具环境赛事中取得82.0分,相当于某些竞品模型的约两倍表现;操作系统交互评估OSWorld-Verified中,该模型以86.1分荣登前列,体现了其强蟻智能体操作能力。

Qwen3.8-Max在视觉推理和操作系统任务中超越多款主流模型,显示了其在全球AI排行榜上的竞争力。

先进编程与专业任务能力

编程作为大模型的关键技能,Qwen3.8实现代码自主生成的新里程碑,CodeArena全球排名第四。相较于早期版本仅能辅助编写函数,Qwen3.8能从空白文件夹启动,独立完成十数天真实项目交付,无需人工干预。通过联合强化学习扩展,模型覆盖数百种高频专业任务,适用于Cowork等实际工作环境,提供稳定可靠的生产级输出。

视觉理解能力与开源前景

Qwen3.8-Max在Vision Arena榜单排名全球第二,其混合多模态智能体能力在RecreationBench任务中得到验证:仅凭交互反馈复刻复杂应用,无需源代码或联网,通过迭代编程循环推进视觉编程(Visual Coding),达到了新的高度。阿里云强调版,预览版已在Token Plan、Qoder和QoderWork中上线,预计Qwen3.8开源后,可能成为仅次于Fable 5的顶级模型。