阿里千问8月3日发布Qwen3.8-Max,模型权重下周首次开源
8月3日,阿里千问正式发布大模型产品Qwen3.8-Max。该模型在编程、办公、长程任务及多模态智能体能力方面全面提升,官方宣布其能够“端到端完成复杂目标”。模型权重将于下周首次开源。
四大场景能力增强
Qwen3.8-Max针对多个应用领域进行了重点优化。在编程场景,模型可以更高效地理解需求并生成代码;在办公方面,支持文档处理、任务管理等常见工作流;长程任务能力使模型能够维持长期上下文,完成多步骤规划;多模态智能体则让模型可以融合文本、图像等多种信息进行交互与处理。
其中,多模态智能体指模型在统一框架下处理不同类型的数据,并协同完成复杂任务,这提升了人机交互的自然度。
端到端完成复杂目标
官方强调,Qwen3.8-Max具备端到端完成复杂目标的能力。这意味着用户只需输入最终目标,模型可以自主规划、执行、调整,直到交付结果,中间无需人工分步介入。这种能力在自动化、智能协同等场景中具有重要价值。
下周首次开源模型权重
阿里千问还宣布,Qwen3.8-Max的模型权重将于下周首次向公众开源。开源后,开发者和研究者可以下载模型进行本地部署、微调与二次开发,有助于加速AI技术在行业中的落地应用。
- 发布时间:8月3日
- 能力亮点:编程、办公、长程任务、多模态智能体
- 核心特性:端到端复杂目标完成
- 开源安排:下周首次开源模型权重
千问 参数与性能方面,Qwen3.8-Max基于Qwen 3.5架构构建,总参数规模达2.4万亿,激活参数950亿,支持100万上下文Tokens。第三方基准测试显示,Qwen3.8-Max在Arena榜单中,文本能力与视觉理解均为第二、编程能力第三。
AI模型自主构建oh-my-cli项目 16天提交代码265次
一个AI模型在完全自主运行状态下,耗时约16天从零构建oh-my-cli项目,并持续迭代。截至7月30日,该项目累计完成265次代码提交、127个合并请求和151个议题,显示出该模型具备持续演进的自动化开发能力。
项目背景与开发方式
该模型被要求独立创建并持续自主迭代oh-my-cli项目,整个开发过程无人工干预,完全由模型自动驱动。
核心指标解读
截至7月30日,该项目在约16天的完全自主运行中累计产生265次代码提交、127个合并请求和151个议题。
代码提交是开发中每次变更的版本记录;合并请求用于代码审核与分支整合;议题用于跟踪项目任务和技术讨论。这些指标综合展示了模型的自主开发效率。
自主运行能力解析
“完全自主运行”意味着模型独立完成项目规划、编码、测试和版本管理,无需人工协助。oh-my-cli项目的快速演进正是这一能力的实证。
该模型在编程领域的实践表明,AI已能够独立维持一个项目的持续迭代,展现了自动化开发的可验证能力。

Qwen3.8-Max五天自主复现并超越原论文:7600行代码、33轮训练,AIME24提升2.7个百分点
近日,一款名为Qwen3.8-Max的模型在科研复现任务中展示出全自主工作能力:仅凭一篇论文和GPU资源,从零开始独立工作五天后,不仅完整复现了原文的六项结论,还在AIME24数学基准上实现了超越。
全程自主操作:7600行代码与33轮训练
根据披露的信息,Qwen3.8-Max总计用时125小时完成整个科研复现流程。其中,前37小时用于复现论文的六项核心结论,后88小时则自主提出了18种改进方向。在全部过程中,该模型自主写下7600行代码,并完成了33轮GPU训练。
最终成果:超越原论文2.7个百分点
经过上述流程,Qwen3.8-Max在AIME24数学基准上的表现超越了原论文所报告的结果,超出幅度为2.7个百分点。该模型实现了从论文复现到性能优化的完整闭环。
“全程自主写下7600行代码、完成33轮GPU训练——实现了论文的复现与超越。”
关于相关概念
科研复现指的是在现有资料基础上,还原原始研究的过程与结论,以验证其可信度。此处提到的AIME24则被用作一项数学能力评估基准,用于衡量模型在数学问题上的推理表现。
据CNMO科技了解,今日起全球开发者都可通过千问AI平台获得Qwen3.8的API服务,国内每百万Tokens输入12元、输出36元。 版权所有,未经许可不得转载
