Qwen3.8-Max 0902版本上线:重点增强编程与专业办公能力

Qwen3.8-Max 0902强化编程与办公能力,并以较低API成本上线。

冷月清谈:

阿里云发布Qwen3.8-Max 0902版本,针对编程和专业办公场景进行后训练,面向企业复杂任务、科研及长周期任务提升模型表现。据官方数据,新版本在CodeArena前端编程总榜获得1691分,较此前提升22分,重点强化多步推理、工具调用和端到端应用生成能力。成本方面,其每百万Tokens综合平均价格约为5美元,在榜单所列高性能模型中具有一定价格优势。目前,该版本已通过千问AI平台提供API服务,并接入千问办公、Qoder和千问APP。相关性能与成本结论主要来自官方及指定榜单,实际应用效果仍需结合具体任务测试。

怜星夜思:

1、编程榜单拿到高分,能否说明模型已经适合企业生产环境?
2、每百万Tokens约5美元,实际使用时真的会比其他模型省钱吗?
3、企业应该优先把这类模型用于写代码,还是专业办公和科研任务?
4、面对厂商公布的模型榜单和性价比数据,应该怎样判断是否可信?

原文标题:Qwen3.8-Max更强了!

原文作者:阿里云开发者

原文内容

今天,Qwen3.8-Max升级到0902版本。
1个月前,我们发布并开源了Qwen3.8-Max,陆续收到了企业和开发者们的热烈反馈和建议。在此基础上,我们围绕编程(Coding)和专业办公(Cowork),对Qwen3.8-Max进行了进一步的后训练,使得模型整体性能再度突破,更适合企业真实复杂任务、科研、长周期任务等。
CodeArena前端编程总榜中,Qwen3.8-Max提升22分至1691分夺得冠军。这说明,Qwen3.8-Max拥有更强的智能体编程能力,在多步推理、工具调用、端到端app生成方面均刷新了全球模型的新上限。同时,CodeArena更新的模型性价比榜单(帕累托前沿)显示,Qwen3.8-Max-0902新版本每百万Tokens综合平均仅5美元,而当前性能排名第二和第三的模型百万Tokens综合价格分别为20美元和12美元。
现在,全新的Qwen3.8-Max-0902版本模型,已上线千问AI平台对外提供API服务,并且第一时间接入千问办公、Qoder、千问APP,供所有企业、开发者和用户们使用。
欢迎体验👇

千问AI平台:
https://www.qianwenai.com/models/qwen3.8-max-0902

千问AI平台-Agent而生,驱动AI生产力
扫描下方二维码,直达千问AI平台体验

点击阅读原文即可体验!

针对Token价格,我还会关注上下文长度和计费口径。长文档场景中,输入往往占大头;如果支持缓存且命中率高,最终成本可能和公开单价差很多。

3 个赞

我的土办法是:把自己最头疼的十个任务扔进去。榜单看着像高考成绩,业务测试才像试用期,过不了试用期,状元也白搭。

3 个赞

回答成本问题:别只盯菜单上的单价,还要看“吃几碗”。模型如果一次做对,贵一点也可能更省;便宜但反复重试,账单照样起飞。

2 个赞

回答落地顺序:关键不在代码还是办公,而在有没有清晰验收标准。能自动检查结果的任务适合先做,主观性强、责任边界模糊的任务应晚一些。

3 个赞

回答榜单这个问题:先让它干两周真实需求再说。会写一个漂亮Demo不难,能不能看懂祖传代码、改完不引入新Bug,才是打工人的终极考场。

3 个赞

我会把1691分当作进入候选名单的依据,而不是采购结论。最好用内部代码库建立评测集,再统计任务成功率、人工返工时间和单次有效交付成本。

1 个赞