阿里千问发布Qwen3.8-Max-0902升级版,8项编程评测全涨,部分超Claude Opus 5

阿里千问发布Qwen3.8-Max-0902升级版,8项编程评测全涨,部分超Claude Opus 5

2026-09-02 03:12查看原文

据官方公告,阿里千问发布旗舰模型Qwen3.8-Max的升级版Qwen3.8-Max-0902。参数规模保持2.4T参数和100万Token上下文,重点针对编程、复杂工作流和长时间Agent任务进行后训练。据阿里公布的对比数据,0902在8项编程评测上全部高于原版:TerminalBench 3.0从11.3涨至29.0,DeepSWE 1.1从56.6涨至69.3,QwenSWEbench V2从55.1涨至70.0,JobBench从53.4涨至64.0。

与Claude Opus 5相比,0902在多数编程项目上仍落后,但在MLS-Bench-Lite、SWE-Atlas QnA和QwenSWEbench V2三项上超过对方。多模态四项评测仅微涨0.4至3分,表明本轮升级聚焦于Agent的代码执行与任务执行能力。上述成绩均为阿里自测结果。目前Qwen3.8-Max-0902已上线QwenCloud API,价格维持不变:输入2美元、输出6美元/百万Token。

#AI巨头动态#AI模型发布

免责声明:含第三方意见,不构成财务建议

推荐阅读

Anthropic向外部安全团队开放接近内部权限,CEO称应放缓模型能力研发

8 天前
Anthropic向外部安全团队开放接近内部权限,CEO称应放缓模型能力研发

Caterpillar将自动化采矿经验用于AI部署,推出Cat AI语音助手并计划五年投入1亿美元培训员工

21 天前
Caterpillar将自动化采矿经验用于AI部署,推出Cat AI语音助手并计划五年投入1亿美元培训员工

传OpenAI几周内发布Astra:员工已在Codex里试用新版本

08-20
传OpenAI几周内发布Astra:员工已在Codex里试用新版本

美国法律AI公司Harvey推出自有法律模型Tenet,底座采用月之暗面Kimi K3

08-19
美国法律AI公司Harvey推出自有法律模型Tenet,底座采用月之暗面Kimi K3

OpenAI 在 Hugging Face 事件后推出新安全措施:强化监控、网络隔离,30分钟警报机制

08-19
OpenAI 在 Hugging Face 事件后推出新安全措施:强化监控、网络隔离,30分钟警报机制

Perplexity 免费赠送策略见效:印度用户留存超五倍,订阅收入反增60%

08-19
Perplexity 免费赠送策略见效:印度用户留存超五倍,订阅收入反增60%

苹果带摄像头AirPods明确不能录制,仅用于Siri视觉智能

08-19
苹果带摄像头AirPods明确不能录制,仅用于Siri视觉智能