据官方公告,阿里千问发布旗舰模型Qwen3.8-Max的升级版Qwen3.8-Max-0902。参数规模保持2.4T参数和100万Token上下文,重点针对编程、复杂工作流和长时间Agent任务进行后训练。据阿里公布的对比数据,0902在8项编程评测上全部高于原版:TerminalBench 3.0从11.3涨至29.0,DeepSWE 1.1从56.6涨至69.3,QwenSWEbench V2从55.1涨至70.0,JobBench从53.4涨至64.0。
与Claude Opus 5相比,0902在多数编程项目上仍落后,但在MLS-Bench-Lite、SWE-Atlas QnA和QwenSWEbench V2三项上超过对方。多模态四项评测仅微涨0.4至3分,表明本轮升级聚焦于Agent的代码执行与任务执行能力。上述成绩均为阿里自测结果。目前Qwen3.8-Max-0902已上线QwenCloud API,价格维持不变:输入2美元、输出6美元/百万Token。
免责声明:含第三方意见,不构成财务建议
Anthropic向外部安全团队开放接近内部权限,CEO称应放缓模型能力研发
8 天前
Caterpillar将自动化采矿经验用于AI部署,推出Cat AI语音助手并计划五年投入1亿美元培训员工
21 天前
传OpenAI几周内发布Astra:员工已在Codex里试用新版本
08-20
美国法律AI公司Harvey推出自有法律模型Tenet,底座采用月之暗面Kimi K3
08-19
OpenAI 在 Hugging Face 事件后推出新安全措施:强化监控、网络隔离,30分钟警报机制
08-19
Perplexity 免费赠送策略见效:印度用户留存超五倍,订阅收入反增60%
08-19
苹果带摄像头AirPods明确不能录制,仅用于Siri视觉智能
08-19






