争议大模型 SubQ 发布 1.1 Small 版本技术报告,三方评测称 1200 万 token 下检索准确率达 98%

争议大模型 SubQ 发布 1.1 Small 版本技术报告,三方评测称 1200 万 token 下检索准确率达 98%

2026-06-17 10:14查看原文

据报道,曾宣称能将计算消耗削减千倍的争议大模型 SubQ 发布了 1.1 Small(小参数)版本技术报告。研发公司 Subquadratic 联合评估商 Appen 开展三方评测,声称模型在 1200 万 token 的极限长度下实现了 98% 的检索准确率,且在实战编程测试中取得了接近主流前沿模型的成绩。

技术报告透露,该模型并非从头训练,而是在开源前沿模型基础上,替换注意力计算机制并增量训练 1 万亿 token 改造而来。目前模型未公开核心参数下载,也未开放人人可用的 API 接口。

#AI模型发布

免责声明:含第三方意见,不构成财务建议

推荐阅读

传OpenAI几周内发布Astra:员工已在Codex里试用新版本

08-20
传OpenAI几周内发布Astra:员工已在Codex里试用新版本

美国法律AI公司Harvey推出自有法律模型Tenet,底座采用月之暗面Kimi K3

08-19
美国法律AI公司Harvey推出自有法律模型Tenet,底座采用月之暗面Kimi K3

MiniMax H3开源后登顶多项评测榜并升至Hugging Face热度第一

08-05
MiniMax H3开源后登顶多项评测榜并升至Hugging Face热度第一

Qwen-Image-3.0-Pro 上线 Qwen Cloud,支持4.5k-token提示词和12种语言

08-05
Qwen-Image-3.0-Pro 上线 Qwen Cloud,支持4.5k-token提示词和12种语言

马斯克称 Grok 4.6 下周发布,SpaceX 全量数据将用于训练

08-05
马斯克称 Grok 4.6 下周发布,SpaceX 全量数据将用于训练

Mistral 发布 3B 参数开源多模态安全分类器 Shieldstral,单张 16GB Nvidia GPU 即可运行

08-05
Mistral 发布 3B 参数开源多模态安全分类器 Shieldstral,单张 16GB Nvidia GPU 即可运行

MiniMax-H3 发布,MLX 移植后可在 Apple Silicon 上运行

08-05
MiniMax-H3 发布,MLX 移植后可在 Apple Silicon 上运行