据报道,曾宣称能将计算消耗削减千倍的争议大模型 SubQ 发布了 1.1 Small(小参数)版本技术报告。研发公司 Subquadratic 联合评估商 Appen 开展三方评测,声称模型在 1200 万 token 的极限长度下实现了 98% 的检索准确率,且在实战编程测试中取得了接近主流前沿模型的成绩。
技术报告透露,该模型并非从头训练,而是在开源前沿模型基础上,替换注意力计算机制并增量训练 1 万亿 token 改造而来。目前模型未公开核心参数下载,也未开放人人可用的 API 接口。
免责声明:含第三方意见,不构成财务建议
传OpenAI几周内发布Astra:员工已在Codex里试用新版本
08-20
美国法律AI公司Harvey推出自有法律模型Tenet,底座采用月之暗面Kimi K3
08-19
MiniMax H3开源后登顶多项评测榜并升至Hugging Face热度第一
08-05
Qwen-Image-3.0-Pro 上线 Qwen Cloud,支持4.5k-token提示词和12种语言
08-05
马斯克称 Grok 4.6 下周发布,SpaceX 全量数据将用于训练
08-05
Mistral 发布 3B 参数开源多模态安全分类器 Shieldstral,单张 16GB Nvidia GPU 即可运行
08-05
MiniMax-H3 发布,MLX 移植后可在 Apple Silicon 上运行
08-05






