据报道,OpenAI 即将发布的 Astra 模型采用了循环推理架构(recurrent depth,又称 looped transformer)。该架构允许同一段信息反复经过同一组 Transformer 层进行多次计算后再输出,无需生成更长的思维链即可增加推理计算量。
字节跳动 Seed 团队去年发布的 Ouro 模型同样采用了这种 Looped Language Model 设计,使较小模型可通过更多计算接近更大模型的效果。然而,部分推理过程发生在模型内部隐藏状态,人类无法通过外部思维链完整检查模型是否违规。为此,OpenAI 限制了 Astra 使用 recurrent depth 的程度,保留可读的思维链,并计划加入额外的 CoT 监控措施。
免责声明:含第三方意见,不构成财务建议
千问发布Qwen-Audio-3.1系列语音大模型,TTS/Realtime/ASR价格大幅下调
1 小时前
Docker披露macOS Sandboxes严重漏洞:恶意代码可逃逸读写主机文件
5 天前
传OpenAI几周内发布Astra:员工已在Codex里试用新版本
08-20
美国法律AI公司Harvey推出自有法律模型Tenet,底座采用月之暗面Kimi K3
08-19
MCP服务器安全漏洞:明文配置与权限过宽可致企业机密泄露
08-19
攻击者利用单一基础设施持续抓取Salesforce和ServiceNow客户门户数据超一年
08-19
CISA将Ray框架活跃利用漏洞列入已知利用漏洞目录
08-19






