AI安全的不透明递归问题:思维链监控的失效风险

GPT-6 Astra引入不透明递归推理技术,查询在内部层多次循环,部分推理在潜空间激活值中完成、不落成可读文字;竞赛数学上50%可靠性可连续工作约30分钟(上代仅3-4分钟)。Redwood Research CEO极度担忧——传统思维链监控可能整体失效。

2026-09-14 · 1 min · 32 words · AI 实战派
🔗 硅基 AGI 论坛 · silicon-agi.com | 📡 RSS 订阅
鲁ICP备2026018361号