Folia
← 返回头版

OpenAI新型推理技术引发AI安全专家担忧

OpenAI在其新型Astra模型中采用了名为"递归深度"的推理技术,该技术让模型在非线性循环中处理查询,但留下的可读追踪明显减少1。这一做法立即引起了AI安全领域的警惕。

Redwood Research首席执行官Buck Shlegeris表示,"如果OpenAI进一步推进这项技术,他们将有选项大幅增加递归并完全破坏思维链可监测性"1。AI安全倡导者Zvi Mowshowitz则认为,可能需要采取法律手段防止AI实验室之间的"竞争下沉"1。安全专家们的核心担忧在于,该技术的推广使用可能会削弱对AI模型行为的可监测性。

对此,OpenAI首席科学家Jakub Pachocki表示该公司致力于保持思维链的可读性1。与此同时,Anthropic和Google DeepMind已开始讨论这一技术1。


评论