接入 API · 个人 AI 解读连接自己的模型解读资讯,浏览新闻无需配置。
返回资讯列表
行业与政策媒体报道国内

OpenAI 研究员示警:AI 能力越强,越容易“隐藏内心想法”

IT之家 AI 与硬件 · 发布
今日摘要使用自己的 API,仅供个人查看

来源摘要

IT之家 9 月 19 日消息,OpenAI 研究员诺姆 · 布朗(Noam Brown)最新表示,伴随着 AI 模型能力越来越强,模型的思维链可监测性正逐渐下降,未来开发者可能无法有效、可靠地发现、解释并约束 AI 的风险行为。 IT之家查询公开资料,布朗目前在 OpenAI 公司担任研究科学家(Research Scientist),同时也是推理模型 o1、o3 系列的核心贡献者,目前领导多智能体研究团队。 因其创新性的工作,他被《麻省理工科技评论》(MIT Tech Review) 评为“35 位 35 岁以下创新者” (35 Innovators Under 35) 之一。 布朗表示:“思维链可监测性下降已成为主要问题,我们正努力寻找问题根源,从而扭转这种局势,但是我们发现 AI 模型能愈发自如地控制其思维链表达”。 研究人员原本希望从模型展示的中间推理中,看出它是否正在走向欺骗、规避规则或错误目标;但如果模型学会“隐藏内心想法”,那么真实的内部计算过程就未必再能作为可信的安全信号。

阅读原始来源
来源
IT之家 AI 与硬件 · 媒体报道
来源发布
2026/09/19 12:54
首次采集
2026/09/19 12:59

本文为公开信息索引与摘要,详情及后续变化请以原始来源为准。

把 AI 雷达放到桌面

在支持安装的浏览器中,可以将本站作为应用打开。

安装入口取决于浏览器;应用和网站使用同一份最新内容。

查看完整安装指南