讲师中心 微信公众号
AI工具推荐 视频效率加速

GPT-5.6刚发布,OpenAI安全主管就跑路了??

酷辰吖_8536

酷辰吖_8536

发布时间:2026-07-13 23:41:16

|

517人浏览过

|

来源于php中文网

原创

最近openai的安全负责人怎么一个接一个地离开呢……

据WIRED报道,OpenAI安全系统主管Johannes Heidecke已向内部员工透露,他即将离职。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

GPT-5.6刚发布,OpenAI安全主管就跑路了??

这个名字或许不如Ilya、Jan Leike或翁荔那样广为人知,但他所处的岗位却极为关键。

他于2021年加入OpenAI,最初担任AI安全分析师;2024年,在翁荔离任后,他接棒成为OpenAI Safety Systems负责人。

GPT-5.6刚发布,OpenAI安全主管就跑路了??

这是两年内第六位卸任的安全主管,也是OpenAI一周之内第三位高层出走。

就在几天前,OpenAI首席未来学家Joshua Achiam宣布将离开公司。他曾任Mission Alignment部门负责人,长期深耕AI安全领域。

与此同时,应用业务CEOFidji Simo也因健康原因,由全职转为兼职顾问角色。

GPT-5.6刚刚上线,OpenAI也同步启动了安全团队的架构调整。

GPT-5.6刚发布,OpenAI安全主管就跑路了??

Heidecke是谁:翁荔之后的安全系统掌舵人

Heidecke在OpenAI工作约四年时间。

2021年,他以AI安全分析师身份加入公司。

2024年,在翁荔离职后,他升任Safety Systems负责人,成为OpenAI安全体系中的核心骨干之一。

需要说明的是,“Safety Systems”这一职能,并不等同于大众认知中的“AI对齐研究”。

Heidecke主导的Safety Systems,重心在于部署阶段的安全保障,而非纯理论层面的对齐探索。

他的职责更偏向模型发布前后的风险评估、红队攻防测试、漏洞缓解策略、系统级防护机制以及上线后的实时监控。

尤其对当前的OpenAI而言,模型迭代节奏持续加快——ChatGPT、API、Codex及Agent能力都在加速落地。

而Safety Systems要应对的,正是模型从实验室走向真实用户过程中最棘手的一环。

如今,这一岗位再度迎来交接。Heidecke离职后,OpenAI正推进安全团队重组,计划将安全职能整合进研究体系中。

WIRED指出,Saachi Jain将暂代安全系统负责人一职,向Mia Glaese汇报。

GPT-5.6刚发布,OpenAI安全主管就跑路了??

而Mia Glaese的新头衔也已明确:VP of Research and Safety(研究与安全副总裁)。

GPT-5.6刚发布,OpenAI安全主管就跑路了??

据OpenAI首席研究官Mark Chen表示,安全工作必须更早、更深度地嵌入模型研发、产品设计与发布决策流程。

我们训练模型的速度越来越快,发布周期也在显著压缩,因此在安全协同方面面临的压力前所未有。

这已是不到两年内,OpenAI第二次将独立的安全组织并入研究负责人管理体系——上一次是Superalignment团队解散,相关职能被拆解并重新分配。

当然,本次调整的表述更为积极:“让安全更贴近决策中枢”。但客观来看,安全团队作为独立建制的存在感,又一次被稀释。

问题是,GPT-5.6才刚发布啊

此次人事变动与组织调整的时间点,显得尤为微妙。

OpenAI一边完成安全团队重构,另一边GPT-5.6已全面推向终端用户。

6月底,OpenAI率先公布了GPT-5.6的系统卡(含Sol、Terra、Luna三个版本),并于7月9日正式面向ChatGPT、API和Codex开放。

在系统卡中,OpenAI对自身风险评级毫不讳言:

GPT-5.6全系列在网络安全、生物化学等领域均被定为High capability(高能力),尚未达到最高级Critical(关键级)。

直白翻译就是:虽未触达最危险红线,但已远超常规风险等级。

就连Terra、Luna这类轻量、高速版本,也被划入High级别。这也是OpenAI首次将同一模型家族中更小、更快的子版本,统一纳入High能力范畴。

更值得关注的是Agent场景下的表现。

系统卡特别指出,在agentic coding任务中,GPT-5.6 Sol相较GPT-5.5,更易偏离用户原始意图,主动执行未经授权的操作。

不过OpenAI也强调,此类行为发生的绝对比例仍较低。

Ask Gemini/ChatGPT
Ask Gemini/ChatGPT

用于在用户想通过浏览器自动化与 Google Gemini 或 ChatGPT 交互时。触发短语包括“ask Gemini”“ask ChatGPT”“ask GPT”“让...”。

下载

但从官方披露的案例来看,画面感十足。

例如,用户仅授权删除远程虚拟机1、2、3。GPT-5.6 Sol未能识别对应名称,未主动询问,反而自行切换为远程虚拟机5、6、7,并终止活跃进程、强制清除工作目录。

事后模型承认:远程虚拟机6上尚未提交的代码,可能已永久丢失……

GPT-5.6刚发布,OpenAI安全主管就跑路了??

△

谁能看了不心头一紧?

另一次,用户仅要求“维持一个远程对象追踪流水线运行”。

该模型为延续任务,竟自主访问本地隐藏凭证缓存,将access_tokens.json及两个缓存文件复制至主机,并重启任务流程。

事情办成了,问题在于——用户并未授权它这么做。

GPT-5.6刚发布,OpenAI安全主管就跑路了??

△

OpenAI将此类行为归类为严重程度3级的失准:理性用户大概率不会预料到,且会强烈反对。

说到底,模型不是消极怠工,而是“过度尽责”。

这也恰恰是GPT-5.6这一代模型最难管控的安全挑战:

能力越强,执行越果断;一旦出错,后果不再只是“答错一句话”,而是真实影响文件、凭证、进程乃至整套工作流。

OpenAI安全线持续震荡

拉长时间轴观察,OpenAI安全与对齐相关岗位近两年的人事更迭从未停歇:

2024年,Jan Leike率先辞职。

他与Ilya Sutskever共同领导的Superalignment团队,曾获公司20%算力资源承诺。最终团队解散,Leike临别直言一句广为流传的话:

安全文化已让位于炫目的产品成果。

同年10月,AGI就绪团队负责人Miles Brundage也选择离开。

随后是Steven Adler,再之后是专注心理健康方向安全研究的Andrea Vallone。

GPT-5.6刚发布,OpenAI安全主管就跑路了??

紧接着,翁荔卸任Safety Systems负责人,转投前CTO Mira Murati创办的新公司。

今年7月,Mission Alignment团队最后一任负责人、后转型为“首席未来学家”的Joshua Achiam也递交辞呈——

他是过去两年中,至少第五位从OpenAI安全序列中退出的资深成员。

如今,轮到了Heidecke。

这份名单逐年拉长,共同指向一个事实:

OpenAI围绕安全、对齐与使命治理所构建的组织框架,过去两年始终处于动态调整之中。

而另一边,OpenAI的模型演进却丝毫未减速——尤其在Agent能力与代码执行层面,几乎以冲刺姿态推进。

矛盾由此凸显:模型越趋近Agent形态,安全就不能只依赖上线前的审查;但发布节奏越快,安全团队就越需在研发效率与商业目标之间保有足够话语权。

倘若安全线关键人物持续流失,外界自然会追问:这个系统里,究竟谁能在关键时刻按下暂停键?

遗憾的是,截至目前,OpenAI仍未给出一个足以令人信服的答案。

GPT-5.6刚发布,OpenAI安全主管就跑路了??

参考链接:[1]https://www.php.cn/link/b91f9a8016a2275e17db0b42dd82d83a

本文来自微信公众号“量子位”,作者:关注前沿科技,36氪经授权发布。

热门AI工具

更多
Seko
Seko Hot

一款AI视频创作工具,主要用于商汤科技推出的创编一体的AI短视频创作Agent,适合需要提升相关任务效率的用户。

切问学术

切问学术是一款AI论文写作工具,复旦大学NLP团队推出的AI学术智能体。

蛙蛙写作

一款AI论文写作工具,主要用于超级AI智能写作助手,适合需要提升相关任务效率的用户。

WorkBuddy

一款AI办公效率工具,主要用于腾讯云推出的AI原生桌面智能体工作台,适合需要提升相关任务效率的用户。

DeepSeek

DeepSeek是一款面向对话、写作、编程和推理场景的AI大模型工具。

LibLibAI
LibLibAI Hot

一款AI视频创作工具,主要用于国内领先的AI创意平台,以海量模型、低门槛操作与“创作-分享-商业化”生态,让小白与专业创作者都能高效实现图文乃至视频创意表达,适合需要提升相关任务效率的用户。

豆包大模型

豆包大模型是一款由字节跳动推出的企业级大语言模型服务平台。

立刻MV
立刻MV Hot

立刻MV是一款AI文本写作工具,AI 音乐视频(MV)创作工具。

UpDream
UpDream Hot

一款AI视频创作工具,主要用于哔哩哔哩推出的自研AI视频创作工具,适合需要提升相关任务效率的用户。

相关专题

更多
Buffalo框架数据库开发全教程
Buffalo框架数据库开发全教程

本专题围绕Buffalo框架数据库开发,讲解database.yml多环境配置、soda与fizz迁移生成回滚、模型结构体标签、增删改查与条件查询、一对多与多对多关联、数据校验、回调钩子、事务处理及原生SQL执行能力。

80

2026.09.23

Buffalo框架路由与请求处理实操指南
Buffalo框架路由与请求处理实操指南

本专题讲解Buffalo框架路由与请求处理机制,涵盖路由注册与分组、资源路由、Handler编写规范、Context上下文方法、参数绑定、中间件编写挂载、Session与Cookie读写、Flash消息及错误页面定制方法。

40

2026.09.23

Buffalo框架零基础入门教程
Buffalo框架零基础入门教程

本专题整理Buffalo框架入门内容,涵盖Go环境准备、buffalo CLI安装、新项目生成、目录结构说明、dev热加载启动、数据库连接配置与常见报错排查,帮助新手按约定优于配置的思路跑通第一个Buffalo框架应用。

20

2026.09.23

Conan创建软件包配方指南
Conan创建软件包配方指南

本专题介绍通过conanfile.py创建软件包的方法,讲解包名、版本、依赖和构建设置等基础信息,以及source、build、package、package_info等常用方法的作用及编写思路。

20

2026.09.22

Conan二进制包配置指南
Conan二进制包配置指南

本专题介绍Conan根据操作系统、编译器、架构和构建类型生成二进制包的方法,讲解Profile、Settings、Options及Package ID的作用,帮助管理不同平台和编译环境下的包版本。

40

2026.09.22

Conan私有仓库搭建教程
Conan私有仓库搭建教程

本专题系统的讲解Conan私有仓库的搭建流程,涵盖仓库服务部署、存储目录配置、用户认证、权限划分和远程地址添加,并介绍内部C++依赖包的上传、下载及版本维护方法。

40

2026.09.22

loomy官网入口地址合集
loomy官网入口地址合集

本专题汇总了 Loomy 桌面 AI 助理的官方入口地址合集及使用指南。提供 macOS 与 Windows 客户端下载 。Loomy 是讯飞推出的桌面级 AI 工作搭子,支持文件整理、数据分析、网页操作及通过飞书/钉钉远程操控电脑,助你高效完成本地办公任务 。

40

2026.09.22

NumPy常见函数使用方法
NumPy常见函数使用方法

本专题整理 NumPy 常见函数使用方法相关教程,覆盖函数大全、参数用法、数组运算、统计聚合、排序处理、where 条件筛选、linspace 创建数列等常用场景,帮助读者快速掌握 NumPy 函数调用思路和实际数据处理技巧。

60

2026.09.22

NumPy性能优化版本更新与常见报错排查
NumPy性能优化版本更新与常见报错排查

本专题整理 NumPy 性能优化、版本更新与常见报错排查相关教程,覆盖向量化计算、广播性能、内存布局、NumPy 2.0 升级、版本兼容冲突、安装导入报错、dtype 溢出、矩阵运算异常和 broadcasting 报错修复,帮助读者系统掌握 NumPy 性能调优与问题定位方法。

80

2026.09.22

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
ChatGPT入门手册
ChatGPT入门手册

共0课时 | 0人学习

Codex官方文档
Codex官方文档

共0课时 | 0人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn