☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

据 CNBC 报道,Anthropic 首席执行官 Dario Amodei 提出,应在领先 AI 企业中长期派驻独立第三方安全评估人员,赋予其近乎等同于公司内部风控团队的系统访问权限,并允许其在保留必要敏感信息的前提下,自主公开评估报告。他明确以银行业“嵌入式监管”模式为范本,并承诺 Anthropic 将向这些外部评估员开放与内部风险团队完全一致的技术接口与数据权限。
阿莫代伊在上周末发布的深度长文中进一步警示:未来半年至一年内,若出现目标错位的智能体集群,或将在全球互联网中迅速扩散并引发数千亿美元级经济损失。此前,Anthropic 前研究员 Jacob Coxon 曾离职并公开警告称,当前头部AI实验室正陷入一场高风险竞赛——争相构建可能脱离人类控制的系统。
银行检查员有权叫停业务,AI评估员却只能“写报告”
多位深耕金融监管领域的法学专家及AI安全评估实践者指出,该构想缺失了银行监管体系中最关键的一环:强制执行力。怀俄明大学法学院院长 Julie Andersen Hill 指出,政府派驻大型银行的监察员拥有实权,可直接命令暂停某类金融活动、冻结扩张计划、更换高管团队,甚至依法接管或关闭机构;而 Amodei 所设想的AI评估员仅能开展审查与披露,无法干预模型训练流程、阻止模型上线。“这构成了本质差异——银行监管者的权力远超‘旁观者’范畴。”
网络安全公司 XBOW 的 AI 安全负责人 Albert Ziegler 补充道,黑盒压力测试虽能验证模型是否具备执行高危指令的能力,但真正致命的风险往往潜伏于评估者未曾覆盖的输入组合与运行环境中。“我们确实不具备否决权。”评估方最多促使企业在发布前进行审慎权衡,但最终拍板权仍牢牢掌握在企业自身手中。
“独立性”遭质疑:METR 被点名合作,却被指难逃利益绑定
Amodei 特别提及非营利组织 METR 作为潜在嵌入式评估机构,而值得注意的是,另一位前 Anthropic 研究员 Joe Benton 近期已正式加入 METR。加州大学伯克利分校研究员 Deborah Raji 对此提出尖锐质疑:这种人员流动叠加合作意向,极易引发财务关联、理念趋同与私人关系三重利益冲突;且 METR 近年评估工作高度集中于 Anthropic 与 OpenAI,“客观上为诸多异常操作提供了默许空间”。她强调,仅获得技术访问并不等于实质独立——真正的独立应由完全脱离企业影响的权威主体来定义评估资质、划定检查边界、决定结果呈报路径,否则“无异于让一家公司请自己的熟人来批改考卷”。
Raji 指出,检验评估机制是否有效的终极标尺,在于负面发现能否触发切实后果:“如果审计做完却毫无回响,那它就只是‘洗白式审计’。”Hill 则直言:“倘若你真心相信AI具备颠覆社会秩序的力量,那么你就必须配备一位真正握有断电权限的、完全独立的监督者。”
Anthropic 公共政策主管 Sarah Heck 于本周三回应称,AI行业的安全治理绝不能依赖“自律公约”或道德自觉:“我们不能既当考生又当监考老师——这一点毋庸置疑。”

















