据404media深入调查,openai长期雇佣数百名外包人员,对真实用户与chatgpt的对话记录进行人工审核,旨在持续优化模型输出质量。内部泄露文件及多位知情人士证实,这些审核员需依据统一标准,对ai生成的每条回复打分(1–7分),核心目标包括遏制模型“过度讨好用户”及“过度拟人化”等倾向。
有观点指出,多数用户并未意识到自己的聊天内容可能正被真人审阅;尽管对话经匿名化处理,仍存在暴露医疗、财务或身份类敏感信息的风险。尽管OpenAI已部署隐私过滤系统,但公司亦公开承认该系统存在漏判与误判可能。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

据悉,这批审核人员由外包机构Crossing Hurdles招募,并由AI训练服务商Mercor负责薪资发放。一名来自北美地区的前审核员透露,其时薪逾50美元。目前,OpenAI将“为所有人改进模型”设为默认开启项,用户可手动关闭该功能,从而阻止新发起的常规聊天被用于模型训练及人工评估;而启用“临时聊天”模式的对话,则完全不参与任何训练或人工审核流程。
使用 @youdotcom-oss/teams-anthropic 将 Anthropic Claude 模型(Opus、Sonnet、Haiku)添加到 Microsoft Teams.ai 应用程序中。可选集成 You.com MCP 服务器以进行网页搜索和内容提取。
需要强调的是,OpenAI并非首次公开人工审核机制。其官方FAQ自2023年起即载明:经授权的员工及第三方服务提供商,在必要范围内有权访问用户数据,以支持模型性能提升,并明确建议用户避免输入敏感或私密信息。但404Media指出,该说明措辞笼统、位置隐蔽,普通用户难以据此准确判断人工审核的实际覆盖广度与执行强度。
当前,人工反馈已深度嵌入大语言模型迭代闭环。Anthropic亦确认,对于开启特定隐私选项的Claude用户,其对话在完成匿名化后仍可能进入人工审核队列;谷歌同样允许审核人员抽查部分Gemini用户会话。此次曝光再度引发业界对AI发展效率与个体数据权益之间张力的广泛反思。

















