讲师中心 微信公众号
AI工具推荐 视频效率加速

ShareGPT数据集在幻觉检测研究中的使用:识别AI生成错误信息的数据标注方法

秋婷酱_6349

秋婷酱_6349

发布时间:2026-05-21 18:01:37

|

456人浏览过

|

来源于php中文网

原创

利用ShareGPT构建幻觉标注体系需四步:一、提取含时间/数值/专有名词等高风险语义片段;二、双标注员分别判别上下文与外源性幻觉,专家仲裁分歧;三、对真实回复做时间/人名/机构名三类扰动生成负样本;四、为每条幻觉标注嵌入维基锚点或API证据及离线快照哈希。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

sharegpt数据集在幻觉检测研究中的使用:识别ai生成错误信息的数据标注方法

如果您正在开展AI幻觉检测研究,但缺乏可用于标注和验证模型错误输出的高质量对话基准,则可能是由于现有数据集未覆盖真实场景下的虚构陈述模式。以下是利用ShareGPT数据集构建幻觉标注体系的操作步骤:

一、基于原始对话提取高风险语义片段

ShareGPT数据集包含大量真实用户与AI助手的多轮交互记录,其中部分回复已隐含事实性偏差或逻辑断裂,可作为幻觉样本的天然来源。需从中定位易产生外源性幻觉的语义单元,例如涉及时间、数值、专有名词、因果关系的断言性语句。

1、遍历ShareGPT JSON文件中的每个"messages"列表,筛选role为"assistant"且content长度超过30字符的条目。

2、对每条assistant回复应用规则过滤:匹配正则表达式“(于|在|截至)[0-9]{4}年”、“共[0-9]+[个|种|次]”、“由[^\n,。;]+研发”等典型事实锚点结构。

3、将匹配成功的回复连同其前序user提问、相关images路径(如有)打包为独立样本单元,存入待标注队列。

二、引入双维度人工标注协议

为避免单一判断标准导致标注噪声,需对同一语义片段同步评估其是否构成幻觉及其幻觉类型,确保标注结果可区分上下文幻觉与外源性幻觉。

1、第一标注员判断该assistant回复是否与user提问中明确提供的信息矛盾,若矛盾则标记为上下文幻觉。

2、第二标注员脱离对话上下文,仅依据外部可信知识源(如维基百科快照、权威机构公开数据库)核查回复中所有实体、事件、数值的真实性,若无法验证或证伪则标记为外源性幻觉。

3、两名标注员结果不一致时,交由第三名领域专家仲裁,并记录分歧原因至元数据字段"annotation_conflict_reason"。

三、构建对抗性负样本增强集

原始ShareGPT数据中幻觉样本比例偏低,需通过可控扰动生成补充负样本,提升检测模型对细微虚构模式的敏感度。

1、对已标注为真实的assistant回复,使用预设扰动模板进行替换:将“2023年发布”改为“2025年发布”,将“张伟”替换为“李明”,将“北京协和医院”替换为“上海华山医院”。

2、每条原始回复生成3种扰动变体,分别对应时间篡改、人名替换、机构名替换三类常见幻觉模式。

3、将扰动后文本与原始user提问重新组合,添加字段"perturbation_type":"time_fabrication"等标识,纳入负样本库。

四、嵌入可追溯的事实核查锚点

为支持后续自动化检测模块回溯依据,需在标注过程中强制插入结构化事实核查线索,使每条幻觉标注具备可验证路径。

1、对标注为外源性幻觉的每条内容,在JSON样本中新增"fact_check_evidence"字段,填入对应维基百科页面标题及章节锚点,例如"COVID-19疫情时间线#2020年"。

2、若核查依赖数值型数据库,则记录具体API端点与查询参数,如"https://data.who.int/dataset/covid-19?filter=country:CN&year=2022"。

3、所有evidence链接必须经离线快照存档,并将存档哈希值写入"evidence_snapshot_hash"字段。

热门AI工具

更多
PixTV
PixTV Hot

PixTV是一款面向AIGC内容创作的AI视频生成工具。

PixPix
PixPix Hot

PixPix是一款面向电商视觉生产的AI商品图生成工具。

WorkBuddy

一款AI办公效率工具,主要用于腾讯云推出的AI原生桌面智能体工作台,适合需要提升相关任务效率的用户。

UpDream
UpDream Hot

一款AI视频创作工具,主要用于哔哩哔哩推出的自研AI视频创作工具,适合需要提升相关任务效率的用户。

豆包大模型

豆包大模型是一款由字节跳动推出的企业级大语言模型服务平台。

DeepSeek

DeepSeek是一款面向对话、写作、编程和推理场景的AI大模型工具。

超级简历WonderCV

一款AI办公效率工具,主要用于免费求职简历模版下载制作,应届生职场人必备简历制作神器,适合需要提升相关任务效率的用户。

VibeKnow
VibeKnow Hot

一款AI视频创作工具,主要用于全球首个AI知识视频创作平台,文档、文章、网页,一键生成视频,适合需要提升相关任务效率的用户。

Seko
Seko Hot

一款AI视频创作工具,主要用于商汤科技推出的创编一体的AI短视频创作Agent,适合需要提升相关任务效率的用户。

相关专题

更多
数据分析的方法
数据分析的方法

数据分析的方法有:对比分析法,分组分析法,预测分析法,漏斗分析法,AB测试分析法,象限分析法,公式拆解法,可行域分析法,二八分析法,假设性分析法。php中文网为大家带来了数据分析的相关知识、以及相关文章等内容。

1662

2023.07.04

数据分析方法有哪几种
数据分析方法有哪几种

数据分析方法有:1、描述性统计分析;2、探索性数据分析;3、假设检验;4、回归分析;5、聚类分析。本专题为大家提供数据分析方法的相关的文章、下载、课程内容,供大家免费下载体验。

2230

2023.08.07

网站建设功能有哪些
网站建设功能有哪些

网站建设功能包括信息发布、内容管理、用户管理、搜索引擎优化、网站安全、数据分析、网站推广、响应式设计、社交媒体整合和电子商务等功能。这些功能可以帮助网站管理员创建一个具有吸引力、可用性和商业价值的网站,实现网站的目标。

6270

2023.10.16

数据分析网站推荐
数据分析网站推荐

数据分析网站推荐:1、商业数据分析论坛;2、人大经济论坛-计量经济学与统计区;3、中国统计论坛;4、数据挖掘学习交流论坛;5、数据分析论坛;6、网站数据分析;7、数据分析;8、数据挖掘研究院;9、S-PLUS、R统计论坛。想了解更多数据分析的相关内容,可以阅读本专题下面的文章。

2884

2024.03.13

Python 数据分析处理
Python 数据分析处理

本专题聚焦 Python 在数据分析领域的应用,系统讲解 Pandas、NumPy 的数据清洗、处理、分析与统计方法,并结合数据可视化、销售分析、科研数据处理等实战案例,帮助学员掌握使用 Python 高效进行数据分析与决策支持的核心技能。

4045

2025.09.08

Python 数据分析与可视化
Python 数据分析与可视化

本专题聚焦 Python 在数据分析与可视化领域的核心应用,系统讲解数据清洗、数据统计、Pandas 数据操作、NumPy 数组处理、Matplotlib 与 Seaborn 可视化技巧等内容。通过实战案例(如销售数据分析、用户行为可视化、趋势图与热力图绘制),帮助学习者掌握 从原始数据到可视化报告的完整分析能力。

6012

2025.10.14

Python 数据分析与可视化合集
Python 数据分析与可视化合集

聚焦 Python 在数据分析领域的核心应用,讲解 NumPy 数组运算、Pandas 数据清洗与聚合统计、缺失值与异常值处理、数据透视表生成,以及使用 Matplotlib、Seaborn、Pyecharts 制作折线图、柱状图、热力图、地图等多种可视化图表,适合数据分析师和运营人员快速掌握用 Python 从原始数据中挖掘洞察的能力。

236

2026.04.08

Python数据分析与Pandas高级实战
Python数据分析与Pandas高级实战

本专题围绕 Python 数据分析展开,系统讲解 Pandas 的高级用法,包括数据清洗、透视表、时间序列分析以及多表合并与分组操作。通过实战案例,帮助开发者掌握高效处理与分析数据的方法,提高数据处理效率与分析能力。

411

2026.04.13

LLVM自定义Pass怎么写
LLVM自定义Pass怎么写

本专题聚焦LLVM自定义Pass开发,整理Pass类结构、run()方法、PreservedAnalyses、CMake构建、插件注册、-load-pass-plugin加载和测试用例编写流程。

80

2026.09.30

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
热门推荐
/
最新课程
关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn