ShareGPT与Chatbot Arena通过数据共享、身份映射、标签协同和反馈回传四路径深度联动:前者为后者提供脱敏对话数据,后者反哺能力标签并闭环反馈异常。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您在使用ShareGPT浏览他人分享的对话记录时,注意到部分对话旁标注了“Arena胜出”或链接至lmsys.org,这反映了两个平台在模型行为数据层面的实际交集。以下是揭示二者关联的具体路径:
一、共享对话数据作为评测原始素材
Chatbot Arena的匿名对战机制依赖真实用户提交的多轮交互样本,而ShareGPT是其关键数据来源之一。该平台允许用户导出并公开GPT-4、Claude、Gemini等模型的完整对话JSON,这些结构化数据经脱敏处理后可直接注入Arena的对抗评测流水线。
1、用户在ShareGPT上传对话时勾选“允许用于研究”,系统自动将对话哈希值同步至LMSYS联盟数据库。
2、Arena后台按预设规则筛选满足长度≥5轮、含明确指令与响应差异的对话,标记为“可比对样本集”。
3、当两名志愿者在Arena中对同一ShareGPT来源对话进行盲评时,系统锁定该对话ID并禁用其他来源的交叉干扰。
二、用户身份的双向映射机制
ShareGPT注册用户可通过绑定LMSYS账号实现评测行为溯源,这种设计使个体贡献可被量化追踪。平台不显示用户名,但通过加密设备指纹与会话令牌建立隐式关联,确保单个用户在两个平台的活跃度形成统计闭环。
1、在ShareGPT设置页点击“关联评测平台”,跳转至LMSYS OAuth授权页。
2、授权后,用户在ShareGPT发布的每条对话末尾自动生成Arena评测入口二维码。
3、其他用户扫码进入Arena时,系统自动加载该对话历史,并将本轮投票结果反向写入原ShareGPT对话元数据字段。
三、模型能力标签的协同标注体系
ShareGPT对话卡片底部的“推理强度:高”“事实一致性:中”等标签,并非人工标注,而是调用Arena累计胜率数据生成的衍生指标。每个标签对应Arena中该模型在对应能力维度的Top-3胜出频次加权值。
1、Arena每日聚合各模型在“数学推导”“代码生成”等12类任务中的胜率变化曲线。
2、ShareGPT后台服务定时拉取API接口,将模型ID与最新胜率矩阵匹配。
3、当用户浏览某条GPT-4对话时,前端JS脚本实时查询gpt-4-turbo在“多步推理”维度的72小时胜率(当前值83.6%),并映射为“推理强度:高”标签。
四、对抗性测试反馈的闭环回传
当Arena检测到某模型在特定对话中连续3次被判定为“回避回答”,该对话ID将触发紧急回传协议,强制ShareGPT对该对话添加“需人工复核”水印,并暂停其在热门流中的推荐权重。
1、Arena后台识别异常投票模式后,生成包含对话哈希、时间戳、仲裁者ID的XML报告。
2、ShareGPT接收报告并校验数字签名,确认来源合法性。
3、系统自动将该对话置顶栏文字更改为“此对话触发模型可靠性审查,当前展示为存档版本”,同时冻结点赞与转发功能。


















