答案是使用CodeBuddy插件执行医疗数据合规分析:上传PDF报告→确认双模脱敏→选择预设包或自定义规则(禁用原始值存档)→自动OCR识别与语义校验→结构化输出+加密签名审计日志。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要在不泄露患者隐私的前提下,从1000份体检报告中提取结构化指标并生成合规审计日志。手动脱敏耗时长、易出错,且无法满足监管对操作留痕的强制要求。
上传原始数据并触发医疗合规分析Skill
打开VS Code → 确保已安装CodeBuddy插件并登录企业账号 → 在侧边栏WorkBuddy面板点击“+新建任务” → 选择“医疗数据合规分析”Skill模板。
将扫描版PDF体检报告文件夹拖入指定区域,系统自动识别为非结构化文本源。这一步操作起来很简单,直接把文件拖进去就行。
上传完成后,CodeBuddy会弹出确认框:“检测到含身份证号、手机号、病历号等PII字段,是否启用GDPR+《个人信息保护法》双模脱敏策略?”→ 点击【是】。
【必须点击“是”,否则后续所有输出均不满足监管审计要求】
配置脱敏规则与审计参数
方法一:使用预设医疗合规包
在弹出的配置面板中,下拉选择“三级医院体检数据合规包(2026版)”,该包已内置:身份证号掩码为前6后4、手机号中间4位替换为*、病历号哈希化处理、时间字段统一转为YYYY-MM格式。
使用 draw.io(.drawio 格式)和 SVG 生成兼容 Microsoft Visio 的架构图。当用户需要以下任一场景时触发: - 用于 Visio 或技术文档的架构/系统/网络图 - 带连接标注的分层控制系统图 - 将 draw.io XML 转换为稳定、可嵌入的 SVG - 修复 Visio 或 draw.io 无法打开的故障排查类图表 - 任何需专业级布局且文本可编辑的图表
方法二:自定义字段级策略
点击“高级配置”→ 在字段列表中勾选“空腹血糖”→ 点击右侧“精度控制”→ 设置保留小数点后1位(避免因过度保留引发再识别风险)→ 对“尿酸”字段启用值域截断(800视为异常值,自动标记为NULL)。
注意:不要勾选“原始值存档”选项——这会导致未脱敏数据残留在本地缓存,违反《医疗卫生机构网络安全管理办法》第22条。
执行结构化提取与审计日志生成
第一步:点击“开始分析”按钮,CodeBuddy调用OCR引擎解析PDF,同时启动语义校验模块识别误识别项(如将“甘油三酯”误读为“甘油三脂”)。
第二步:自动比对脱敏后字段与《WS/T 595-2026 健康体检数据元规范》标准编码表,对不匹配项(如“总胆固醇”未映射为CV04.50.003)生成修正建议。
第三步:完成提取后,系统在项目根目录生成两个不可分割的输出物:① structured_output.xlsx(仅含脱敏后结构化指标);② audit_log_20260806_1447.json(含每条记录的脱敏操作指纹、模型输入token哈希、执行时间戳、操作员ID)。
这个JSON日志文件由模型服务网关实时加密签名,任何篡改都会导致校验失败——这是通过等保三级认证的硬性要求,不可跳过或替换。

















