讲师中心 微信公众号
AI工具推荐 视频效率加速

谷歌AI模型Veo - 3可伪造手术视频,超93%错误源于医学逻辑缺陷

轻杰姑娘_1423

轻杰姑娘_1423

发布时间:2025-12-22 09:45:14

|

411人浏览过

|

来源于php中文网

原创

研究人员对谷歌最新视频生成人工智能模型veo-3进行了测试,使用真实手术录像作为评估素材。结果显示,该模型虽能生成高度逼真的视觉内容,但在医学操作流程的理解上存在根本性缺失。

研究中,研究人员仅输入单张手术图像,要求Veo-3预测此后8秒内的手术进展。为系统评估其性能,一个国际研究团队构建了名为SurgVeo的专用评测基准,涵盖50段真实的腹腔与脑部手术视频。评估由四位经验丰富的外科医生独立完成,从视觉真实性、器械使用合理性、组织反馈表现、操作医学逻辑性四个维度对AI生成视频进行打分(满分5分)。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

SurgVeo评估结果对比图

Veo-3生成的视频初看极具迷惑性,部分外科医生评价其画质“令人震惊地清晰”。然而深入分析后,其内容逻辑漏洞频出。在腹腔手术测试中,模型在第1秒的视觉合理性能达3.72分,但医学准确性相关指标则显著下滑:

  • 器械操作:仅1.78分
  • 组织反应:仅1.64分
  • 最核心的手术逻辑性:低至1.61分

这表明,该模型虽可复现高保真影像表征,却无法还原真实手术室中必需的操作顺序、解剖约束与因果关联。

在神经外科这类对精度要求极高的场景中,Veo-3表现更为逊色。自第1秒起,即难以模拟神经外科所需的微米级操作精度。

  • 器械使用得分降至2.77分(腹腔手术为3.36分)
  • 8秒后的手术逻辑性评分更是跌至1.13分

研究团队进一步归类错误类型发现:超93%的错误源于医学逻辑层面。例如——凭空“创造”现实中不存在的手术器械、虚构违背生理规律的组织形变、执行临床毫无依据的操作步骤。而与图像质量相关的错误占比极低:腹腔手术仅6.2%,脑部手术更仅有2.8%。

Git Changelog Generator
Git Changelog Generator

使用约定式提交(Conventional Commits)从 Git 历史记录中生成结构化变更日志,支持多种格式、AI 增强型描述以及可自定义的范围……

下载

研究人员尝试向模型注入更多上下文信息,如手术类型、当前操作阶段等,但效果未见显著或稳定提升。团队指出,问题症结并非输入信息不足,而是模型本身缺乏对医学知识的内在理解与因果推理能力。

医学逻辑错误示例图

SurgVeo研究清晰揭示:当前视频生成AI距真正具备医学理解能力仍有巨大鸿沟。尽管未来此类系统有望应用于医生培训、术前模拟乃至术中辅助,但现有模型远未达到临床安全应用的基本门槛。它们擅长制造“以假乱真”的视听幻象,却严重欠缺支撑正确临床判断的知识根基。

研究团队计划将SurgVeo基准数据集开源至GitHub,以推动全球学界协同提升AI在医学领域的认知与推理能力。该研究亦发出明确警示:将此类AI生成视频直接用于医学教育存在重大风险。不同于英伟达利用AI视频训练通用任务机器人,在医疗场景中,这种“幻觉”可能引发严重后果——若Veo-3类系统输出看似合理、实则违反医学规范的操作视频,或将误导手术机器人执行错误路径,或导致医学生习得危险技术。

此外,结果还显示:当前将视频生成模型视作“世界模型”的设想仍明显超前。现有系统仅能捕捉表观运动模式与形态变化,尚无法可靠建模解剖结构、生物力学响应及手术中的因果链条。其输出虽具表面说服力,实则无法映射手术背后真实的生理机制与操作逻辑。

相关文章

谷歌浏览器
谷歌浏览器

谷歌浏览器Google Chrome是一款可让您更快速、轻松且安全地使用网络的浏览器。Google Chrome的设计超级简洁,使用起来得心应手。这里提供了谷歌浏览器纯净安装包,有需要的小伙伴快来保存下载体验吧!

下载

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

热门AI工具

更多
SkildArt
SkildArt Hot

SkildArt是一款AI文本写作工具,一站式 AI 视觉创作平台。

UP简历
UP简历 Hot

一款AI办公效率工具,主要用于基于AI技术的免费在线简历制作工具,适合需要提升相关任务效率的用户。

PixTV
PixTV Hot

PixTV是一款面向AIGC内容创作的AI视频生成工具。

WorkBuddy

一款AI办公效率工具,主要用于腾讯云推出的AI原生桌面智能体工作台,适合需要提升相关任务效率的用户。

Lovart
Lovart Hot

一款面向视觉设计创作的AI设计平台,可通过智能体和画布工作流辅助制作海报、Logo、网页、PPT及其他视觉内容。

AionClaw
AionClaw Hot

AionClaw是一款面向办公、创作和编程任务的AI桌面智能体。

豆包大模型

豆包大模型是一款由字节跳动推出的企业级大语言模型服务平台。

切问学术

切问学术是一款AI论文写作工具,复旦大学NLP团队推出的AI学术智能体。

DeepSeek

DeepSeek是一款面向对话、写作、编程和推理场景的AI大模型工具。

相关专题

更多
Veo 3入门教程指南
Veo 3入门教程指南

Veo 3入门教程指南专题提供Veo 3安装使用、功能介绍、操作指南、视频生成流程、入门教学等内容,帮助用户快速掌握Google Veo 3视频生成模型。

104

2026.06.04

Veo 3实战教程大全
Veo 3实战教程大全

Veo 3实战教程大全汇总优质AI视频作品、商业应用案例、自媒体创作案例及实战经验分享,展示Veo 3的实际应用效果。

171

2026.06.04

LLVM自定义Pass怎么写
LLVM自定义Pass怎么写

本专题聚焦LLVM自定义Pass开发,整理Pass类结构、run()方法、PreservedAnalyses、CMake构建、插件注册、-load-pass-plugin加载和测试用例编写流程。

80

2026.09.30

LLVM RISC-V参数配置教程
LLVM RISC-V参数配置教程

本专题介绍LLVM对RISC-V基础ISA和扩展的支持方式,涵盖RV32、RV64、标准扩展、实验性扩展、厂商扩展、-menable-experimental-extensions和版本差异。

80

2026.09.30

LLVM IR中间表示入门指南
LLVM IR中间表示入门指南

本专题整理LLVM IR的核心概念,包括中间表示作用、模块结构、函数、基本块、SSA形式、类型系统和常见语法,帮助新手理解LLVM编译流程中的关键层。

80

2026.09.30

PDF转图片方法
PDF转图片方法

需要把 PDF 页面用于上传、预览、分享或图片归档时,PDF 转图片方法专题整理 JPG/PNG 格式选择、逐页导出、清晰度设置、批量下载和结果检查等流程,帮助用户稳定完成 PDF 图片化处理。

40

2026.09.30

PixTV AI视频生成与无限画布创作
PixTV AI视频生成与无限画布创作

PixTV专题整理AI视频与视觉内容创作相关功能使用教程,涵盖AI生图、视频生成、无限画布、多模型创作、素材管理、声音音乐及视频剪辑等功能,帮助用户快速掌握PixTV从创意到成片的完整制作方法。

60

2026.09.29

Buffalo框架数据库开发全教程
Buffalo框架数据库开发全教程

本专题围绕Buffalo框架数据库开发,讲解database.yml多环境配置、soda与fizz迁移生成回滚、模型结构体标签、增删改查与条件查询、一对多与多对多关联、数据校验、回调钩子、事务处理及原生SQL执行能力。

280

2026.09.23

Buffalo框架路由与请求处理实操指南
Buffalo框架路由与请求处理实操指南

本专题讲解Buffalo框架路由与请求处理机制,涵盖路由注册与分组、资源路由、Handler编写规范、Context上下文方法、参数绑定、中间件编写挂载、Session与Cookie读写、Flash消息及错误页面定制方法。

160

2026.09.23

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Veo 3 官方文档
Veo 3 官方文档

共0课时 | 0人学习

vscode手册
vscode手册

共0课时 | 0人学习

Git 教程
Git 教程

共21课时 | 8万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn