万兴天幕2.0深度耦合华为云盘古多模态大模型,采用双模驱动策略,在昇腾算力集群上完成定向蒸馏与微调;运镜控制、首尾帧补齐接入盘古能力,音效生成仍由自研WaveLDM 2.1承担;已落地专业运镜设计、立体音效生成、首尾帧智能补齐三类升级。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

万兴天幕已正式接入华为云盘古多模态大模型,不是简单调用API,而是深度耦合基座能力并完成垂类重构。
技术合作的本质是双模驱动下的模型共建
万兴天幕2.0不再依赖单一自研或第三方模型,而是采用“双模驱动”策略:自研模型调用量占比超第三方,同时将华为云盘古多模态大模型作为底层基座进行定向蒸馏与微调。这一步必须在华为云昇腾算力集群上完成,【本地GPU服务器无法复现该训练流程】。
华为云为万兴科技开通专属ModelArts训练空间,所有音视频原子能力(如运镜参数生成、帧间光流对齐、多轨音效分层建模)均在该环境中重新训练验证。
盘古能力不是直接调用,而是被拆解为可插拔组件
方法一:运镜控制模块接入盘古视觉理解子模型。万兴将盘古的时空特征提取能力封装为独立推理节点,嵌入到天幕2.0的镜头语言引擎中,用于解析用户输入的“推拉摇移跟”文本指令,并输出符合电影工业标准的贝塞尔运镜曲线。
方法二:首尾帧智能补齐调用盘古多模态跨模态对齐能力。当用户只提供开头和结尾画面时,系统自动激活盘古的图文-视频联合表征模块,生成中间过渡帧序列——该过程不经过万兴自有扩散模型,完全由盘古基座驱动。
注意:音效生成模块未接入盘古语音模型,仍由万兴自研的WaveLDM 2.1承担,因盘古当前未开放高保真立体声场建模接口。
联合实验室产出已落地三类关键能力升级
第一步:专业级运镜设计能力上线万兴天幕创作广场公测版,支持17种运镜类型+5档强度调节,生成结果通过Cinebench V24视频渲染一致性测试。
第二步:多层次立体音效生成模块完成灰度发布,在万兴喵影v14.2.0中启用,用户可对AI生成的环境音、对白、配乐分别设置空间方位角与衰减系数。
第三步:首尾帧智能补齐功能在Wondershare SelfyzAI移动端实装,处理3秒内短视频时延低于800ms,【需开启华为云账号授权且绑定HMS Core 6.13+】。



















