Nova AI可在几分钟内将照片、视频和语音备忘录自动生成带动态字幕的Vlog:需上传至少1图+1视频+1语音→输入自然语言指令→可选校准节奏、人物一致性或BGM→导出后长按生成动态图文知识卡。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想用Nova AI在几分钟内把手机里零散的旅行照片、几段随手拍的视频和一段语音备忘录,变成一支节奏紧凑、配乐精准、带动态字幕的完整Vlog,不需要剪辑基础,也不用反复调试参数。
上传原始素材并触发多模态解析
打开鸿蒙版文心App,进入主对话界面→点击右下角“+”图标→选择“上传文件”→一次性勾选你要用的照片(建议3~7张)、短视频(单段≤60秒,总时长建议≤3分钟)和语音备忘录(MP3或M4A格式,时长≤90秒)→点击“确定”后系统自动开始多模态联合解析。
这一步必须上传至少1张图+1段视频+1段语音,否则AI无法启动“任务型Vlog生成”流程;【三类素材缺一不可】,仅传图片会退回至普通图文摘要模式。
用一句话指令激活Vlog任务引擎
在输入框中直接输入一句自然语言需求,例如:“把刚才上传的北海道雪景照、泡温泉视频和我说的‘想吃拉面’语音,做成90秒冬季旅行Vlog,BGM用轻快日系钢琴曲,字幕加在画面底部。”
AI会立刻识别出地理关键词(北海道)、情绪基调(冬季/轻快)、内容焦点(雪景→温泉→拉面)、时长约束(90秒)和输出格式(带字幕的视频)。不需要写“请生成”“谢谢”等礼貌用语,也不用分点罗列要求——它只认主谓宾明确的动宾结构。
手动校准三项关键参数(可选但推荐)
方法一:调整节奏密度
生成预览后,若发现画面切换太快看不清细节,点击右上角“⚙️”→滑动“叙事节奏”条至“舒缓”档位→重新渲染。该操作会自动延长每张图停留时间,并插入0.5秒淡入淡出过渡。
方法二:锁定人物一致性
若上传素材中有人物出镜且姿态差异大(如一张站姿、一张坐姿),在参数页开启“角色锚定”开关→从相册选取一张最清晰的正脸照作为基准图→AI将在所有镜头中统一发色、瞳色与面部轮廓比例。
方法三:替换默认BGM
点击预览视频下方“音乐”标签→在弹出的12首系统推荐曲库中选择→或点击“上传本地音频”导入你自己的背景音乐文件→确认后自动重排音画同步点。
导出并启用动态图文知识卡增强信息密度
点击“导出高清视频”→等待转码完成(通常8~15秒)→保存至相册。
导出完成后,立即在App内打开该视频→长按画面任意位置→选择“生成知识卡”→AI将自动提取视频中出现的地名(如“登别地狱谷”)、温度数据(如“-8℃”)、饮食名词(如“味噌拉面”)并生成可展开的动态图文卡片,点击即显示简要百科与实景对比图。


















