谷歌Vids是Google Workspace推出的AI视频工具,支持提示生成视频、智能剪辑、AI配音、图文转视频及图片文字指令编辑五大功能,全程英文操作,无需专业经验。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

谷歌Vids是一款由Google Workspace推出的AI驱动视频创作与编辑工具,专为无需专业设备或剪辑经验的用户设计。它集成Gemini大模型能力,支持从提示生成视频草稿、智能剪辑、AI配音、图文转视频等核心功能。以下是该工具的具体使用方式:
一、创建首个AI生成视频
该方法利用Gemini AI理解文本意图并自动构建视频结构,适用于快速产出宣传、培训或汇报类内容。系统将自动生成分镜建议、脚本初稿、匹配媒体素材及背景音乐。
1、登录 Google Workspace 账户,访问 https://vids.google.com。
2、点击“Help me create”,在输入框中键入英文提示,例如“Explain how photosynthesis works for middle school students”。
3、等待Gemini生成含场景、脚本和推荐素材的初始故事板,确认后点击“Insert into video”。
4、在编辑器中拖入Google Drive或Photos中的补充素材,调整顺序与时长。
二、上传原始视频进行智能精剪
此方式针对已有访谈、讲解或会议录像,通过AI识别冗余口语与静默段落,实现一键净化,提升信息密度与观看节奏。
1、在编辑界面点击“+ Add media”,选择本地视频文件上传。
2、视频导入后,点击右侧边栏“Trim with AI”按钮。
3、系统自动标出所有“um”“uh”等语气词位置及超过1秒的停顿区间,勾选需删除项。
4、点击“Apply edits”,AI将执行非破坏性裁剪,原始片段仍保留在媒体库中。
三、用三张图片生成8秒短视频
基于Veo 3.1模型,该功能可在保持主体一致性前提下,将静态图像序列转化为动态短视频,适合产品展示与品牌快闪内容。
1、在编辑器空白处点击“+ Add media”,选择“Generate from images”。
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
2、上传最多三张JPG或PNG格式图片,确保主体位于画面中央且光照一致。
3、在提示框中输入英文描述,如“A smartphone rotating smoothly on white background, studio lighting”。
4、点击“Generate”,等待约15秒后预览8秒生成片段,确认后插入时间线。
四、替换语音旁白为AI配音
该功能规避真人录音限制,提供七种可调节语速与语调的AI音色,适用于教育、营销等需统一声音形象的场景。
1、选中时间线上含语音轨道的片段,右键选择“Replace audio with AI voice”。
2、在弹出面板中粘贴英文脚本,或从已生成的AI脚本中直接选取段落。
3、从下拉菜单中选择音色,如“Alex (Professional male, calm tone)”。
4、拖动滑块调整语速至0.9x–1.1x范围,点击“Generate voiceover”完成替换。
五、在静态图上执行文字指令编辑
借助多模态理解能力,Vids允许用户对单张图片输入自然语言指令,实时修改视觉元素,无需进入图像编辑软件。
1、将一张JPG/PNG图片拖入时间线,双击进入“Edit image”模式。
2、点击右下角“Enhance with text”,在文本框中输入英文指令,如“Remove glare from eyeglasses”。
3、系统即时渲染修改效果,若不满意可更换指令,如“Make the background pure white”。
4、确认后点击“Apply”,修改结果将作为新图层嵌入当前帧。


















