VibeKnow支持纯文本一键生成带字幕、语音、画面和音乐的竖屏视频;需先清理口播稿(删括号、符号、空格、省略号),再粘贴至网站并选9:16格式,配置语音与视觉后点击生成,下载MP4即可。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想把写好的口播稿——比如产品介绍话术、短视频脚本或直播开场白——直接变成带字幕、语音、画面节奏和背景音乐的成品视频,VibeKnow支持纯文本输入,无需录音、不调时间轴、不配素材,粘贴即生成。
准备干净可用的口播稿文本
打开记事本或Word,将口播稿内容整理为连续段落,删除所有中文括号(如“(注意)”)、项目符号(•、-)、缩进空格、页眉页脚和连续句号(……)。AI会把“……”识别为停顿异常,导致语音卡顿或字幕断行错乱。
确保每句话独立成行或用句号明确分隔;避免长段堆砌,超过45字的句子建议手动拆成两句。这一步直接影响语音自然度和字幕分屏逻辑。
【粘贴前务必删除所有中文括号、项目符号、缩进空格和连续句号,否则AI可能跳段或语音错乱】。
上传文本并选择竖屏模式
打开Chrome或Edge浏览器,手动输入 https://vibeknow.com → 点击首页中央“Try Now Free” → 用Google或Microsoft账号登录(不支持手机号)→ 登录成功后右上角显示头像,且出现“Upload Document”按钮。
点击“Upload Document” → 选择“Paste Text”选项卡 → 将上一步整理好的口播稿全文粘贴进去。
在右侧设置栏找到“Video Format” → 下拉选择“Vertical 9:16”。这一步操作起来很简单,直接点击即可生效;但若漏掉,系统将默认输出横屏16:9,无法直接发抖音或视频号。
配置语音与视觉效果
方法一:基础配置(推荐新手)
勾选“Auto-add visuals”(自动配图解),让AI根据关键词匹配图标与动态画面;
下拉选择“Chinese voice (female)”(中文女声),语速调至0.9x——太快字幕跟不上,太慢节奏拖沓;
开启“Sync Subtitles”,确保语音与字幕逐句对齐,重点词自动高亮。
方法二:精细控制(适合有明确风格需求)
点击“Voice Settings” → 手动指定音色为“Linlin”(比默认女声更接近真人语感);
关闭“Auto-add visuals”,改选“Manual visual prompts” → 在每段口播稿后加英文括号标注画面提示,例如:“点击立即领取(show hand clicking button)”;
背景音乐保持开启,系统会按语句情绪自动调节音量起伏。
生成并下载成品视频
第一步:确认右侧设置无误 → 点击绿色“Generate Video”按钮。
第二步:等待40~90秒,进度条走完后自动跳转至预览页,视频已含动态字幕、重点词高亮、分段淡入动画和自适应背景音乐。
第三步:在预览页右下角点击“Download MP4”,文件默认为1080×1920分辨率,命名格式为“vibeknow_YYYYMMDD_HHMMSS.mp4”。
【务必用手机本地相册播放一次】:检查画面是否填满屏幕、字幕是否居中不被遮挡、语音与文字是否同步——iOS用户尤其要注意,部分安卓播放器会自动加黑边,不代表视频本身有问题。


















