必须明确叙述主体、观众身份,严格绑定画面与文案,用镜头语言强化动线,否定常见偏差并锁定文案长度及数据来源。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想让百小应生成的图文脚本提示词输出更具体、可直接落地执行,不能只写“做一个介绍产品功能的脚本”,必须把画面节奏、文案语气、镜头逻辑都钉死到细节层。
明确角色与视角
第一步:在提示词开头就定义叙述主体,比如【不是旁白解说,而是产品经理本人出镜口播】;如果用AI数字人,要写清【数字人穿浅灰衬衫、坐办公桌前、手势自然,不微笑不眨眼】——没有这个前提,百小应默认用通用虚拟形象,动作僵硬、表情漂移。
第二步:指定观众身份,例如【面向刚入职两周的销售新人,他们连产品后台入口在哪都不知道】。这直接影响术语密度和举例方式,漏掉这句,脚本里就会冒出“调用API接口”“配置租户权限”这类新人根本听不懂的词。
绑定画面与文案的强对应关系
方法一:用“画面+文案”分段式写法,每段严格对齐3秒内信息量。例如:【画面】手机屏幕特写,手指点击「立即试用」按钮 → 【文案】“点这里,30秒开通测试账号,不用填公司名,也不用等审批。”
方法二:插入镜头语言关键词,如【推镜→聚焦弹窗右下角小字】、【切全景→展示5人围坐讨论的会议室】。百小应识别这些术语后,会自动匹配视觉动线,否则它默认所有画面都是静态中景。
【关键陷阱】避免写“配上相关图片”——百小应无法理解“相关”指什么,会随机抓取图库中带“科技”标签的模糊图,导致文案说“操作步骤第一步”,配图却是服务器机房。
限制生成自由度
① 用否定指令封死常见偏差:“不要出现卡通图标、不要用渐变色背景、不要出现‘点击了解更多’跳转提示”。
② 锁定文案长度:写明【每句口播文案≤12个汉字,最多两行字幕,禁用破折号和省略号】。这能防止百小应生成散文式长句,导致字幕超框或配音语速失控。
③ 指定数据来源:“所有参数引用2026年Q2内部SaaS看板最新值,不得虚构增长率”。没这句话,它可能编出“用户留存率提升217%”这种明显造假数字。

















