Seko解析剧本前需清洗特殊符号:启用空白字符显示定位零宽空格等控制符,用Python脚本或VS Code正则\p{C}批量清除;再将全角括号、顿号、冒号转半角,确保角色名后为半角冒号+空格,删除多余空行,禁用智能引号。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

使用 Seko 工具解析含特殊符号(如全角括号、中文顿号、emoji、不可见 Unicode 控制符)的剧本时,常出现解析中断、角色名错乱或分镜跳过等报错,必须先清洗文本再导入。
识别并定位问题符号
打开剧本文件 → 用 VS Code 或 Notepad++ 打开 → 按 Ctrl+Shift+P 调出命令面板 → 输入「Toggle Render Whitespace」启用空白字符显示 → 观察是否有灰色小点(U+200B 零宽空格)、小方块(U+FFFD 替换符)或异常缩进。
特别注意中文标点混用:比如「(」和「)」配对错误、「、」代替英文逗号用于分隔参数、「——」破折号被误识别为双连字符「--」导致 YAML 解析崩溃。
批量清除不可见控制符
方法一:用 Python 脚本一键过滤(推荐,适合多文件处理)
新建 text_clean.py,粘贴以下代码并运行:import re; with open('script.txt',encoding='utf-8') as f: s=f.read(); s=re.sub(r'[\u200b-\u200f\u202a-\u202e\ufeff\uf900-\ufaff]', '', s); open('cleaned.txt','w',encoding='utf-8').write(s)
这一步会删除零宽空格、LRM/RLM 方向控制符、BOM 头及中日韩兼容区干扰字符,【务必先备份原文件,该操作不可逆】。
方法二:VS Code 内置替换(适合单次快速修复)
Ctrl+H → 勾选「.*」正则模式 → 查找框输入 \p{C} → 替换框留空 → 全部替换。此正则匹配所有 Unicode 控制类字符(Category=C),比手动删更彻底。
标准化中文标点与结构符号
第一步:将全角括号「()」→ 半角 (),全角顿号「、」→ 英文逗号 ,,全角冒号「:」→ 半角 :;
第二步:检查 Seko 要求的剧本结构标记——角色名后必须紧跟半角冒号+空格,例如「张三: 你来啦?」,若写成「张三:你来啦?」(无空格)或「张三: 你来啦?」(英文冒号),Seko 会跳过该台词行。
第三步:删除段首段尾空行及连续空行,仅保留单个空行作为场景切换分隔符。Seko 将两个以上连续空行识别为非法段落断裂,直接终止解析流程。
第四步:禁用智能引号。Word 或 Pages 默认开启「直引号转弯引号」,把 "hello" 自动变成 “hello”,而 Seko 只认 ASCII 双引号 "。可在 Word 中:文件 → 选项 → 校对 → 自动更正选项 → 取消勾选「键入时自动套用格式」下的「直引号替换为弯引号」。


















