必须将邮箱、手机号、中文姓名拆成三个独立提示词分别提交;百小应会因混写而生成无法直接使用的臃肿正则,需严格按三段式结构、锚点包裹及命名组等规范分别构造。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你正在用百小应写正则表达式提示词,但每次生成结果都把邮箱校验、手机号清洗、中英文混输提取全塞进一个表达式里,根本没法直接用在代码里——这不是能力问题,是提示词结构没拆开。
先分清三类任务边界
正则不是万能胶,不能指望一条表达式同时干三件事。百小应会把“待匹配”“格式要求”“例外情况”自动归并,一旦你混着写,它就真给你合成一个臃肿的超级模式。
比如你写:“要匹配邮箱和手机号,还要能提取中文姓名”,它就会返回类似[\u4e00-\u9fa5]+|[\w.-]+@[\w.-]+\.\w+|\d{11}这种连不带锚点、无命名组、无法校验的拼凑体。
【必须把邮箱、手机号、中文姓名拆成三个独立提示词分别提交】——这是百小应当前版本的硬性处理逻辑,不是你提示词写得不够好。
邮箱提示词:按三段式写死结构
第一步:开头固定身份声明,不加任何标点或换行
你是一名前端正则工程师,只输出标准PCRE兼容的正则字符串,不加任何解释、反引号、代码块标记、换行或额外字符
第二步:严格用分号分隔三段,每段内部不换行
待匹配:邮箱;格式要求:支持国际化域名和带引号的合法用户名;例外情况:需覆盖user_name@domain.co.uk、test+filter@gmail.com、a@b.c等正向样例,排除@ gmail.com、user@@domain.com等反向样例
第三步:补上锚点和Unicode支持
最后必须加上^和$包裹,结尾加\u标志(如需匹配中文域名)——百小应不会自动加,漏了就变成子串匹配,一粘贴就出错。
手机号提示词:用索引法替代模糊描述
方法一:针对中国大陆手机号
待匹配:中国大陆手机号;格式要求:11位,以1开头,第二位为3–9,后9位全数字;例外情况:不匹配10086、114、12315等特服号,也不匹配带空格/横线/括号的格式(如138-1234-5678)
方法二:带清理预处理说明
注意:输入字符串可能含全角空格、中文括号、软回车,提示词里必须写明“先用[\s\u200b\u2028\u3000]+替换为单个半角空格,再剥离非数字字符”——百小应看到这句才会生成配套清洗逻辑,而不是只给个\d{11}。
中英文混合字段:用命名捕获组锁定语义
第一步:明确字段用途
比如是用于用户名校验,那就写“待匹配:用户注册时填写的昵称字段”,不是笼统说“中英文混合文本”。
第二步:定义合法字符集与边界
格式要求:允许中文\u4e00-\u9fa5、英文字母a-zA-Z、数字0-9、下划线_,禁止纯数字,首尾不可有空白,长度2–16位
第三步:强制指定匹配方式
必须写“使用re.fullmatch确保整体合规”,否则百小应默认用search,导致“123abc”这种纯数字开头的也通过校验。

















