REGEXP是MySQL中的操作符而非函数,必须写作column_name REGEXP 'pattern',不可加括号;RLIKE为其同义词;需显式使用^和$锚点确保全匹配;不支持d等简写,须展开为[0-9];8.0+才支持REGEXP_REPLACE等函数。

MySQL 里用 REGEXP 做匹配,不是函数,别加括号
很多人一看到“正则”就下意识写成 REGEXP('pattern'),结果报错 FUNCTION REGEXP does not exist。因为 REGEXP 是操作符,不是函数,语法必须是 column_name REGEXP 'pattern'。同理,RLIKE 是它的同义词,二者完全等价,但混用会降低可读性,建议统一用 REGEXP。
常见错误现象:
-
WHERE name REGEXP('John')→ 语法错误 -
SELECT * FROM t WHERE REGEXP(email, '^.+@.+..+$')→ 报错,MySQL 不认这种函数调用形式
正确写法示例:
SELECT * FROM users WHERE email REGEXP '^[a-zA-Z0-9._%+-]+@[a-zA-Z0-9.-]+.[a-zA-Z]{2,}$';锚点 ^ 和 $ 必须显式加上,否则变成子串匹配
不加 ^ 和 $,REGEXP 实际行为和 LIKE '%pattern%' 类似,只做子串存在性判断。比如验证邮箱时漏掉 $,'user@gmail.com.xxx' 也会被误判为合法。
使用场景:
- 校验格式(如手机号、邮箱)→ 必须用
^...$ - 模糊搜索关键词 → 可省略,如
title REGEXP 'error|warning'
性能影响:带 ^ 的模式可能利用前缀索引(如果列上有合适索引),但 $ 对索引无帮助;全表扫描风险仍高,大表慎用。
MySQL 不支持 dw 等简写,得手写字符类
写 'd{3}' 会完全不匹配,甚至在某些版本报错。MySQL(包括 8.0+)至今不支持 Perl 风格的预定义简写,必须展开:
-
d→[0-9] -
w→[a-zA-Z0-9_] -
s→ 显式写[ ]或只用空格(MySQL 默认不匹配换行符)
容易踩的坑:
-
phone REGEXP '^1[0-9]{10}$'看似合理,但实际包含已停用号段;更贴近真实场景应写成'^1[3-9][0-9]{9}$' - 点号
.在正则中是元字符,匹配任意字符;要匹配字面量.(如文件后缀),必须转义为.,而 MySQL 里反斜杠本身要再转义一次,所以最终写'\.txt$'
替换和提取功能只在 MySQL 8.0+ 可用,低版本直接报错
REGEXP_REPLACE、REGEXP_SUBSTR、REGEXP_INSTR 这些函数在 MySQL 5.7 及更早版本不存在。运行会抛出 FUNCTION REGEXP_REPLACE does not exist。
使用前务必确认版本:
SELECT VERSION();
若返回值 < 8.0,只能靠应用层处理,或改用 SUBSTRING_INDEX + LOCATE 等组合模拟简单提取逻辑。
另外注意:REGEXP_REPLACE 中的捕获组引用(如 \1)依赖双反斜杠,单写 会被 MySQL 当作字符串转义,导致引用失效。
真正麻烦的是边界控制和版本兼容性——一个正则在本地 8.0 跑通,上线到生产 5.7 就崩,且错误信息不提示版本问题,只说函数不存在。写之前先查 VERSION(),比调半天更省时间。


















