JavaScript数组去重本身不依赖正则表达式,因去重基于值比较,而正则仅用于字符串匹配;所谓“结合正则”实为先用正则清洗或提取字符串元素,再用Set等方法去重。

JavaScript 数组去重本身不依赖正则表达式,因为去重是基于值的相等性判断(如 ===、引用比较或字符串化),而正则表达式用于**字符串匹配与提取**,二者作用域不同。直接用正则“对数组去重”没有语义基础——正则无法判断两个数组元素是否重复。
什么时候会“结合正则”?
实际开发中,所谓“结合正则”,通常出现在以下两类场景,本质是先用正则预处理字符串元素,再进行去重:
- 清洗字符串内容后再去重:比如数组里存的是带空格、标点或大小写混杂的标签,需统一格式
- 提取关键片段后去重:例如从日志行、URL 或 HTML 片段中抽取出 ID、邮箱、域名等结构化子串,再对这些子串去重
常见操作示例
① 清洗后去重(如忽略空格和大小写)
```js
const arr = [' User1 ', 'user2', ' USER1 ', 'user2'];
const cleaned = arr.map(s => s.trim().toLowerCase()); // ['user1','user2','user1','user2']
const unique = [...new Set(cleaned)]; // ['user1', 'user2']
```
立即学习“Java免费学习笔记(深入)”;
② 用正则提取再去重(如从文本中抽邮箱)
在 Java 中初始化和管理阿里云 SDK客户端。包括单例模式、线程安全、endpoint 与 region 配置、VPC 终端节点、同步与异步等。
```js
const texts = [
'Contact: a@b.com or support@test.org',
'Email us at admin@site.cn',
'Also try a@b.com again'
];
// 提取所有邮箱,扁平化,去重
const emailRegex = /[a-zA-Z0-9._%+-]+@[a-zA-Z0-9.-]+\.[a-zA-Z]{2,}/g;
const emails = texts
.map(text => text.match(emailRegex) || [])
.flat()
.filter(Boolean);
const uniqueEmails = [...new Set(emails)]; // ['a@b.com', 'support@test.org', 'admin@site.cn']
```
不推荐的做法(容易出错)
有人尝试把整个数组转成字符串,再用正则找“重复模式”,例如:
```js
// ❌ 错误思路:试图用正则识别数组中的重复项
JSON.stringify([1,2,2,3]).replace(/(\d+),\1/g, '$1'); // 完全不可靠,且不适用于对象、NaN、undefined 等
```
这种写法:
• 仅对简单数字/字符串序列偶然有效
• 无法处理嵌套结构、引号转义、类型差异(如 2 和 "2")
• 逻辑脆弱,维护成本高,不是真正意义上的“数组去重”
总结
正则表达式不是去重工具,而是字符串抽取或标准化的前置步骤。真正去重请坚持用可靠方法:
• [...new Set(arr)](最简、高效、兼容 NaN/null/undefined)
• arr.filter((v, i) => arr.indexOf(v) === i)(需保留原始顺序且兼容旧环境)
• 对象键或 Map 辅助(需自定义比较逻辑,如对象深比较)
正则只在它该出现的地方发力:处理字符串内容本身。

















