最直接办法是用 std::regex_replace 配合 "-+" 模式替换为 "-";高频调用时应复用静态 std::regex 对象;禁用正则时可用双指针原地去重,遇连字符只保留首个并跳过后续重复。

用 std::regex_replace 一次性压缩连续连字符
最直接的办法是用正则把两个及以上连续的 - 全部替换成单个 -。C++11 起标准库支持 std::regex,但要注意:Windows 上 MSVC 默认启用 /std:c++17 才能稳定使用,GCC/Clang 一般没问题。
关键点在于正则模式:"-+" 表示“一个或多个连字符”,替换为 "-" 即可:
std::string s = "a--b---c----d";
s = std::regex_replace(s, std::regex("-+"), "-"); // 结果:"a-b-c-d"
常见错误是写成 "--+"(试图匹配“两个以上”),其实 "-+" 已覆盖所有重复情况;另外别漏掉 std::regex 构造开销——如果高频调用,建议把 std::regex 对象提取为静态变量复用。
不用正则时的手动遍历方案
当项目禁用 RTTI 或正则(比如嵌入式、竞赛环境),就得手动扫一遍字符串。核心逻辑是:跳过后续重复的 -,只保留第一个。
立即学习“C++免费学习笔记(深入)”;
注意边界处理和原地修改的稳定性:
- 用两个指针:
write指向写入位置,read扫描源字符 - 遇到
-时,先写入一个,然后跳过所有紧邻的- - 非
-字符照常复制
std::string s = "a--b---c";
size_t write = 0;
for (size_t read = 0; read < s.length(); ++read) {
s[write++] = s[read];
if (s[read] == '-') {
while (read + 1 < s.length() && s[read + 1] == '-') {
++read; // 跳过后续连字符
}
}
}
s.resize(write); // 截断尾部多余字符
这个版本无额外内存分配,但必须确保 s 非 const;若输入是 const std::string&,得先拷贝一份再操作。
组合式C++代码评审方案,融合静态分析、AI推理、多轮迭代评审和C++专项检查,适用于PR审查、增量代码审查、全项目评审和代码质量评分,触发词包括review cpp、cpp代码评审、C++review、代码审查。
区分“删除重复连字符”和“去重所有连字符”
容易混淆的是需求描述:“删除所有重复连字符”常被误解为“只剩一个连字符,其余全删”,但实际语义更可能是“把连续多个压缩成一个”。前者是全局去重(整个字符串只留最多一个 -),后者才是常见需求(如 URL 规范化)。
如果真要全局只留一个 -,推荐先找首次出现位置,再用 erase 删除后续所有:
auto first = s.find('-');
if (first != std::string::npos) {
s.erase(first + 1, std::string::npos); // 从第二个开始全删
// 或者更安全:s.erase(std::find(s.begin() + first + 1, s.end(), '-'), s.end());
}
但多数场景下你真正需要的是压缩连续段,不是全局去重——这点务必和产品/文档对齐,否则改完才发现逻辑反了。
性能与跨平台兼容性提醒
std::regex 在 libstdc++(GCC)上曾有严重性能问题(尤其长字符串),libc++(Clang/macOS)和 MSVC 较稳。如果字符串平均长度超几 KB,且调用频繁,优先选手动遍历方案。
另一个坑是 locale:默认 std::regex 受当前 locale 影响,某些 locale 下 - 可能被当作范围运算符。保险起见,显式指定 std::regex_constants::ECMAScript 标志:
std::regex_replace(s, std::regex("-+", std::regex_constants::ECMAScript), "-")
手动方案没这问题,但要注意 std::string::length() 返回 size_t,做减法前必须判断是否为空,否则下溢成极大正数。

















