“冗余后缀”指按业务规则需删除的重复或多余后缀,并非语法概念;例如末尾连续重复子串(如"data.json.json.json"→"data.json"),需先明确定义规则再实现,C++标准库无现成函数。

什么是“冗余后缀”?先明确你要删的到底是什么
很多同学一看到“删除冗余后缀”,下意识就去搜 std::string::rfind 或写循环从末尾匹配,结果删错了——因为“冗余”不是语法概念,而是业务定义。比如:
- 你指重复出现的相同后缀,如
"hello.txt.txt"→ 删成"hello.txt" - 还是说某个固定后缀(如
".tmp")只应保留一个,多出来的全干掉? - 又或者,是像
"a.b.c.c.c"这种点分段中末尾连续重复的段?
C++ 标准库没有现成函数做这类“语义化后缀去重”,必须自己界定规则再实现。
删连续重复后缀:用 rfind + substr 循环截取
适用场景:字符串末尾有连续、完全相同的子串,你想只留一个。例如 "data.json.json.json" → "data.json"。
关键思路是:不断检查末尾是否包含自身前缀,且该前缀长度能整除剩余长度。
立即学习“C++免费学习笔记(深入)”;
实操建议:
- 先获取原始字符串长度
len,设suffix_len = len / 2为最大可能后缀长度(至少得有两个重复才叫冗余) - 从大到小遍历可能的后缀长度
i,用s.rfind(s.substr(len - i), 0) == len - i判断是否以该子串结尾且该子串在开头也存在(不严谨,仅适用于“前后一致”的简单情况) - 更稳妥的做法是:提取末尾候选后缀
cand = s.substr(len - i),然后反复erase直到末尾不再匹配cand
std::string remove_repeated_suffix(std::string s) {
size_t len = s.length();
if (len == 0) return s;
for (size_t i = 1; i <= len / 2; ++i) {
std::string cand = s.substr(len - i);
size_t pos = s.rfind(cand);
while (pos != std::string::npos && pos == s.length() - cand.length()) {
s.erase(pos);
pos = s.rfind(cand);
}
}
return s;
}⚠️ 注意:rfind 返回的是最后一次出现位置,但你要确认它是不是真在“末尾”——所以得额外判断 pos == s.length() - cand.length(),否则会误删中间内容。
删固定后缀多次出现:用 while + ends_with(C++20)或手动比对
适用场景:你知道冗余的是某个特定后缀,比如日志文件名里多个 ".log",如 "app.log.log.log" → "app.log"。
如果你用 C++20,直接上 std::string::ends_with 最清晰:
void remove_multiple_suffix(std::string& s, const std::string& suffix) {
while (s.length() >= suffix.length() && s.ends_with(suffix)) {
s.erase(s.length() - suffix.length());
}
}如果是 C++17 或更早,得手写末尾比对:
bool ends_with(const std::string& s, const std::string& suffix) {
return s.length() >= suffix.length() &&
s.compare(s.length() - suffix.length(), suffix.length(), suffix) == 0;
}常见坑:
- 忘记检查长度,
s.length() 时调 <code>substr或compare会抛std::out_of_range - 用
find替代rfind或ends_with,导致删了开头或中间的匹配 - 修改字符串过程中没更新长度判断,造成越界或死循环
性能与边界:短字符串别过度优化,长文本注意 erase 的开销
std::string::erase 在末尾删除是 O(1) 均摊,但若反复调用(比如几千次),每次都要移动内部指针、检查容量,实际开销不小。
更高效的做法是:一次扫描确定最终长度,最后只做一次 resize:
std::string remove_trailing_duplicates(const std::string& s, const std::string& suffix) {
size_t end = s.length();
while (end >= suffix.length() &&
s.compare(end - suffix.length(), suffix.length(), suffix) == 0) {
end -= suffix.length();
}
return s.substr(0, end);
}这个版本不改原串,避免多次内存操作;返回新串也更符合函数式习惯。不过要注意:如果 suffix 是空串,compare 会出错——务必提前校验输入。
真正难的不是写代码,是和产品/日志规范对齐:那个“冗余”,到底是按字面重复算,还是按语义(比如忽略大小写、忽略点号前后空格)算。这些逻辑一旦定错,删掉的可能就是有效数据。


















