Workerman 4.0.41 高并发压测与调优需严格遵循四步:确认基础状态(进程数、backlog、ulimit、TCP统计)、分场景wrk压测(短连测吞吐、长连测业务)、内核四参数联动调优(somaxconn等)、Worker进程数动态校准,并禁用sleep/PDO/redis->wait等阻塞操作。

Workerman 4.0.41 压测与性能调优实战,需直面高并发下连接超时、QPS骤降、TIME_WAIT堆积、子进程频繁退出等真实问题,不能仅靠改几个参数就宣称“已优化”。
压测前必须确认的三项基础状态
第一步:执行 php start.php status,检查输出中是否包含 【worker process count】 与实际配置一致、【listen backlog】 显示为 65535(非默认 128)、所有子进程状态为 Idle 或 Busy 而非 Unknown。
第二步:运行 ulimit -n,确认返回值 ≥ 65536;若小于该值,立即执行 sudo sh -c "echo '* soft nofile 65536' >> /etc/security/limits.conf && echo '* hard nofile 65536' >> /etc/security/limits.conf" 并重新登录终端生效。
第三步:用 ss -s | grep "TCP:" 查看当前 TCP 连接统计,确保 inuse 数值稳定、orphans 接近 0;若 orphans 持续 >50,说明内核已开始丢包,必须暂停压测先调参。
用 wrk 模拟真实流量压测
方法一:基础短连接压测(验证连接层吞吐)
执行 wrk -t16 -c8000 -d30s http://127.0.0.1:8080/health,其中 -t16 对应 CPU 核数×2,-c8000 是单机可建连接上限的 80%,避免客户端自身瓶颈。此命令不带 keep-alive,专测 SYN 队列与 accept 效率。
方法二:长连接+请求体压测(验证业务层稳定性)
新建 post.lua 文件,内容为:request = function() return wrk.format("POST", "/api/chat", {["Content-Type"] = "application/json"}, '{"msg":"hello"}') end
再执行 wrk -t8 -c1000 -d60s --script=post.lua http://127.0.0.1:8080。这会真实触发 onMessage 回调并序列化 JSON,暴露内存分配与协程调度问题。
注意:wrk 默认启用 HTTP/1.1 keep-alive,但 Workerman 4.0.41 的 HTTP Worker 默认未开启 reusePort,若压测中出现大量 Connection reset by peer,需在启动脚本中显式设置 $http_worker->reusePort = true;。
Linux 内核四参数联动调优
① 打开 /etc/sysctl.conf,追加以下四行(缺一不可):
net.core.somaxconn = 65535<br>net.ipv4.tcp_max_syn_backlog = 65535<br>net.ipv4.tcp_tw_reuse = 1<br>net.core.netdev_max_backlog = 30000
② 执行 sudo sysctl -p 生效,并用 sysctl net.core.somaxconn 逐项验证输出值是否匹配。
③ 修改 Workerman 启动脚本,在 Worker 实例化后、Worker::runAll() 前插入:Worker::$defaultListenBacklog = 65535;
这一步【必须与 somaxconn 值严格一致】,否则内核会静默截断超出部分的连接请求,现象是 ab/wrk 报 apr_socket_connect: Connection refused 且无日志。
④ 若服务器物理内存 ≥ 32GB,额外添加:
net.ipv4.tcp_rmem = 4096 524288 16777216<br>net.ipv4.tcp_wmem = 4096 524288 16777216
此项提升大包传输效率,但小内存机器启用会导致 OOM Killer 杀进程。
Worker 进程数动态校准
第一步:用 ps aux --sort=-%mem | grep 'php.*start\.php' | head -n5 抓取 5 个稳定运行的 Worker 进程,记录其 RSS 列数值(单位 KB),计算平均值(例如:124500 KB ≈ 121.6 MB)。
第二步:套用硬上限公式——假设服务器总内存为 64GB:(64 × 1024) ÷ 121.6 × 0.8 ≈ 426,向下取整得 426。
第三步:在启动脚本中设 $worker->count = 426;,但【首次不要直接设满】,先从 200 开始,每轮压测增加 50,同步监控 vmstat 1 10 中的 cs(上下文切换)值:若 cs > 50000,则说明调度过载,需回调至前一档值。
第四步:观察 php start.php status 输出的各进程 memory 字段,若某进程内存持续上涨且不回收,说明存在协程未释放或全局变量污染,必须停机排查代码。
禁用阻塞操作的三处关键拦截
在 onMessage 回调开头插入:if (function_exists('sleep')) { die('Blocking sleep() detected'); }
这是最粗暴但最有效的阻塞函数拦截,防止开发者误用 sleep()、usleep() 或 file_get_contents() 同步调用。
对 MySQL 操作,强制使用异步连接池:
引入 workerman/mysql 包后,必须通过 $pool->get() 获取连接,禁止直接 new PDO;否则每个请求都会新建 TCP 连接,迅速耗尽文件描述符。
Redis 调用必须走 workerman/redis 异步客户端,且所有 ->get()、->set() 方法后必须接 ->then() 回调链,【禁止使用 ->wait()】,该方法会阻塞当前协程直至完成,使整个 Worker 进程卡死。


















