Spring Boot 5.2 高可用健康检查需真实反映业务级依赖状态,通过配置Actuator端点、启用/禁用内置Indicator、实现自定义HealthIndicator(推荐继承AbstractHealthIndicator),并遵循轻量探测、避免事务与事件、返回结构化诊断信息等原则。

要在 Spring Boot 5.2 中实现高可用服务所需的精准健康检查,必须让 /actuator/health 端点真实反映业务级依赖状态,而非仅停留在数据库连接是否通的层面——否则 Kubernetes 会误判服务可就绪,流量涌入后立即失败。
引入 Actuator 并暴露健康端点
在 pom.xml 中添加 starter-actuator 依赖,这是所有健康检查能力的基础。
打开 application.yml,配置端点暴露策略:management.endpoints.web.exposure.include=health,info;【不写 * 或 all,避免生产环境暴露 beans、env 等敏感端点】
设置详情显示策略为 when-authorized,防止未授权用户获取组件连接串等信息。
启用内置 Indicator 并按需关闭冗余项
Spring Boot 5.2 自动装配 DataSourceHealthIndicator、DiskSpaceHealthIndicator 等——只要 classpath 存在对应依赖(如 spring-boot-starter-data-jdbc),它们就生效。
若项目未使用 MongoDB,却因引入了 spring-boot-starter-data-mongodb 而触发 MongoHealthIndicator,会导致 /health 响应变慢甚至超时;此时应在配置中显式关闭:management.health.mongo.enabled=false。
同理,RabbitMQ、Elasticsearch、Cassandra 等组件的健康指示器均支持 management.health.[component].enabled=false 控制开关。
实现自定义 HealthIndicator(标准方式)
方法一:直接实现 HealthIndicator 接口
创建类并标注 @Component,重写 health() 方法,返回 Health.up() 或 Health.down() 构建对象。
注意:health() 方法必须是同步阻塞调用,且执行时间应控制在 300ms 内;超时会导致 /health 整体响应失败,Kubernetes readiness probe 视为失败。
方法二:继承 AbstractHealthIndicator(推荐)
该抽象类已封装异常捕获与状态构建逻辑,你只需专注 doHealthCheck() 中的实际探测代码。
例如检查 Redis 连通性:注入 LettuceConnectionFactory 后调用 connection.sync().ping(),成功则 result.up(),失败则 result.down() 并附带 error detail。
编写业务级健康检查逻辑
第一步:识别关键依赖链路
不是所有外部服务都需纳入健康检查——只选那些一旦不可用就会导致核心流程中断的组件,如支付网关、订单中心 HTTP client、主库写连接。
第二步:设计轻量探测方式
禁止在 health() 中执行 SELECT * FROM huge_table;改用 SELECT 1 或执行空事务;对 HTTP 依赖,用 HEAD 请求或预设 /health 路径,超时设为 1s。
第三步:注入业务上下文
可通过 @Autowired 注入 Service 或 Client Bean,但【严禁注入 @Transactional 方法或触发事件发布】,否则可能引发事务传播异常或死锁。
第四步:返回结构化诊断信息
使用 withDetail("last-check-time", Instant.now()) 和 withDetail("cached-result", cachedStatus) 提供可追溯线索,运维能快速判断是瞬时抖动还是持续故障。

















