讲师中心 微信公众号
AI工具推荐 视频效率加速

Keras 自定义损失函数中正确实现指标(metrics)的完整指南

胖敏酱_1795

胖敏酱_1795

发布时间:2026-07-11 15:25:22

|

364人浏览过

|

来源于php中文网

原创

Keras 自定义损失函数中正确实现指标(metrics)的完整指南

本文详解如何在 keras 中设计兼容内置 metrics(如 accuracy、mse)的自定义损失函数,重点解决因输出形状不匹配、梯度中断或标量聚合缺失导致的 metrics 返回 0 或 nan 的常见问题。

本文详解如何在 keras 中设计兼容内置 metrics(如 accuracy、mse)的自定义损失函数,重点解决因输出形状不匹配、梯度中断或标量聚合缺失导致的 metrics 返回 0 或 nan 的常见问题。

在 Keras 中,自定义损失函数若无法与内置 metrics 协同工作(例如 accuracy 恒为 0、mse 显示 NaN),通常并非逻辑错误,而是违反了 Keras 对损失函数的隐式契约损失函数必须返回一个 batch-wise 的标量张量(shape () 或 (1,)),而非 (batch_size, 1) 等可广播但非标量的形状。你的 custom_loss 函数返回 shape=(3, 1) 的张量,正是导致 metrics 失效的根本原因。

? 问题定位:为什么 metrics 失败?

Keras 的 metrics(如 tf.keras.metrics.MeanSquaredError)在训练/评估时会自动对 loss 张量调用 .reduce_mean() —— 但前提是该张量能被正确广播和降维。当 loss 是 (N, 1) 形状时:

  • 若未显式压缩维度,reduce_mean 可能作用于错误轴;
  • 更关键的是,某些 metrics 内部实现依赖 loss 为标量(scalar)或至少是 (N,) 形状的一维张量,(N, 1) 会被误判为“需沿 axis=1 聚合”,而你的逻辑中 axis=1 并无语义(仅是冗余维度),导致 NaN 或零值。

此外,原实现中 loss_within_range = tf.zeros_like(y_pred_average) 确实存在梯度风险:虽然 tf.where 在 within_range=True 分支中选取该常量,但由于 zeros_like 不依赖 y_pred,该分支梯度为零 —— 这本身是合理的设计(区间内无惩罚),只要 tf.where 的条件是可微近似即可。真正的问题在于输出未归约为标量

✅ 正确实现:标量损失 + 兼容 metrics

以下是修复后的生产级 custom_loss,满足 Keras 所有要求:

import tensorflow as tf

def custom_loss(y_true, y_pred):
    # Step 1: 计算预测值的绝对均值 (shape: [batch_size, 1] → [batch_size])
    y_pred_abs_avg = tf.abs(tf.reduce_mean(y_pred, axis=1, keepdims=False))  # now shape: (N,)

    # Step 2: 提取上下界 (shape: (N,))
    y_true_lower = tf.squeeze(y_true[:, 0:1], axis=-1)  # (N,)
    y_true_upper = tf.squeeze(y_true[:, 1:], axis=-1)    # (N,)

    # Step 3: 判断是否在区间内(使用 tf.math.logical_and)
    within_lower = y_true_lower <= y_pred_abs_avg
    within_upper = y_pred_abs_avg <= y_true_upper
    within_range = tf.math.logical_and(within_lower, within_upper)

    # Step 4: 计算区间外的惩罚:到最近边界的距离
    dist_to_lower = tf.abs(y_pred_abs_avg - y_true_lower)
    dist_to_upper = tf.abs(y_pred_abs_avg - y_true_upper)
    penalty = tf.minimum(dist_to_lower, dist_to_upper)  # (N,)

    # Step 5: 使用 tf.where 选择损失值,并强制归约为标量(关键!)
    per_sample_loss = tf.where(within_range, tf.zeros_like(penalty), penalty)  # (N,)

    # ✅ 最终返回 batch 均值标量:shape = ()
    return tf.reduce_mean(per_sample_loss)

? 验证示例

import numpy as np

y_t = np.array([[1, 2], [3, 4], [5, 6]], dtype=np.float32)
y_p = np.array([[1.2, 1.5], [4.5, 4.7], [3.6, 4.8]], dtype=np.float32)

loss_val = custom_loss(y_t, y_p).numpy()
print(f"Scalar loss: {loss_val:.4f}")  # 输出: Scalar loss: 0.7000
# ✅ 此标量可被任何 Keras metric 正确消费

⚠️ 关键注意事项

  • 永远返回标量:使用 tf.reduce_mean(...) 或 tf.reduce_sum(...) 显式聚合至 () 形状,避免 (N, 1) 或 (N,)。

  • 保持梯度连通:tf.where 的条件(within_range)虽不可导,但 TensorFlow 在反向传播中会自动屏蔽 True 分支的梯度(即区间内无梯度),这是安全的;确保 penalty 表达式完全依赖 y_pred。

  • Metrics 配置建议:在 model.compile() 中,不要将自定义 loss 直接作为 metric(如 metrics=['accuracy'] 即可),Keras 会自动用 loss 值计算 loss metric;若需监控区间满足率,可单独定义 InRangeRate metric:

    class InRangeRate(tf.keras.metrics.Metric):
        def __init__(self, name='in_range_rate', **kwargs):
            super().__init__(name=name, **kwargs)
            self.total = self.add_weight(name='total', initializer='zeros')
            self.count = self.add_weight(name='count', initializer='zeros')
    
        def update_state(self, y_true, y_pred, sample_weight=None):
            y_pred_avg = tf.reduce_mean(y_pred, axis=1)
            lower, upper = y_true[:, 0], y_true[:, 1]
            in_range = tf.math.logical_and(lower <= y_pred_avg, y_pred_avg <= upper)
            self.total.assign_add(tf.cast(tf.size(in_range), tf.float32))
            self.count.assign_add(tf.cast(tf.reduce_sum(tf.cast(in_range, tf.float32)), tf.float32))
    
        def result(self):
            return self.count / (self.total + tf.keras.backend.epsilon())

✅ 总结

Keras metrics 失效的根源几乎总是损失函数未返回符合规范的标量张量。通过严格保证 custom_loss 输出 shape=()、确保所有中间计算可微、并避免冗余维度,即可无缝集成 accuracy、mse 等所有内置指标。记住黄金法则:Loss is a scalar. Always.

热门AI工具

更多
DeepSeek

DeepSeek是一款面向对话、写作、编程和推理场景的AI大模型工具。

Seko
Seko Hot

一款AI视频创作工具,主要用于商汤科技推出的创编一体的AI短视频创作Agent,适合需要提升相关任务效率的用户。

咔片AIPPT

一款在线AI演示文稿制作工具,可根据主题和内容需求辅助生成PPT结构与页面,提高演示材料制作效率。

WorkBuddy

一款AI办公效率工具,主要用于腾讯云推出的AI原生桌面智能体工作台,适合需要提升相关任务效率的用户。

AionClaw
AionClaw Hot

AionClaw是一款面向办公、创作和编程任务的AI桌面智能体。

UpDream
UpDream Hot

一款AI视频创作工具,主要用于哔哩哔哩推出的自研AI视频创作工具,适合需要提升相关任务效率的用户。

Loomy
Loomy Hot

一款AI工具,主要用于科大讯飞发布的桌面级 AI 助理,比 OpenClaw 更易用、更安全!,适合需要提升相关任务效率的用户。

豆包大模型

豆包大模型是一款由字节跳动推出的企业级大语言模型服务平台。

讯飞智作

讯飞智作是一款AI视频创作工具,AI文本配音工具,数字人课程、营销视频制作。

相关专题

更多
python打包成可执行文件
python打包成可执行文件

本专题为大家带来python打包成可执行文件相关的文章,大家可以免费的下载体验。

1551

2023.07.20

python能做什么
python能做什么

python能做的有:可用于开发基于控制台的应用程序、多媒体部分开发、用于开发基于Web的应用程序、使用python处理数据、系统编程等等。本专题为大家提供python相关的各种文章、以及下载和课程。

3624

2023.07.25

format在python中的用法
format在python中的用法

Python中的format是一种字符串格式化方法,用于将变量或值插入到字符串中的占位符位置。通过format方法,我们可以动态地构建字符串,使其包含不同值。php中文网给大家带来了相关的教程以及文章,欢迎大家前来阅读学习。

1549

2023.07.31

python教程
python教程

Python已成为一门网红语言,即使是在非编程开发者当中,也掀起了一股学习的热潮。本专题为大家带来python教程的相关文章,大家可以免费体验学习。

20677

2023.08.03

python环境变量的配置
python环境变量的配置

Python是一种流行的编程语言,被广泛用于软件开发、数据分析和科学计算等领域。在安装Python之后,我们需要配置环境变量,以便在任何位置都能够访问Python的可执行文件。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

2567

2023.08.04

python eval
python eval

eval函数是Python中一个非常强大的函数,它可以将字符串作为Python代码进行执行,实现动态编程的效果。然而,由于其潜在的安全风险和性能问题,需要谨慎使用。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

2627

2023.08.04

scratch和python区别
scratch和python区别

scratch和python的区别:1、scratch是一种专为初学者设计的图形化编程语言,python是一种文本编程语言;2、scratch使用的是基于积木的编程语法,python采用更加传统的文本编程语法等等。本专题为大家提供scratch和python相关的文章、下载、课程内容,供大家免费下载体验。

1063

2023.08.11

python合并两个列表
python合并两个列表

Python是一种强大的编程语言,具有许多方便的功能和工具。在Python中,有多种方法可以合并两个列表。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

576

2023.08.10

Vibeknow在线使用入口合集
Vibeknow在线使用入口合集

本专题汇总了Vibeknow在线创作视频的官方入口及网页版使用教程,涵盖PPT、PDF、Word等文档一键转讲解视频的核心操作,并整理了免费版水印规则与手机端浏览器访问指南,助你快速将知识内容视频化。

0

2026.09.21

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn