讲师中心 微信公众号
AI工具推荐 视频效率加速

如何基于K近邻计算目标特征(如z值)的平均值

夏杰同学_7985

夏杰同学_7985

发布时间:2026-03-26 10:21:24

|

818人浏览过

|

来源于php中文网

原创

如何基于K近邻计算目标特征(如z值)的平均值

本文详解如何利用scikit-learn的nearestneighbors获取k个最近邻索引,并高效计算每个样本对应邻居的目标维度(如z坐标)的均值,支持任意k值扩展,代码简洁可复用。

本文详解如何利用scikit-learn的nearestneighbors获取k个最近邻索引,并高效计算每个样本对应邻居的目标维度(如z坐标)的均值,支持任意k值扩展,代码简洁可复用。

在空间数据分析、插值建模或局部平滑任务中,常需对每个样本点基于其K个最近邻(KNN)计算某项特征(如高度z、温度、响应值等)的局部平均值。关键在于:KNN返回的是邻居在原始数据集中的索引,而非直接的特征值;因此需通过索引安全提取对应特征并聚合。

以下是一个完整、可扩展的实现方案:

✅ 核心步骤与代码实现

首先,明确数据结构:假设 X 是形状为 (n_samples, n_features) 的二维数组,其中最后一列(索引为 2)代表待平均的 z 值。我们仅用前 n_features−1 列(如 x, y)作距离度量,但需从全量 X 中提取 z。

import numpy as np
from sklearn.neighbors import NearestNeighbors
from statistics import mean  # 更清晰、支持空列表(需注意K≥1)

# 示例数据:每行 = [x, y, z]
X = np.array([
    [6,   -3,  0.1],
    [-5,  -9,  0.5],
    [3,   -7,  0.8],
    [-10,  6,  0.5],
    [-4, -16,  0.9],
    [1, -0.5,  0.0]
])

# Step 1: 构建KNN模型(仅用x,y坐标计算距离)
# 注意:这里使用全部列会将z也纳入距离计算——通常不希望如此
X_coords = X[:, :2]  # 提取前两维作为空间坐标
k = 2
nbrs = NearestNeighbors(n_neighbors=k, metric='euclidean').fit(X_coords)

# Step 2: 获取每个点的K个最近邻索引(含自身?否!默认exclude self)
distances, indices = nbrs.kneighbors(X_coords)
# indices.shape == (n_samples, k) → 每行是该点的k个邻居索引

# Step 3: 提取每个点所有邻居的z值,并计算均值
z_values = X[:, 2]  # 预提取z列,提升效率
neighbor_z_means = [
    mean(z_values[idx_row])  # 直接索引+内置mean,简洁鲁棒
    for idx_row in indices
]

print("每个点的KNN-z均值:", np.round(neighbor_z_means, 3))
# 输出示例: [0.3, 0.65, 0.5, 0.5, 0.45, 0.3]

⚠️ 关键注意事项

  • 坐标与特征分离:务必区分用于距离计算的坐标(X_coords)和用于聚合的目标特征(z_values)。若误将 z 纳入 fit(),会导致距离失真。
  • 是否包含自身:NearestNeighbors 默认返回包括查询点自身的最近邻(即第一个索引常为自身)。若需严格K个其他邻居,应设 n_neighbors = k + 1 并切片 indices[:, 1:]:
    nbrs = NearestNeighbors(n_neighbors=k+1).fit(X_coords)
    _, indices = nbrs.kneighbors(X_coords)
    neighbor_z_means = [mean(z_values[idx_row[1:]]) for idx_row in indices]
  • 性能优化:对大数据集,避免Python循环。可用NumPy向量化:
    # indices: (n, k), z_values: (n,)
    # 将indices展平后索引z_values,再reshape求均值
    z_matrix = z_values[indices]  # shape: (n, k)
    neighbor_z_means = np.mean(z_matrix, axis=1)
  • 边界处理:当 k > n_samples−1 时,kneighbors() 会返回少于 k 个邻居(取决于n_jobs和算法),statistics.mean 可正常处理;若用 np.mean,需确保 indices 行长度一致。

✅ 总结

该方法将KNN检索与特征聚合解耦,逻辑清晰、扩展性强:只需修改 k 值和 z_values 的提取列索引(如 X[:, -1] 或 X[:, 3]),即可适配任意多维输入与任意目标特征。结合向量化操作,可轻松支撑万级样本的实时局部均值计算,是地理加权回归、点云平滑、缺失值插补等任务的基础组件。

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

热门AI工具

更多
Lovart
Lovart Hot

一款面向视觉设计创作的AI设计平台,可通过智能体和画布工作流辅助制作海报、Logo、网页、PPT及其他视觉内容。

PixTV
PixTV Hot

PixTV是一款面向AIGC内容创作的AI视频生成工具。

DeepSeek

DeepSeek是一款面向对话、写作、编程和推理场景的AI大模型工具。

WorkBuddy

一款AI办公效率工具,主要用于腾讯云推出的AI原生桌面智能体工作台,适合需要提升相关任务效率的用户。

Laper
Laper Hot

Laper是专为编剧、导演和制片人推出的 AI 原生剧本创作工具。

切问学术

切问学术是一款AI论文写作工具,复旦大学NLP团队推出的AI学术智能体。

豆包大模型

豆包大模型是一款由字节跳动推出的企业级大语言模型服务平台。

蛙蛙写作

一款AI论文写作工具,主要用于超级AI智能写作助手,适合需要提升相关任务效率的用户。

SkildArt
SkildArt Hot

SkildArt是一款AI文本写作工具,一站式 AI 视觉创作平台。

相关专题

更多
python打包成可执行文件
python打包成可执行文件

本专题为大家带来python打包成可执行文件相关的文章,大家可以免费的下载体验。

1611

2023.07.20

python能做什么
python能做什么

python能做的有:可用于开发基于控制台的应用程序、多媒体部分开发、用于开发基于Web的应用程序、使用python处理数据、系统编程等等。本专题为大家提供python相关的各种文章、以及下载和课程。

3924

2023.07.25

format在python中的用法
format在python中的用法

Python中的format是一种字符串格式化方法,用于将变量或值插入到字符串中的占位符位置。通过format方法,我们可以动态地构建字符串,使其包含不同值。php中文网给大家带来了相关的教程以及文章,欢迎大家前来阅读学习。

1629

2023.07.31

python教程
python教程

Python已成为一门网红语言,即使是在非编程开发者当中,也掀起了一股学习的热潮。本专题为大家带来python教程的相关文章,大家可以免费体验学习。

22597

2023.08.03

python环境变量的配置
python环境变量的配置

Python是一种流行的编程语言,被广泛用于软件开发、数据分析和科学计算等领域。在安装Python之后,我们需要配置环境变量,以便在任何位置都能够访问Python的可执行文件。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

2767

2023.08.04

python eval
python eval

eval函数是Python中一个非常强大的函数,它可以将字符串作为Python代码进行执行,实现动态编程的效果。然而,由于其潜在的安全风险和性能问题,需要谨慎使用。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

2827

2023.08.04

scratch和python区别
scratch和python区别

scratch和python的区别:1、scratch是一种专为初学者设计的图形化编程语言,python是一种文本编程语言;2、scratch使用的是基于积木的编程语法,python采用更加传统的文本编程语法等等。本专题为大家提供scratch和python相关的文章、下载、课程内容,供大家免费下载体验。

1123

2023.08.11

python合并两个列表
python合并两个列表

Python是一种强大的编程语言,具有许多方便的功能和工具。在Python中,有多种方法可以合并两个列表。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

596

2023.08.10

LLVM自定义Pass怎么写
LLVM自定义Pass怎么写

本专题聚焦LLVM自定义Pass开发,整理Pass类结构、run()方法、PreservedAnalyses、CMake构建、插件注册、-load-pass-plugin加载和测试用例编写流程。

0

2026.09.30

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
热门推荐
/
最新课程
关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn