讲师中心 微信公众号
AI工具推荐 视频效率加速

c# NUMA 架构和 C# 应用的性能调优

千宇姑娘_7588

千宇姑娘_7588

发布时间:2026-01-18 12:19:02

|

548人浏览过

|

来源于php中文网

原创

NUMA架构对C#应用的真实影响是跨节点内存访问导致GC延迟升高2–5倍及线程调度抖动;需通过start /NODE命令绑定进程到单个NUMA节点,配合服务器GC、按节点数设堆数、调优线程池,并用ETL+PerfView验证绑定效果。

c# numa 架构和 c# 应用的性能调优

NUMA 架构对 C# 应用的真实影响在哪?

NUMA(Non-Uniform Memory Access)不是“理论问题”——当你的 C# 应用在 32 核以上服务器、使用大量 ArrayPool<T> 或密集 Span<T> 操作、且内存分配峰值超过 64GB 时,跨 NUMA 节点访问内存会直接导致 GC.Collect() 延迟升高 2–5×,ThreadPool 工作线程调度抖动明显。Windows 默认不绑定进程到特定 NUMA 节点,.NET 运行时也不自动感知拓扑,这意味着你写的高性能服务可能正默默承受非本地内存访问的惩罚。

如何让 .NET 进程绑定到单个 NUMA 节点?

不能靠 Process.PriorityClass 或 Thread.BeginThreadAffinity() 解决——它们不控制 NUMA 亲和性。必须在进程启动前由操作系统层完成绑定:

  • 使用 Windows 自带的 start /NODE 命令启动应用:
    start /NODE 0 /AFFINITY 0x000000FF MyService.exe
    (其中 0x000000FF 是 CPU 掩码,对应节点 0 的前 8 个逻辑核)
  • 在容器中(如 Windows Server Container),通过 --cpuset-cpus + --memory 组合限制,但需确认宿主机启用了 numactl 兼容层(Windows 容器目前不原生支持 numactl,需改用 Hyper-V 隔离 + 手动规划)
  • 避免使用 SetProcessAffinityMask API 直接调用:.NET 6+ 的 Environment.ProcessId 在容器中可能返回不准确 PID,导致设置失败

ThreadPool 和 GC 在 NUMA 场景下的关键配置

.NET 默认的线程池和 GC 行为假设内存访问代价均等,这在 NUMA 下失效:

Accessory Bundles
Accessory Bundles

为多SKU配件店铺(如全系列手机壳、表带)设计交叉销售和捆绑结构。当用户提及捆绑销售时使用。

下载
  • 启用 ThreadPool.UseLegacyExecutionContextFlow(false)无意义——它只影响 ExecutionContext 流转,不改变线程物理位置
  • 必须设置环境变量 DOTNET_gcServer=1(启用服务器 GC),否则工作站 GC 会在每个线程栈分配本地内存,加剧跨节点指针引用
  • 推荐显式设置 DOTNET_gcHeapCount = NUMA 节点数(例如 4),让 GC 为每个节点维护独立堆段,减少跨节点 Gen2 扫描压力
  • ThreadPool.MinThreads 不建议设为核数 × 2——应按 NUMA 节点内逻辑核数设置,比如节点 0 有 12 核,就调用 ThreadPool.SetMinThreads(12, 12)

验证 NUMA 绑定是否生效的三个硬指标

光看任务管理器“CPU 使用率”没用。要确认绑定成功,必须检查:

  • 运行 logman query -ets && logman start "NumaNodeTrace" -ets -o numa.etl -nb 16 16 -bs 1024 -f bincirc -cnf 00:05:00,再用 perfview /accepteula Collect /CircularMB:512 /KernelEvents:Process+Thread+VirtualAlloc+VirtualFree 抓取 30 秒,打开后查看 VirtualAlloc 的 Node 列是否稳定为单一值
  • 在代码中读取 Windows.Win32.System.SystemInformation.GetNumaHighestNodeNumber(P/Invoke),再对比 GetCurrentProcessorNumberEx 返回的 GROUP_AFFINITY 中的 NodeNumber 字段
  • 监控 .NET CLR Memory\% Time in GC 计数器:绑定后若仍长期高于 8%,说明仍有跨节点对象引用(比如共享的 ConcurrentDictionary<string, object> 缓存被多节点线程高频写入)

NUMA 优化不是“开个开关就提速”,而是从进程启动、内存分配模式、线程生命周期全程约束——漏掉任意一环,都可能让其他优化归零。

相关文章

数码产品性能查询
数码产品性能查询

该软件包括了市面上所有手机CPU,手机跑分情况,电脑CPU,电脑产品信息等等,方便需要大家查阅数码产品最新情况,了解产品特性,能够进行对比选择最具性价比的商品。

下载

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

热门AI工具

更多
Seko
Seko Hot

一款AI视频创作工具,主要用于商汤科技推出的创编一体的AI短视频创作Agent,适合需要提升相关任务效率的用户。

LibLibAI
LibLibAI Hot

一款AI视频创作工具,主要用于国内领先的AI创意平台,以海量模型、低门槛操作与“创作-分享-商业化”生态,让小白与专业创作者都能高效实现图文乃至视频创意表达,适合需要提升相关任务效率的用户。

DeepSeek

DeepSeek是一款面向对话、写作、编程和推理场景的AI大模型工具。

AionClaw
AionClaw Hot

AionClaw是一款面向办公、创作和编程任务的AI桌面智能体。

火山引擎

火山引擎是一款面向企业的云计算与AI服务平台。

豆包大模型

豆包大模型是一款由字节跳动推出的企业级大语言模型服务平台。

WorkBuddy

一款AI办公效率工具,主要用于腾讯云推出的AI原生桌面智能体工作台,适合需要提升相关任务效率的用户。

VibeKnow
VibeKnow Hot

一款AI视频创作工具,主要用于全球首个AI知识视频创作平台,文档、文章、网页,一键生成视频,适合需要提升相关任务效率的用户。

Loomy
Loomy Hot

一款AI工具,主要用于科大讯飞发布的桌面级 AI 助理,比 OpenClaw 更易用、更安全!,适合需要提升相关任务效率的用户。

相关专题

更多
string转int
string转int

在编程中,我们经常会遇到需要将字符串(str)转换为整数(int)的情况。这可能是因为我们需要对字符串进行数值计算,或者需要将用户输入的字符串转换为整数进行处理。php中文网给大家带来了相关的教程以及文章,欢迎大家前来学习阅读。

5459

2023.08.02

C++ 智能指针与现代内存管理
C++ 智能指针与现代内存管理

深入讲解 C++ 现代内存管理的核心工具——智能指针,涵盖 unique_ptr 独占所有权语义、shared_ptr 引用计数机制与循环引用问题、weak_ptr 弱引用的应用场景、make_unique/make_shared 工厂函数的性能优势、自定义删除器的编写、RAII 资源管理思想的实践,以及从裸指针迁移到智能指针的重构策略,帮助开发者编写安全无泄漏的现代 C++ 代码。

319

2026.04.23

堆和栈的区别
堆和栈的区别

堆和栈的区别:1、内存分配方式不同;2、大小不同;3、数据访问方式不同;4、数据的生命周期。本专题为大家提供堆和栈的区别的相关的文章、下载、课程内容,供大家免费下载体验。

4907

2023.07.18

堆和栈区别
堆和栈区别

堆(Heap)和栈(Stack)是计算机中两种常见的内存分配机制。它们在内存管理的方式、分配方式以及使用场景上有很大的区别。本文将详细介绍堆和栈的特点、区别以及各自的使用场景。php中文网给大家带来了相关的教程以及文章欢迎大家前来学习阅读。

2208

2023.08.10

堆和栈的区别
堆和栈的区别

堆和栈的区别:1、内存分配方式不同;2、大小不同;3、数据访问方式不同;4、数据的生命周期。本专题为大家提供堆和栈的区别的相关的文章、下载、课程内容,供大家免费下载体验。

4907

2023.07.18

堆和栈区别
堆和栈区别

堆(Heap)和栈(Stack)是计算机中两种常见的内存分配机制。它们在内存管理的方式、分配方式以及使用场景上有很大的区别。本文将详细介绍堆和栈的特点、区别以及各自的使用场景。php中文网给大家带来了相关的教程以及文章欢迎大家前来学习阅读。

2208

2023.08.10

线程和进程的区别
线程和进程的区别

线程和进程的区别:线程是进程的一部分,用于实现并发和并行操作,而线程共享进程的资源,通信更方便快捷,切换开销较小。本专题为大家提供线程和进程区别相关的各种文章、以及下载和课程。

3678

2023.08.10

Java 并发编程高级实践
Java 并发编程高级实践

本专题深入讲解 Java 在高并发开发中的核心技术,涵盖线程模型、Thread 与 Runnable、Lock 与 synchronized、原子类、并发容器、线程池(Executor 框架)、阻塞队列、并发工具类(CountDownLatch、Semaphore)、以及高并发系统设计中的关键策略。通过实战案例帮助学习者全面掌握构建高性能并发应用的工程能力。

523

2025.12.01

LLVM自定义Pass怎么写
LLVM自定义Pass怎么写

本专题聚焦LLVM自定义Pass开发,整理Pass类结构、run()方法、PreservedAnalyses、CMake构建、插件注册、-load-pass-plugin加载和测试用例编写流程。

0

2026.09.30

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
WebSocket手册
WebSocket手册

共0课时 | 0人学习

HTML5/CSS3/JavaScript/ES6入门课程
HTML5/CSS3/JavaScript/ES6入门课程

共102课时 | 10.7万人学习

前端基础到实战(HTML5+CSS3+ES6+NPM)
前端基础到实战(HTML5+CSS3+ES6+NPM)

共162课时 | 28万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn