首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >AI Infra 系列 · 第四章 训练与调度(上): 8 张卡 7 张闲?单机调优才是你欠下的第一笔账

AI Infra 系列 · 第四章 训练与调度(上): 8 张卡 7 张闲?单机调优才是你欠下的第一笔账

作者头像
dongdonglog
修改2026-09-01 11:37:34
修改2026-09-01 11:37:34
290
举报
概述
这一篇把镜头拉回一台机器内部:为什么 8 张卡里总有一张利用率上不去?为什么同样的代码,换个机器慢 20%?答案往往不在算法,而在 CPU 怎么给 GPU 喂数据。NUMA、CPU 绑定、内存固定、THP、GPU 持久化、MPS/MIG、容器挂载——七个旋钮,每个都能榨出几个点的吞吐。

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档