跳转到文档内容

14 篇文章 文档包含 "GPU"

查看全部标签

KubeCon China 2026 回顾:两场 Keynote、一场闪电演讲,与一项案例大奖

· 阅读需要 7 分钟
HAMi 社区

9 月 7-9 日,KubeCon + CloudNativeCon + OpenInfra Summit + PyTorch Conference China 2026在上海国际会议中心落下帷幕。这是 HAMi晋级 CNCF 孵化项目后首次参加 KubeCon China:社区带来了两场 Keynote、一场闪电演讲、一场专场分享和一个全天值守的展台,外加 Keynote 舞台上揭晓的一项案例大奖。

四场分享的幻灯片均可在 KubeCon China 2026 活动页下载。

HAMi 可组合调度策略:mutex、binpack、spread、numa 如何协同工作

· 阅读需要 10 分钟

HAMi 一直通过 hami.io/gpu-scheduler-policy 注解提供按 Pod 生效的 GPU 调度策略:binpack 尽量把负载堆叠到少数卡上,spread 尽量打散,v2.10.0 新增的 mutex 则要求独占一张卡。但在 v2.10.0 之前,这个注解只能填一个值。

真实集群很少只需要一种行为。一份典型的生产诉求是这样的:推理副本要紧凑装箱,留出整卡空闲;同时每个 Pod 的多卡要落在同一 NUMA 节点上以保证带宽;而时延敏感的那批负载,干脆要独占几张卡。一句话里出现了三种策略。在 v2.10.0 之前,你只能选一个,放弃其余。

v2.10.0 补上了这块拼图:hami.io/gpu-scheduler-policy 现在接受有序的、逗号分隔的列表,过滤型与排序型策略可以组合(#2621@mesutoezdil,关闭 #2010)。本文解释组合是如何求值的,以及如何上手与验证。如果你喜欢动手学习,配套的实验 14:在 GKE 上验证可组合调度策略会在真实集群上逐一复现下文的每个场景。

HAMi 即将亮相 KubeCon China 2026:两场 Keynote、两场技术分享,展台 T-1 等你

· 阅读需要 6 分钟
HAMi 社区

9 月 7-9 日,KubeCon + CloudNativeCon + OpenInfra Summit + PyTorch Conference China 2026将在上海国际会议中心举行。这也是 HAMi 在今年 7 月晋级 CNCF 孵化(Incubating)项目后,首次以孵化项目的身份亮相 KubeCon China。

本届大会上,HAMi 社区将带来两场 Keynote、一场闪电演讲、一场专场技术分享,并在现场设置项目展台(T-1):从 PD 分离的异构推理部署,到 5 分钟讲透 MIG 动态切分,再到千卡规模的 GPU 虚拟化生产实践。欢迎社区的小伙伴到现场交流。

HAMi v2.10.0 发布:Flexible MIG、可组合调度策略与更广阔的加速器生态

· 阅读需要 15 分钟
HAMi 社区

HAMi 社区正式发布 HAMi v2.10.0。本次发布在三个方向上取得进展:更灵活的调度策略、更广泛的异构加速器覆盖,以及更加丰富的调度器生态

v2.10.0 引入了动态 Flexible MIG、全新的 mutex 调度策略、社区期待已久的 NUMA 排序修复可组合调度策略PodGroup(gang-scheduling) 支持,以及更准确的 init 容器 资源计量。在设备侧,新增了 AMD MI300X壁仞支持、让基于模板的 vNPU 与 HAMi-core 节点在同一集群共存的昇腾异构管理能力,以及 vNPU HAMi-core 监控。同时通过全新的 KAI Resource Isolator 伴随项目,首次实现了 KAI Scheduler + HAMi-core 集成。

本文将对 v2.10.0 的主要更新进行详细说明。

HAMi 亮相 KubeCon + CloudNativeCon India 2026:将 GPU 共享带给社区

· 阅读需要 7 分钟
HAMi 社区

2026 年 6 月 18-19 日,KubeCon + CloudNativeCon India 2026 在印度孟买举行,来自云原生生态的实践者、平台工程师、AI 基础设施团队和开源贡献者齐聚一堂。随着 AI 成为本届大会最重要的主题之一,HAMi 展示了 Kubernetes 原生 GPU 共享如何帮助组织提升加速器利用率,同时保持工作负载隔离和运维灵活性。

从开场 Keynote 到展台现场演示,再到与工程团队的技术讨论,本次活动凸显了一个越来越明确的行业关注点:让昂贵的 GPU 基础设施真正适用于多租户 AI 工作负载。

HAMi v2.9.0 发布:昇腾用户态切分、DRA 正式可用与调度生态扩展

· 阅读需要 14 分钟
HAMi 社区

HAMi 社区正式发布 HAMi v2.9.0。这是一个在异构设备虚拟化深度、调度器生态扩展与 Kubernetes 原生标准落地层面具有里程碑意义的版本。

v2.9.0 引入了昇腾 910C HAMi-core 模式、HAMi-DRA 正式可用、项目发布以及 Volcano vGPU 升级至 v0.19 等重磅特性,同时在可观测性、安全性、稳定性等方面进行了系统性增强,共有 19 位新贡献者首次参与。

本文将对 v2.9.0 的主要更新进行详细说明。

HAMi WebUI 正式发布:Kubernetes GPU 监控仪表盘

· 阅读需要 6 分钟
HAMi 社区

在 Kubernetes 中管理 GPU 资源,长期以来存在一个"盲区"。你知道 GPU 在被使用,但要回答"哪个节点还有空闲?"、"这个工作负载是否真的在用分配到的 GPU?"、"集群整体 GPU 利用率趋势如何?"这些问题,往往需要在 kubectl get、Prometheus PromQL 和日志输出之间反复切换。

今天,HAMi 社区正式推出 HAMi WebUI,一款将整个 GPU 集群呈现在单一可视化界面中的开源 GPU 监控仪表盘。

HAMi WebUI v1.1.0 现已作为首个正式主要版本发布,邀请你试用。

与 HAMi 核心调度器配合,WebUI 实现了完整的闭环:从 GPU 调度到可视化可观测性

KubeCon EU 2026 回顾:HAMi 从展台到主论坛 Keynote Demo

· 阅读需要 11 分钟
HAMi 社区

刚刚结束的 KubeCon + CloudNativeCon Europe 2026,释放出一个越来越明确的行业信号:

云原生正在快速从“应用运行平台”演进为 AI 基础设施的运行底座。

在阿姆斯特丹,围绕 Kubernetes、GPU、推理服务、Agentic AI 和异构算力调度的讨论,已经不再停留在概念层面,而是进入到更具体的工程实践、社区协作与基础设施范式演进阶段。

CNCFHAMi 是 CNCF 孵化项目