标签

PyTorch

用 Helion 与 Hugging Face Kernels 构建、调优并分发高性能 GPU Kernel

来源: pytorch.org 19
Hugging Face Kernels 项目加入 Helion 支持后,GPU Kernel 的开发链路变得更完整:开发者可以用更接近 Python 和 PyTorch 的方式描述计算,通过自动调优寻找适合当前硬件与输入形状的配置,再借助 Hugging Face Kernels 进行打包和分发。重点不只是“写出一个能运行的 Kernel”,而是让它...

从 PyTorch 模型到云原生部署:解读 PyTorch Conference China 2026 的开放 AI 技术栈

来源: pytorch.org 26
PyTorch Conference China 2026 于 9 月 8 日至 9 日在上海举行,并与 KubeCon + CloudNativeCon、OpenInfra Summit 同期举办;此前一天还有由赞助商组织的联合活动。这样的会议组合释放了一个清晰信号:AI 工程已经不再局限于模型训练,团队需要把框架、推理服务、容器、调度和基础设施作为...

PyTorch 中国大会释放信号:开放 AI 技术栈正在走向协同共建

来源: pytorch.org 38
在上海举行的 PyTorch Conference China 聚集了阿里云、蚂蚁集团、寒武纪和华为等中国 AI 产业参与者。更值得关注的是,阿里云和寒武纪加入 PyTorch Foundation,成为白金会员,蚂蚁集团也加入基金会。这一变化说明,AI 基础设施的竞争正在从单一模型或单一芯片,扩展到框架、编译器、硬件适配、云服务和开发者生态的整体协作...

寒武纪加入 PyTorch 基金会白金会员:AI 芯片厂商如何更深度参与开源生态

来源: pytorch.org 44
PyTorch 基金会宣布,寒武纪(Cambricon)加入该基金会,成为白金会员。PyTorch 基金会是 Linux 基金会旗下、以社区驱动的开源 AI 枢纽;寒武纪成立于 2016 年,此次加入意味着 AI 芯片厂商与 PyTorch 开源社区之间的协作关系进一步受到关注。 对于开发者而言,会员身份本身并不会自动改变某个 PyTorch API ...

从会用模型到共建系统:班加罗尔 PyTorch 与 Hugging Face 技术社区的实践信号

来源: pytorch.org 39
在班加罗尔举行的一场技术活动中,超过 170 名学生、工程师、研究人员和开源贡献者聚到一起,围绕 PyTorch、大规模推理与强化学习展开交流。活动由 Red Hat 和 Hugging Face 主办。比参会规模更值得注意的是主题的变化:机器学习社区关注的不再只是“如何调用一个模型”,而是如何理解运行时、控制推理成本、评估系统行为,并把改进反馈给开源...

从芯片到集群:PyTorch Conference North America 2026 硬件加速参会指南

来源: pytorch.org 45
PyTorch Conference North America 2026 将于 10 月 20 至 21 日在圣何塞举行。从已公布的主题看,硬件加速与计算基础设施会是重要主线:如何让 PyTorch 在日益多样的芯片上运行得更快,同时保持可移植、可观测和可靠。对工程团队而言,这不只是选择一块更快的加速卡,还涉及编译、算子覆盖、分布式通信、环境复现和成...

Google Cloud 的智能体时代底座:从 AI 全栈协同到动态基础设施与数字主权

来源: cloud.google.com 23
Google 表示,Gartner 已连续第九年将其列入战略云平台服务魔力象限的领导者,并在“愿景完整性”维度上处于最远位置。比排名更值得工程团队关注的,是 Google Cloud 对下一阶段云基础设施的判断:企业需要把模型、智能体、应用、数据和算力放进同一个可调度、可治理的平台,同时控制性能、成本与合规边界。 这套思路可以归纳为三个设计原则:软硬件...

PyTorch 2.14:NVGEMM 将 CuTeDSL 与 CUTLASS 内核带入 Inductor

来源: pytorch.org 26
PyTorch 2.14 的重点变化之一,是 NVGEMM 将由 CuTeDSL 生成的 CUTLASS 内核接入 Inductor,并支持 epilogue fusion(尾部算子融合)。这项改动面向的是编译器和 GPU 内核执行路径:模型中的矩阵乘法不再只是单独完成,后续的缩放、偏置或激活等操作也有机会融合进同一个 GPU 内核,从而减少中间张量写...