标签

架构设计

Istio 1.31.0:从 Gateway API 诊断到 Ambient Waypoint 灰度的关键变化

来源: istio.io 25
Istio 1.31.0 的变化集中在几个运维痛点:旧版 Gateway API CRD 不再悄悄影响流量处理,ambient 模式的 XDS 推送范围更精准,waypoint 支持按权重进行金丝雀发布,同时补齐了多集群、CNI、TLS、负载均衡和安全配置中的一批边界问题。升级时,不能只替换控制面镜像,还应同步检查 CRD、节点 nftables、远程...

为 AI Agent 设计数据层:从事务系统到 MCP 与语义模型

来源: infoq.com 48
企业把大语言模型接入业务系统后,真正棘手的问题通常不是“模型会不会回答”,而是“模型能否在安全、准确、可控成本的前提下访问正确的数据”。Fabiane Nardon 分享了 TOTVS 面向企业级 AI Agent 的数据层思路:让确定性的事务逻辑继续由数据库和服务负责,把 LLM 放在理解意图、选择工具和组织结果的位置上。 这套方法的核心,是同时处理...

MAPS:如何在大规模场景下实现多模态内容个性化

来源: netflixtechblog.com 50
流媒体平台给用户展示的并不只是一个标题,而是一整套内容资产:封面、横幅、预告片、字幕、音频、剧照和文案。不同用户看到同一部作品的不同素材,可能直接影响点击、播放和继续观看。 “MAPS: Netflix’s Multimodal Asset Personalization at Scale”这个标题指向一个重要工程问题:如何把多模态资产纳入个性化系统,...

别等流量打爆 GPU:Kubernetes 预测式自动扩缩容实践

来源: cncf.io 30
GPU 工作负载的扩容,往往不是把副本数从 2 调到 10 那么简单。节点启动、GPU 资源调度、镜像拉取和模型加载都需要时间。如果等队列已经堆积、GPU 利用率已经飙高,扩容动作可能已经来不及了。 一次生产事故很能说明问题:服务不是逐渐变慢,而是在流量上升后直接崩溃;大量 Pod 处于 Pending,用户错误率达到 15%~20%。这类事故的关键通...

Netflix 商业架构的演进:从美国 DVD 服务到全球流媒体基础设施

来源: infoq.com 35
Netflix 的商业系统并不是一开始就为全球流媒体和大型直播事件设计的。它经历了从美国 DVD 租赁服务到全球订阅平台的长期演进:支付方式需要适应不同国家,合规要求不断增加,单体系统必须按业务边界拆分,而突发的直播流量又迫使架构重新思考容量与弹性。 这段演进说明了一个现实:能够长期运行的系统,靠的不是一次性设计出“最终架构”,而是持续根据业务、监管和...

从编译器到贡献者基础设施:PyTorch Conference North America 2026 核心议题指南

来源: pytorch.org 36
PyTorch Conference North America 2026 的 Core PyTorch sessions,关注的不是某个单一模型或应用案例,而是支撑整个 PyTorch 生态运行的工程基础:编译器与运行时、分布式通信、设备可移植性、发布工程、CI、可观测性、加速器集成,以及贡献者基础设施。对每天训练和部署模型的开发者来说,这些议题决定...