标签

Netflix

Netflix 式内部 LLM Serving:从模型接入到可靠推理平台

来源: netflixtechblog.com 48
把大语言模型接入公司内部系统,难点通常不在于启动一个推理进程,而在于让它像数据库、消息队列一样成为稳定的基础设施:调用方不必关心模型部署在哪里,平台团队能够控制成本、延迟和权限,业务团队也能持续替换模型而不重写应用。围绕 “In-House LLM Serving at Netflix” 这一主题,可以把内部 LLM Serving 理解为一套完整的平...

大规模服务拓扑怎么建:从遥测数据到可查询的依赖图

来源: netflixtechblog.com 39
当微服务数量从几十个增长到数千个,服务拓扑就不再是一张手工维护的架构图。它需要持续接收遥测数据,识别服务之间的调用关系,聚合海量边记录,并在故障排查时快速回答“谁在调用谁”“影响会扩散到哪里”。 来源仅提供了标题,没有给出具体实现细节。下面不推断原系统使用的组件,而是围绕大规模服务拓扑通常面对的架构问题,给出一套可以这样实践的参考方案。 服务拓扑可以抽...

GenPage:用生成式方法搭建个性化首页的工程想象

来源: netflixtechblog.com 33
Netflix 的首页不是一张静态海报墙,而是由推荐、排序、文案、视觉资产、实验策略和设备约束共同决定的产品界面。仅从“GenPage: Towards End-to-End Generative Homepage Construction at Netflix”这个标题看,GenPage 关注的不是单点推荐模型,而是把“首页构建”推进到端到端生成式流...