来源: cncf.io
40
把智能体嵌进产品,只解决了“用户在哪里提问”的问题,并没有解决“智能体依据什么回答”。来源材料提到,一个部署类产品在 Web 应用中上线智能体,并分析了 1,192 次对话。这个场景揭示了一个关键工程事实:当问题涉及产品配置、部署状态和版本差异时,模型的通用知识远远不够,智能体需要在回答前检索产品自己的知识库。 用户不会总按文档标题提问。他们更可能输入...
来源: cncf.io
45
云原生时代的平台工程,最初解决的是 Kubernetes、微服务、GitOps 和分布式架构带来的交付复杂度。随着 AI Agent 进入企业应用,平台面对的对象不再只有容器、数据库和流水线,还包括模型、提示词、工具权限、知识源与运行时策略。平台工程正在从“提供基础设施自助服务”演变为“管理应用、资源和智能体的统一控制面”。 传统内部开发者平台通常围绕...
来源: cncf.io
40
2026 年 7 月 28 日,ArgoCon Japan 将在日本横滨举办一场特别的半日活动,时间为 13:30 至 18:30,并与 KubeCon + CloudNativeCon 同期举行。除了现场接触 Argo 项目维护者,来源标题还把企业实践和 Argo CD 3.5 的演进方向列为重点。对于已经在生产环境使用 GitOps 的团队,这类活...
来源: cncf.io
39
评测大语言模型服务时,最常见的数字是吞吐量:系统每秒处理多少请求,或者每秒生成多少 token。这个指标容易采集,也方便横向比较,但它可能掩盖真正影响用户体验的问题。一个服务即使吞吐量很高,如果大量请求超时、首 token 等待过久,或者在高负载下频繁失败,这些工作对用户并没有实际价值。 因此,生产环境更值得关注的是 goodput(有效吞吐量):在给...
来源: cncf.io
45
2026 年 6 月 18 日至 19 日,KubeCon + CloudNativeCon India 在孟买举行。对 LitmusChaos 而言,这不只是一次常规参会,而是其迄今最重要的活动之一。来源摘要没有展开具体议程和现场成果,但 Flipkart、LitmusChaos 与 KubeCon 同时出现,本身就指向一个值得工程团队关注的趋势:混...
来源: cncf.io
41
托管模型 API 仍然是许多业务的合适选择:接入快、运维负担低,也容易按调用量扩展。自托管并不是要取代它,而是提供另一种部署路径。当团队需要控制模型版本、数据流向、推理配置或基础设施成本时,可以考虑在 Kubernetes 中运行 vLLM,把 GPU 推理服务纳入现有的调度、发布和监控体系。 调用托管 API 时,团队主要管理请求、密钥、配额和业务降...
来源: cncf.io
45
CNCF 技术监督委员会(TOC)已投票接纳 HAMi 成为 CNCF 孵化项目。对 AI 基础设施团队来说,这不仅是一次项目状态升级,也意味着一个长期存在的问题获得了更明确的云原生治理路径:昂贵的 GPU 虽然已经被 Kubernetes 纳管,却仍可能因为分配粒度过大、工作负载需求不均而产生资源碎片。 传统 Kubernetes 调度通常把扩展资源...
来源: cncf.io
52
对应用团队来说,数据库本应像一个已经解决的问题:提交 PostgreSQL、MariaDB 或 Redis 的申请,拿到连接凭据,然后开始开发。但在本地数据中心里,真正困难的往往不是启动数据库进程,而是把部署、备份、升级、权限、监控和容量管理组合成稳定的自助服务。 到了 2026 年,建设本地 DBaaS 的关键问题已经不只是“选哪个数据库平台”,而是...
来源: cncf.io
52
KubeCon + CloudNativeCon Japan 2026 举办前夕,KeycloakCon Japan 将于 7 月 28 日 09:00 至 12:30 在横滨举行。活动标题把两个正在快速交汇的方向放在了一起:云原生身份管理,以及 AI 带来的新型身份与授权问题。来源摘要没有披露具体议程和讲者,因此更值得提前梳理的是:开发团队应该带着哪...
来源: cncf.io
51
在 kagent 的早期架构里,Agent 并没有各自占用一个 Pod、Service 和 ServiceAccount,而是直接运行在统一的 kagent runtime 中。这种设计实现快、资源开销小,但随着 Agent 的权限、资源需求和生命周期逐渐分化,一个关键问题就浮出水面:Pod 究竟是不是 Agent 合适的部署单元? 答案通常不是简单的...