分类

文章

可信智能体 AI 不必重造基础设施:云原生正在成为它的运行底座

来源: infoq.com 42
智能体 AI 带来的变化不只是模型更强,而是软件开始自主调用 API、操作数据并持续执行多步任务。CNCF 发布的技术分析提出了一个务实判断:支撑这类系统的关键能力,不必从零发明;现代分布式应用已经使用的云原生生态,可以继续承担调度、隔离、可观测性、安全策略和故障恢复等职责。 一个生产级智能体通常包含模型推理、工具调用、状态存储、任务队列和外部服务访问...

Kimi K3 的真正门槛:3 万亿级 MoE、百万上下文与开放权重之后

来源: oschina.net 35
月之暗面在 7 月 17 日发布 Kimi K3。按照公布信息,这个模型拥有 2.8 万亿总参数,采用 MoE 架构,在 896 个 expert 中每次激活 16 个,支持 100 万 token 上下文和原生多模态,并计划在 7 月 27 日前开放完整权重。数字足够醒目,但对开发者而言,更重要的问题是:它需要多少基础设施、能否稳定完成真实任务,以及...

从 Flipkart 与 LitmusChaos 的 KubeCon 2026 之行,看混沌工程如何进入日常交付

来源: cncf.io 29
2026 年 6 月 18 日至 19 日,KubeCon + CloudNativeCon India 在孟买举行。对 LitmusChaos 而言,这不只是一次常规参会,而是其迄今最重要的活动之一。来源摘要没有展开具体议程和现场成果,但 Flipkart、LitmusChaos 与 KubeCon 同时出现,本身就指向一个值得工程团队关注的趋势:混...

NocoBase 2.2 Beta:用独立 /v/ 入口承接 V2 前端演进

来源: oschina.net 29
NocoBase 2.2 Beta 的变化不只是一组新功能。多工作区、新移动端、新评论区块,以及 AI 知识库和工作流能力的持续增强,都在补齐 V2 的实际使用体验。对已经运行 V2 的团队而言,更关键的信号是新增的 分支:它将作为面向 V2 的独立前端入口,承接后续功能演进。 这意味着升级评估不能只看功能清单。访问入口、反向代理、缓存策略、监控指标和...

GOAI 世界人工智能开源大赛启动:参赛团队现在该准备什么

来源: my.oschina.net 29
GOAI 世界人工智能开源大赛(Global Open-source AI Challenge)官网已经上线,并正式面向全球开放报名。对准备参赛的开发者而言,报名只是起点:一个真正可评审、可复现的开源 AI 项目,还需要清晰的代码结构、明确的运行方式、可验证的输出和完整的开源边界。 目前可以确认的信息是赛事已经正式上线并开启全球报名。具体赛道、模型限制...

AI 投资别只看调用量:用四项指标建立可执行的 ROI 记分卡

来源: openai.com 41
企业评估 AI 项目时,最容易统计的是模型调用次数、Token 消耗和活跃用户数,但这些数字并不直接等于业务价值。Sarah Friar 提出的 AI 记分卡把注意力拉回四个更接近经营结果的维度:完成了多少有用工作、每个成功任务花费多少、系统是否可靠,以及算力投入带来了多少回报。 这套框架的价值不在于制造一个漂亮的总分,而在于让产品、工程和财务团队使用...

Blueking Lite 本周更新:CMDB 调度优化,加速大规模资产同步

来源: oschina.net 35
当 CMDB 管理的资产数量持续增长,采集任务堆积、同一任务重复执行以及自动关联速度下降,都会逐渐演变成数据延迟和资源浪费。本周 Blueking Lite 围绕 CMDB 的任务调度与大规模数据处理进行优化,重点降低任务堆积和重复执行风险,并提升资产同步及自动关联效率。 CMDB 采集通常连接云平台、虚拟化平台、网络设备或业务系统。一次采集可能包含拉...

AI 编程的 Token 经济学:用 11 条工程原则控制上下文、成本与偏航

来源: cloud.google.com 30
AI 编程助手接管了越来越多的代码输入工作,但工程师并没有因此卸下责任。新的核心任务是管理模型的注意力:让每次调用只读取必要上下文,选择与任务匹配的模型,并在自动化越界前及时止损。 Token 消耗并不只是账单问题。上下文膨胀会增加延迟,稀释关键指令,还可能让模型遗忘约束或产生幻觉。真正有效的优化,不是把提示词压缩到难以理解,而是建立一条短、清晰、可验...

生产级 AI Agent:从提示词实验走向平台、护栏与评测体系

来源: infoq.com 47
QCon AI Boston 2026 释放出的信号很明确:AI Agent 的工程重点正在从“怎样写出更好的提示词”转向“怎样让 Agent 在生产环境中稳定、可控、可评估地运行”。上下文管理、包围 Agent 的安全 harness,以及贯穿开发和上线流程的评测体系,开始成为真正决定系统质量的基础设施。 在原型阶段,团队往往把主要精力放在 syst...

Codex Micro:把 AI 编程 Agent 的常用操作搬到 13 键迷你键盘上

来源: oschina.net 44
OpenAI 的第一款自有品牌硬件没有选择手机或 AI 陪伴设备,而是瞄准了一个非常具体的开发场景:用手掌大小的可编程键盘控制 AI 编程 Agent。Codex Micro 由 OpenAI 与加拿大键盘厂商 Work Louder 合作设计,定价 230 美元,面向 Codex 用户提供 13 个矮轴按键。 这款设备值得关注的地方不只是多了几个快捷...