标签

开源中国

用 OpenTelemetry 看 AI Agent 的每一步:LoongSuite GenAI 语义规范实战

来源: my.oschina.net 31
AI Agent 跑起来之后,最难回答的问题不是"它能不能用",而是"它刚才到底做了什么"。一个多步推理的 Agent 可能调了三次模型、检索了两段文档、执行了一个工具调用——中间任何一步出错,最终结果就偏了。传统日志和指标很难把这些串联起来,而阿里云基于 OpenTelemetry 推出的 LoongSuite GenAI 可观测语义规范,正是要解决...

Gemma 4 12B:扔掉编码器,用 16GB 显存跑多模态

来源: oschina.net 30
Google 在 6 月 3 日放出了 Gemma 4 12B——一个把视觉和音频直接塞进语言模型本体、不再依赖外部编码器的统一多模态模型。更关键的是:16GB 显存或统一内存就能本地跑,高端笔记本直接部署,不需要云端算力兜底。 这件事值得认真看,不只是因为"又出了一个新模型",而是因为它代表了一条正在成型的架构路线:把多模态能力内化到语言模型本身,而...

Kimi Work 公测:把 Agent 落到本地,从写代码到做研究

来源: oschina.net 43
月之暗面把自家全员在用的本地 Coding Agent——Kimi Code——做成了更通用的底座,往上叠加金融、科研、办公等场景的 Skill,打包成 Kimi Work Beta 推向公测。这意味着"本地 Agent"不再只是程序员专属的工具,而是任何知识工作者装上客户端就能跑起来的生产力入口。 Kimi Code 是整个系统的内核。它每天服务几十...

VS Code 1.123:Agent 多窗口并行、Research Agent 深度调研、会话跨设备同步

来源: oschina.net 48
VS Code 1.123 把 Copilot Agent 从"单线程聊天"推向了多任务工作流。这次更新有三个值得马上用起来的变化:Agent 窗口支持并排打开多个会话、Research Agent 能针对特定主题生成带引用的 Markdown 报告、聊天会话自动跨设备同步。再加上集成浏览器的改进,整个 Agent 体验从"问答工具"变成了"研究+执行...

2026 年商城系统选型:别再问"能不能用",该问"能不能掌控"

来源: oschina.net 47
选商城系统这件事,2026 年的逻辑变了。过去团队最关心的是"功能够不够、上线快不快",现在核心问题变成了三个:能不能自主掌控数据与代码、能不能灵活二次开发而不被平台绑架、能不能撑住未来三到五年的业务增长而不必推倒重来。 这篇文章不打算给你一个排名表——那种东西半年就过期。我想把选型真正要盯住的维度拆开,再给你一套可以落地的评估方法。 2026 年的电...

openKylin 实践案例征集启动:240 万用户背后的桌面 OS 生态怎么建

来源: oschina.net 47
openKylin 不再只是"国产替代"叙事中的一个名字。超 240 万用户、2100 家共建伙伴、覆盖教育、金融、政务等多个行业的真实部署——这些数字说明它已经从社区实验走向生产环境。2026 年度应用实践案例征集的全面启动,本质上是在做一件事:把已经跑通的经验从各行业里捞出来,变成可复用的参考,让后来者少走弯路。 开源社区常见的贡献路径是提交代码、...

Let's Encrypt 为什么押注 Merkle 树证书来对抗量子计算

来源: oschina.net 36
2026 年 6 月 3 日,Let's Encrypt 在官方博客发布后量子密码学迁移路线图,核心选择不是传统 X.509 证书换一套签名算法,而是把赌注压在 Merkle Tree Certificates(MTC,默克尔树证书) 上。全球最大的免费证书颁发机构要重塑 Web 信任基础设施的底层结构——这不是小修小补,而是换地基。 NIST 已经在...

Paozhu 1.10.0:C++ Web 框架补上 WebSocket 客户端与 RPC,物联网场景终于有了一站式选择

来源: oschina.net 36
做 C++ 后端开发的人大概都经历过这种割裂:HTTP 框架选一个,WebSocket 再找另一个,RPC 又得引入第三方库,物联网场景下的裸 Socket 通信还得自己从 epoll 写起。Paozhu 这个国产 C++ Web 框架在 1.10.0 版本里一口气把这些缺口补上了——WebSocket client、Socket server/cli...

用 Jujutsu 拆解巨型 PR:把审查从"心理清单"变成可操作的工作流

来源: oschina.net 34
面对一个改动 300 个文件、横跨重构+新功能+配置迁移的巨型 PR,审查者最真实的感受不是"代码写得不好",而是"我不知道自己看完了没有"。哪些文件已经审过、哪些意见对方改了、哪些还没回复——这些全靠脑子记。传统 Git 给你一把 ,然后就把你丢进了信息的海洋。 Ben Gesoff 最近分享了一套用 Jujutsu()做大型变更审查的工作流,核心思...

把 Agent 调优当成搜索问题:微软的"Agent 优化循环"思路

来源: oschina.net 34
团队给 Agent 加了评估指标,跑完一看——准确率 72%,工具调用失败率 18%,幻觉率 9%。数字很清楚,下一步却卡住了:改了提示词压幻觉,工具调用失败率反而涨了;换了个工具描述格式,准确率又掉了两分。能测量,但修一个就坏另一个,这是当前 Agent 开发中最让人头疼的循环。 微软的 Vivek Bhaduria、Luis Quintanilla...