来源: infoq.com
33
浏览器自动化长期依赖完整 Chromium。它功能强大,但启动慢、内存占用高,也不容易在大规模短任务中保持低成本。Cloudflare 最近介绍了 Kitesurf,一款面向自动化工作负载的轻量浏览器,尝试把浏览器执行能力放进更适合 Agent 的运行环境。 Kitesurf 的关键组合是:浏览器组件运行在隔离的 WebAssembly 和 Rust ...
来源: infoq.com
36
在 LinkedIn 这样的工程规模下,代码审查的难题不是“能否让大模型读懂一段 diff”,而是如何让系统理解组织内部的编码约定、稳定处理大量 PR,并且避免幻觉与低价值评论。LinkedIn 的做法不是在 GitHub 前面简单挂一个通用 AI 审查器,而是构建多智能体平台,把代码审查当作生产基础设施来运营。 一个模型同时承担上下文检索、缺陷发现、...
来源: infoq.com
38
Cloudflare 分享的案例显示,Astro 项目通过 AI Agent、GitHub Actions 和人工复核,把 GitHub Issue 数量减少了 85%。这件事的重点不只是“让模型自动写代码”,而是把 Issue 分诊、信息补全、重复问题识别和验证流程接入持续集成,让维护者把时间留给真正需要判断的缺陷。 开源项目的 Issue 通常混杂...
来源: infoq.com
35
很多团队并不缺工程规范,缺的是规范真正进入日常开发流程。Cloudflare 最近分享了一个值得关注的方向:借助 AI,把原本停留在文档中的内部工程标准,转化为覆盖软件开发生命周期、能够主动检查和干预的控制系统。 这意味着工程标准不再只是“建议开发者阅读的内容”,而可以成为代码提交、评审、测试、发布和运维过程中的可执行约束。 传统工程规范通常存在于 W...
来源: infoq.com
49
Microsoft 已将 Azure DevOps Remote MCP Server 推进到 GA(正式可用)。它的核心价值很直接:为 AI 客户端提供一个托管的 MCP 入口,让模型能够在授权范围内查询和操作 Azure DevOps 的工作项、代码仓库与流水线,而团队不必自行部署 MCP Server、维护运行环境或暴露内部服务。 不过,GA 不...
来源: infoq.com
36
InfoQ 已开放 AI-Assisted Engineering 在线认证项目报名。这个为期五周的项目面向高级工程师和架构师,尤其是已经每天让编程代理处理生产代码的团队。此时真正困难的问题不再是“提示词怎么写”,而是代理可以修改什么、哪些操作必须禁止,以及如何在人工审查前自动发现错误。 当编程代理只负责生成一个函数时,开发者可以逐行检查输出。一旦代理...
来源: infoq.com
35
{"title_zh":"Harper 5.2:用单运行时架构替代多系统技术栈","body_zh":"# Harper 5.2:用单运行时架构替代多系统技术栈\n\n在个性化数据成为核心业务的应用中,数据库、后端运行时、缓存和部署平台之间的边界,往往也变成性能与运维成本的来源。Harper 主张采用单运行时架构,把应用代码与数据放在同一套运行环境中,...
来源: infoq.com
35
DeepSeek 发布了 DeepSeek Harness()开发者预览版。它不是一个只负责调用模型的 SDK,而是面向自主 AI Agent 的开源执行运行时:用微内核承载最小核心能力,再通过插件扩展具体功能。 这种设计把 Agent 基础设施从一个越来越庞大的单体程序,变成可以替换、审计和演进的模块集合。与此同时, 提供了 append-only ...
来源: infoq.com
38
WhatsApp 正在有限范围内测试 Scam Alert:当陌生联系人发来消息时,端侧机器学习模型会判断其中是否存在潜在诈骗风险。这个方案值得关注的地方不只是“把模型放进手机”,而是如何在消息内容留在设备上的前提下,完成模型效果评估、遥测统计和模型交付。 根据公开摘要,这套架构组合了端侧推理、机密计算、Oblivious HTTP、差分隐私和模型透明...
来源: infoq.com
46
当 AI Agent 只能搜索文档时,调用失败通常只是一次查询错误;当它能够更新工单、发送邮件、修改数据库甚至触发部署时,同一个错误就可能变成真实事故。Cloudflare 正在私有测试 WriteGuard,目标是为 MCP(Model Context Protocol)服务器提供细粒度安全控制,重点约束那些会修改数据或执行动作的工具,而不是把所有工...