标签

LLM

用 LFM2.5-2.6B 把本地 Agent 部署到更多设备

来源: huggingface.co 36
当 Agent 不再只运行在云端服务器,而是要进入开发者电脑、边缘设备和离线环境时,模型大小、启动方式、资源占用与数据边界都会变成工程问题。LFM2.5-2.6B 这个规模的模型适合被放进“本地优先”的 Agent 架构中:让模型负责理解任务和选择工具,应用代码负责执行工具、管理权限与保存状态。 下面的实践以“本地模型服务提供 OpenAI 兼容接口”...

Agent Development Lifecycle:当 AI 写代码快过团队评审,工程流程需要一起升级

来源: blog.cloudflare.com 46
AI agent 正在改变软件开发的速度。代码生成可能只需要几分钟,但评审、部署、监控、修复和长期维护仍然需要完整的工程流程。当代码产出速度超过团队验证和运营能力时,真正的瓶颈就从“怎么写代码”转向了“怎么管理持续生成的代码”。 Cloudflare 介绍的 Agent Development Lifecycle,简称 ADLC,正是针对这一变化提出的...

Cloudflare Wallets:让 AI Agent 在安全边界内自主付款

来源: blog.cloudflare.com 37
AI Agent 正从“调用工具”走向“独立完成交易”。Cloudflare Wallets 面向这一变化,为 Agent 提供原生支付能力与可验证身份,并通过 x402 协议支持按需购买 API 和内容。真正值得关注的不是 Agent 多了一个钱包,而是支付、身份和安全策略可以进入同一套可编程执行流程。 传统付费 API 往往要求开发者先注册账户、绑...

在 Cloudflare 上构建面向百万仓库的可定制 CI/CD 平台

来源: blog.cloudflare.com 45
当 CI/CD 平台需要服务数百万个代码仓库时,问题不只是“如何执行一条构建命令”。平台还必须处理任务隔离、构建产物、失败重试、权限边界、流程定制,以及不同团队对流水线的差异化需求。将复杂 YAML 配置拆成 TypeScript 工作流步骤,再结合 Cloudflare Workflows、Artifacts 和 CI SDK,可以把流水线从静态配置...

让 AI 按工程规范工作:从 RFC 到 Cloudflare Codex 的实践思路

来源: blog.cloudflare.com 32
当 AI 代理参与写代码、修改规格说明,甚至整理事故报告时,真正困难的问题通常不是“它能不能生成代码”,而是“它是否始终遵守团队的工程标准”。Cloudflare 的做法是建立一个由结构化工程规范组成的 Cloudflare Codex,再让 AI 代理在开发生命周期中消费这些规范,并通过代理审查自动检查一致性。 这种思路的关键,不是把一份长篇指南丢给...

Cloudflare Agents:把分散的 Agent 会话放进一个可观测工作台

来源: blog.cloudflare.com 33
当 Agent 从单次调用进入真实生产环境,问题很快会从“模型能不能回答”变成“成千上万个会话运行得怎么样”。Cloudflare Agents 的核心价值,是把已经部署的 Agent 会话集中到一个统一体验中,帮助开发者查看关键运行信息,并理解 Agent 在规模化运行时的表现。 开发阶段,工程师通常盯着一次请求:输入是什么、Agent 调用了什么工...

让 Coding Agent 直接定位本地 Workers 请求故障

来源: blog.cloudflare.com 40
当 Workers 的问题只在本地请求中出现时,过去通常需要反复添加日志、重现请求,再人工拼出执行路径。现在, 会为每个本地请求生成结构化 trace,Coding Agent 可以通过单个 API 查询失败位置和原因,不必先部署到远端环境。 结构化 trace 的价值不只是输出更多日志,而是把一次请求整理成可以被工具消费的数据。Agent 可以围绕请...

用隔离式 AI 子代理构建软件工厂:让 Astro 的 GitHub Issue 大幅归零

来源: blog.cloudflare.com 40
当一个开源项目积累了大量 GitHub Issue,真正消耗维护者时间的往往不是写补丁,而是确认问题能否复现、判断报告是否完整,以及验证修复是否真的有效。Astro 的维护实践给出了一个值得借鉴的方向:把人工 Issue 验证拆成多个运行在 GitHub Actions 中的隔离式 AI 子代理,让它们负责复现 Bug、检查补丁并生成预览版本。 根据文...

Django 6.0.8 和 5.2.17 发布:修复四项安全问题

来源: djangoproject.com 35
Django 团队发布了 Django 6.0.8 和 5.2.17,修复四项安全问题,涉及 GIS 空间查询、语言代码缓存、嵌套几何集合,以及管理后台中的 渲染。官方建议所有使用受影响版本的项目尽快升级。 这次修复覆盖 Django main、6.1、6.0 和 5.2 分支。其中 Django 6.1 目前仍处于 release candidate...

AI Agent 可观测性:看清重复调用、成本失控与决策链路

来源: cncf.io 43
传统 APM 擅长回答“接口为什么慢”“哪个服务报错”,却很难解释另一类生产问题:为什么 Agent 对同一个问题调用了三次模型、为什么一次任务的成本突然翻倍、又为什么它在几个工具之间来回循环。Agent 的故障往往不是单点异常,而是一条仍然返回成功状态的错误决策链。 要理解这类系统,仅记录延迟和 HTTP 状态码还不够。团队需要把一次 Agent 运...