标签

AI

用 Cloudflare AI Gateway 给失控的 AI 账单加上实时刹车

来源: blog.cloudflare.com 60
调用一次 GPT-4o 大概几分钱,跑一轮 Agent 可能几块,但一个没有上限的自动化任务跑一晚上——账单就能从"可接受"直接跳到"需要开会解释"。Cloudflare AI Gateway 新上线的实时消费限额功能,就是给这种场景装了一道硬闸门:token 花到阈值,请求立刻断掉,不再等到月底才看到数字。 账单爆炸很少是单次调用太贵,而是调用次数失...

Postgres 19 终于有了"查询提示"——但它们不叫 Hint

来源: postgr.es 44
Postgres 社区花了二十年说"绝不",然后加了一个功能,和 hint 做的事一样,只是换了个名字。Postgres 19 的 feature freeze 包含两个新的 contrib 模块: 和 。官方说法是——这叫"plan advice",不是 hint。技术上正确,是最好的正确。 这件事值得好好聊聊,不只是因为功能本身,更因为它背后的漫长...

把 Python Docker 镜像从 1GB 瘦到 100MB 以内:实操指南

来源: realpython.com 45
一个典型的 Python Docker 镜像,起步就是 900MB 甚至更大。大部分体积来自你根本不会用到的东西——系统包、pip 缓存、编译中间产物、测试文件。镜像越大,拉取越慢,部署越贵,安全扫描的噪音越多。这篇文章把常用的瘦身手法逐个拆开,给出可以直接复制改造的 Dockerfile 和命令。 用最朴素的方式打包一个 Flask 项目: 构建完 ...

Dropbox Nova:让 AI 编程 Agent 在工程体系里真正跑起来

来源: infoq.com 47
当 AI 编程 Agent 从"个人工具"变成"团队基础设施",问题就不再是"能不能写代码",而是"怎么可靠地调度、观测和管控几十个 Agent 同时干活"。Dropbox 近期公开了内部平台 Nova——一个专门用来编排和运营 AI 编程 Agent 的系统,把 Agent 从实验玩具推进到了工程流水线的一环。 单个开发者用 Copilot 补全几行...

Dropbox Nova:让 AI 编码 Agent 在工程体系里真正跑起来

来源: infoq.com 62
Dropbox 公开了内部平台 Nova——专门用来编排和规模化运行 AI 编码 Agent 的基础设施。这不是又一个 IDE 插件或单点工具,而是一整套让 Agent 从"实验玩具"变成"工程流水线一环"的操作系统。 单个 AI 编码 Agent 在本地跑 demo 很简单:打开 Copilot、写一段 prompt、拿到补全结果。但当你想让 Age...

Blueking Lite 更新:人机协同决策交互优化与三员管理落地

来源: oschina.net 147
运维平台走到"AI First"这一步,最大的挑战不再是算法本身,而是人怎么和算法一起把决策做完。Blueking Lite 本周的更新直指这个痛点——优化选项确认与流程推进的交互体验,同时内置了三员管理角色体系,让权限边界更清晰。 传统 AIOps 平台常见的问题:系统抛出一堆告警,自动生成处置建议,运维人员要么全盘接受,要么逐条驳回,中间缺乏有效的...

把 AI 代码审查装进终端:阿里 Open Code Review 开源实践

来源: oschina.net 62
代码审查谁都绕不开,但谁都觉得烦。PR 堆了一排等着 review,审查者要么匆匆扫过放行,要么逐行抠细节拖慢发布节奏。阿里巴巴内部也撞上了这堵墙——于是他们造了一把锤子,用了两年,现在把锤子免费递给了社区:Open Code Review,一个基于 AI 的代码审查 CLI 工具。 内部两年间,它服务了数万名开发者,累计发现数百万个代码缺陷。这个数字...

Ladybird 关上公开 PR 的大门:浏览器引擎的安全与信任之择

来源: oschina.net 54
开源项目"欢迎一切 PR"几乎是社区默认礼仪,但 Ladybird——那个从零开始构建的独立浏览器引擎——刚刚打破了这个惯例:即日起不再接受外部 Pull Request,所有代码变更只能由项目维护者直接引入。时机微妙:Ladybird 正在冲刺首个 Alpha 版本。 Ladybird 的声明很直接——不是"暂停",不是"暂时限制",而是政策性转变。...

LiteRT-LM 搭上 Gemma 4 多 token 预测,端侧推理提速 2.2 倍

来源: infoq.com 50
端侧跑大模型,瓶颈从来不是模型有多聪明,而是 token 一个一个往外蹦的速度够不够用。Google 最新发布的 LiteRT-LM 把 Gemma 4 的 Multi-Token Prediction(MTP)drafter 原生接进推理引擎,实测推理速度最高提升 2.2 倍——不是靠砍精度,而是靠更聪明的投机解码策略。同时,框架的 API 版图也在...

PlanningBench:让大模型"真会规划"有了一把可验证的尺子

来源: oschina.net 53
大语言模型写诗、写代码、写摘要的能力已经被各类基准反复检验,但"规划"这项更接近真实决策的核心能力,一直缺乏系统化、可扩展的评测手段。腾讯混元团队联合中国人民大学高瓴人工智能学院等机构开源的 PlanningBench,正是要补上这块短板——它从真实规划场景出发,抽象任务结构与约束,构建覆盖 30+ 任务类型的数据生成与验证体系,让"模型到底能不能规划...