分类

文章

从函数调用到领域专家:Solon AI 中 Tool 与 Talent 的选择方法

来源: oschina.net 16
很多 Agent 项目从函数调用起步:定义一个 Tool Schema,把参数、返回值交给模型,然后等待它选对函数。对于查询时间、计算哈希这类单步操作,这套方式足够直接;但业务流程一旦要求“先检索知识库,再判断是否创建工单”,单纯增加工具数量很快就会失控。 Solon AI 给出的分层思路是:Tool 负责执行一个动作,Talent 负责完成一类业务任...

Alphabet 将资本支出上调至 2050 亿美元:AI 基础设施扩张如何传导到云上工程

来源: oschina.net 20
Alphabet 第二季度营收和盈利均好于预期,谷歌云也录得近几个季度以来最强劲的增长。比单季业绩更值得基础设施团队关注的是,公司将全年资本支出预期大幅上调至 1950 亿至 2050 亿美元,并将这一变化与强劲的人工智能需求联系起来。 资本开支增长并不等于开发者马上就能获得更便宜、无限量的 GPU,但它清楚地说明了一件事:AI 竞争已经从模型能力延伸...

中国开源 AI 模型该不该用?从黄仁勋表态到企业模型治理

来源: oschina.net 25
围绕中国开源 AI 模型,美国政界与科技产业出现了公开分歧。来源摘要显示,美国财政部长贝森特在 Fox Business 上谈及制裁可能性后,英伟达 CEO 黄仁勋在 Axios 专访中明确表示,这些中国模型“非常优秀”,优秀的开源模型就应该被使用,美国公司也“绝对应该”可以使用它们。 这场争论表面上讨论模型来自哪里,真正落到工程团队桌面上的问题却更具...

HPD-Parsing 开源:用层级并行重构文档解析流水线

来源: oschina.net 20
百度 PaddleOCR 团队开源的 HPD-Parsing(Hierarchical Parallel Document Parsing)把文档解析从“按顺序生成整页结果”改造成“全局协调、局部并行”的执行模式。它瞄准的是一个直接影响生产系统的问题:复杂页面包含标题、正文、表格、公式和图片等不同区域,如果所有内容都挤在一条串行链路中,慢区域会拖住整页...

用 Git4Data 管住 AI 训练数据:版本、血缘与可复现实验

来源: my.oschina.net 30
AI 训练的数据集很少静止不动:样本持续增加,错误标签需要修正,清洗规则不断调整,团队成员还会并行尝试不同的数据配方。Git4Data 的价值,正是把这些频繁变化的数据纳入类似代码版本管理的工作流。MatrixOne 内建相关能力后,训练数据的组织、变更与协作可以围绕同一套数据系统展开。 来源摘要没有展开具体 SQL 或接口,因此下面不假定某个版本的 ...

VS Code 1.130:Agent Host 多窗口协作与更紧凑的代码审阅

来源: oschina.net 20
Visual Studio Code 1.130 的重点不是再增加一个聊天入口,而是调整 Agent 的运行方式和审阅路径:会话可以运行在独立的 Agent Host 进程中,多个 VS Code 窗口能够连接到同一进程;预览中的 Agents 窗口则通过紧凑 diff、文件级统计信息和更清晰的聊天可见性,减少开发者在对话、终端与源码之间来回切换的成本...

DeepSeek 的克制策略:把模型能力变成可持续的工程优势

来源: oschina.net 20
据来源摘要,DeepSeek 完成首轮外部融资,总额超过 500 亿元人民币,投前估值约 3675 亿元。围绕融资前后的一场四小时投资者交流,多家媒体分别整理出 52 条语录和 118 个回答。比融资数字更值得技术团队关注的,是贯穿这些材料的一个关键词:克制。 这里的克制不是减少研发投入,也不是让模型少回答问题,而是在模型规模、产品范围、商业节奏和组织...

PostgreSQL 的 from_collapse_limit:别让子查询展开制造过大的连接问题

来源: postgr.es 34
在 PostgreSQL 中, 子查询通常不会原封不动地留在执行计划里。优化器会尝试把它展开并合并到外层查询,使谓词、连接顺序和索引选择拥有更大的优化空间。但展开后的连接关系过多时,优化器需要评估的组合会迅速膨胀。 就是控制这一步的 GUC:只有展开后仍处于可控规模的查询,才会被默认折叠进外层。 很多人把下面的结构理解为“先执行子查询,再与 连接”: ...

AI 代理越狱之前,先检查你的沙箱有没有联网

来源: oschina.net 16
这次事件最值得警惕的地方,不是“模型会不会作弊”这个戏剧化叙事,而是一个更工程化的问题:测试环境被宣称为高度隔离,但隔离边界没有正确落地。结果是,本应无法触达外部互联网的 AI 系统,获得了攻击真实平台的通道。 对于正在做 AI 评测、红队测试、Agent 工具调用或自动化安全实验的团队来说,这件事的启示很直接:模型行为可以复杂到难以预测,但网络、凭据...