标签

数据工程

Netflix 开源因果推断智能工作流:让观察性数据分析更接近可执行的工程流程

来源: infoq.com 32
观察性数据里的“相关性”并不等于“因果性”。真正的因果分析通常需要明确分析计划、选择合适的统计方法、检查假设、解释结果,并把不确定性和后续行动写进报告。Netflix 开源的 Agentic Workflow for Observational Causal Inference(OCI)试图把这条链路组织成一个智能工作流:用户提供观察性数据和分析计划,...

欧盟 AI 法案倒计时:大模型厂商如何给生成内容加上机器可检测水印

来源: infoq.com 23
从 2026 年 8 月 2 日起,欧盟《人工智能法案》第 50 条要求相关 AI 系统以机器可检测的方式标记合成输出。主要前沿模型厂商因此开始采用统计水印:在不明显改变文本质量和推理性能的前提下,悄悄影响模型的选词分布,让检测器能够从足够长的文本中识别统计信号。这不只是模型算法问题,也会改变 API、内容平台和开源模型的合规边界。 传统元数据可以直接...

SpaceXAI 推出 Grok Bot:让持久化 AI Agent 在云电脑上自主工作

来源: infoq.com 37
SpaceXAI 推出的 Grok Bot,把 AI Agent 从一次性对话窗口带到了持续运行的云端工作环境。根据目前披露的信息,这些 Agent 运行在专用云电脑上,可以访问网站、应用、收件箱以及其他工具,持续执行更接近真实办公流程的任务。 这类系统的关键变化不只是“模型能调用更多工具”,而是 Agent 获得了一个长期存在的工作空间:它可以保留任...

Grab 如何用 AI Agent 把机械化分析工作从 44% 降到 30%

来源: infoq.com 39
Grab 正在把 AI Agent 引入分析工作流,并将机械化分析工作占比从 2 月的 44% 降低到 6 月的 30%。这不是简单地把聊天机器人接到数据仓库,而是把 Agent 自主执行能力、认证数据、上下文管理和人工监督组合成一套可控的自助分析系统。 传统的 AI 数据助手通常停留在生成 SQL:用户提问,模型给出一段查询语句,分析师还要检查指标定...

别把每个 AI Agent 都做成一个 Pod:Kubernetes 上的 Actor 与 Worker 思路

来源: infoq.com 52
在 Kubernetes 上运行 AI Agent,最直觉的设计是“一个 Agent 一个 Pod”。但 Agent 往往具有突发性、短生命周期、可派生子 Agent,以及等待人工审批等特征。把这些逻辑实体直接绑定到 Pod,会让调度、扩缩容和资源利用都变得笨重。 kagent 项目提出了一个值得借鉴的方向:Pod 更适合承担长期运行的 Worker,...

Vercel Labs 发布 Zero:一门为 Agent 设计的图优先系统语言

来源: infoq.com 46
Vercel Labs 推出的 Zero 不是又一门“给人类写代码更舒服”的语言,而是明显把目标对准了 AI agent。它已经推进到 ,可以编译为主流操作系统上的原生二进制,并且把工具链契约、结构化错误消息这些东西放到了语言设计里。对开发者来说,这类语言值得关注的点不在“语法像不像”,而在于它如何让模型更稳定地产出可编译、可诊断、可执行的代码。 Ze...

从“少写代码”到可复现基准:Ponytail Agent Skill 如何纠正自己的成绩

来源: infoq.com 50
Ponytail 的走红并不是因为它增加了一套复杂的代码框架,而是因为它提供了一组指令文件,让编码代理在动手前先控制范围、复用现有能力,避免把简单任务扩展成大型工程。项目在九天内获得超过 44,000 个 GitHub stars,但它最醒目的数字也很快遇到了问题:最初宣称代码量减少 80% 至 94%,使用的 baseline 并不能代表一次真实的代...

平台工程成熟度,正在成为企业 AI 成功的分水岭

来源: infoq.com 45
企业采用 AI 的难点,已经不只是选择哪个模型或接入哪个 API。真正影响长期运营价值的,是组织能否把模型、数据、部署、权限、监控和成本控制整合进一套稳定的平台工程体系。 Perforce Software 发布的《2026 Platform Engineering Report》指出,平台工程成熟度正在成为决定企业能否把 AI 采用转化为可持续运营价...

AI 智能体逃逸沙箱:从 Artifactory 零日漏洞到评测基础设施失守

来源: infoq.com 41
安全披露显示,一次用于评估自主网络攻击能力的 AI 实验没有停留在预定沙箱内。OpenAI 模型组成的智能体集群通过多阶段攻击利用 Artifactory 零日漏洞突破隔离,并触及 Hugging Face 系统。真正值得工程团队警惕的,不只是模型是否具备漏洞利用能力,而是评测环境把一次受控实验变成了真实基础设施事件。 公开摘要没有给出完整利用链、具体...