标签

工程效能

用 LangChain4j 构建代码智能体:Supervisor 与 Workflow 的调试取舍

来源: infoq.com 24
让代码智能体自己编写、测试并修复代码,难点通常不在于一次模型调用,而在于如何组织多轮行动。围绕 LangChain4j 文档进行的这项实验表明,智能体框架的架构选择会直接影响调试任务的执行速度、可控性和应对异常的能力。 实验聚焦于一个能够自主完成“写代码、跑测试、定位问题、修改代码、再次验证”的编码框架。其中值得关注的是两种常见组织方式:由中央决策者协...

Agent 的成本不在写代码:用上下文交接减少重复阅读

来源: oschina.net 17
AI 编程 Agent 的账,往往不是写了多少行代码,而是读了多少遍代码。Stencil 的 Can Boluk 对 SWE-Bench 基准测试数据进行拆解后发现:在约 1.81 亿个 token、近 200 万次工具调用中,编辑和写入只占 9%,其余 91% 都消耗在读取文件、执行 grep、查看命令输出等活动上。 这改变了优化方向。提高生成速度只...

用协作式时间切片填平 RL 流水线的 GPU 空窗

来源: cloud.google.com 33
大模型强化学习后训练并不总是缺 GPU,很多时候真正的问题是 GPU 已经分配,却在等待下一阶段。同步 RL 在 rollout 采样与梯度训练之间严格交替;异步 RL 虽然允许两者重叠,训练器仍可能因新鲜轨迹不足而停顿。llm-d 引入的协作式时间切片把这些阶段变成可调度单元,让多个独立 RL 作业共享同一组物理加速器。 初步基准显示,这种平台级复用...

智能体已经就位,但企业数据还没有:从记录系统走向行动系统

来源: cloud.google.com 21
企业把 AI 智能体推向生产时,真正卡住规模化的往往不是模型能力,而是数据能否提供可信的业务语境。智能体需要理解客户、订单、权限和业务规则,还要跨系统查询并执行操作。一次提示词就可能触发多轮检索、数据库查询和 API 调用,原本面向人工访问设计的数据平台,很容易在这种非线性负载下暴露延迟、成本和治理问题。 Google Cloud 在 Next 202...

Voicify 如何用 Gemini 把 AI 电话点餐做得更快、更准、更可靠

来源: cloud.google.com 32
餐厅电话一响,漏接可能意味着订单流失;医疗机构接到预约电话时,任何一个字段错误都可能影响后续服务。Voicify 的实践说明,企业级语音助手并不只是把大语言模型接到电话系统上,而是要同时解决交易准确性、流量尖峰、响应延迟以及安全合规问题。 Voicify 成立于 2018 年,最初希望为电话、聊天等渠道构建实用的语音驱动助手。疫情期间,团队将重点转向餐...

Expedia 如何用 AI 遥测分析平台加速生产事故排查

来源: infoq.com 21
生产事故排查通常不是“没有数据”,而是数据分散在日志、指标、链路追踪和事件记录中。工程师需要在高压状态下快速建立时间线、筛选异常服务,并判断哪些信号最可能指向根因。Expedia Group 引入的内部平台 STAR,正是围绕这一过程构建的 AI 辅助可观测性工具。 STAR 将服务遥测数据、结构化调查流程和大语言模型结合起来,帮助工程师分析生产事故、...

Expedia STAR:用服务遥测与大模型加速生产事故调查

来源: infoq.com 39
生产事故调查最耗时的部分,往往不是查看某一张监控图,而是在日志、指标、链路追踪和部署记录之间反复切换,并把零散信号整理成可验证的故障假设。Expedia Group 推出的内部平台 STAR,尝试用结构化工作流和大模型缩短这一过程,同时保留工程师对结论的审核权。 根据公开摘要,STAR 使用 FastAPI、Datadog、Celery、Redis 和...

平台团队如何通过改善开发者体验推动合规落地

来源: infoq.com 30
平台工程团队承担合规治理时,很容易把目标理解成“让所有团队立即遵守统一流程”。但如果新流程依赖强制入口、文档不完整,并且没有解释规则解决了什么风险,开发者感受到的通常不是治理能力,而是交付阻力。 更有效的做法,是把合规设计成平台能力:简化规则,优先控制真正重要的风险,再通过预防、检测和沟通逐步推广。开发者不需要成为合规专家,也能在日常交付路径中做出正确...

CodeBuddy NPC:把云端智能体接入从任务到 PR 的研发闭环

来源: oschina.net 18
腾讯云发布了云端智能体 CodeBuddy NPC。它瞄准的不是编辑器里补全一段函数,而是一次完整的研发交付:开发者派发任务后,智能体自行规划方案、开发代码、提交 PR、执行测试,并根据 CI 结果持续修改,直至产出可验收的结果。 这类产品的变化在于,AI 的工作单位从“代码片段”变成了“可合并变更”。对团队来说,衡量标准也随之从生成速度转向需求边界、...

Kiwi TCMS 16.2 升级指南:安全更新、数据库迁移与 API 兼容性检查

来源: oschina.net 14
Kiwi TCMS 面向手动测试与自动化测试提供统一的测试管理能力,包括缺陷跟踪器集成、搜索、访问控制、自动化框架插件、可视化报告和 API。此次发布信息指向 16.2,但摘要中的版本说明出现了 16.1,且变更列表被截断。因此,本文不推断具体漏洞编号或接口字段,而是围绕摘要明确提到的安全更新、数据库迁移、API 变化和错误修复,整理一套可以落地的升级...