2026-07-17
来源: cloud.google.com
30
AI 编程助手接管了越来越多的代码输入工作,但工程师并没有因此卸下责任。新的核心任务是管理模型的注意力:让每次调用只读取必要上下文,选择与任务匹配的模型,并在自动化越界前及时止损。 Token 消耗并不只是账单问题。上下文膨胀会增加延迟,稀释关键指令,还可能让模型遗忘约束或产生幻觉。真正有效的优化,不是把提示词压缩到难以理解,而是建立一条短、清晰、可验...
2026-07-17
来源: infoq.com
46
QCon AI Boston 2026 释放出的信号很明确:AI Agent 的工程重点正在从“怎样写出更好的提示词”转向“怎样让 Agent 在生产环境中稳定、可控、可评估地运行”。上下文管理、包围 Agent 的安全 harness,以及贯穿开发和上线流程的评测体系,开始成为真正决定系统质量的基础设施。 在原型阶段,团队往往把主要精力放在 syst...
2026-07-17
来源: oschina.net
44
OpenAI 的第一款自有品牌硬件没有选择手机或 AI 陪伴设备,而是瞄准了一个非常具体的开发场景:用手掌大小的可编程键盘控制 AI 编程 Agent。Codex Micro 由 OpenAI 与加拿大键盘厂商 Work Louder 合作设计,定价 230 美元,面向 Codex 用户提供 13 个矮轴按键。 这款设备值得关注的地方不只是多了几个快捷...
2026-07-17
来源: postgr.es
29
在 Postgres 19 之前,手动执行 只有一种含义:立即处理所有待写页面,并在检查点完成后才把控制权交还给客户端。备份、升级和基准测试需要这种确定性,但在繁忙系统上,突然集中的写入也可能把存储延迟推高。 Postgres 19 为这条老命令增加了选项列表,并引入 与 。DBA 现在可以选择快速完成、平滑写入,或者明确要求检查点处理 unlogge...
2026-07-17
来源: my.oschina.net
25
传统智能客服的主要矛盾已经不再是“能不能回答”,而是“能不能稳定解决问题”。听不懂用户意图时答非所问,遇到复杂任务时只会重复 FAQ,高峰期又无法有效分担人工压力。要从“机械应答”走向“服务伙伴”,关键并不是单纯换一个更大的模型,而是把客服 Agent 建设成一套边界清晰、过程可观测、结果可回退的工程系统。 一个可上线的客服 Agent,至少需要区分四...
2026-07-17
来源: aws.amazon.com
34
企业 Agent 真正落地时,难点通常不在于调用大模型,而在于如何让它稳定、准确并且可控地找到内部资料。Amazon Bedrock Managed Knowledge Base 将数据接入、向量化、索引和检索组织成托管流程,使团队可以把精力放在数据质量、检索策略和生产治理上。 这套能力可以从三个支柱理解:简化配置、更智能的检索,以及面向生产环境的准备...
2026-07-17
来源: postgr.es
42
Spock 6 已进入 Beta,支持 PostgreSQL 16、17、18 和 19。与其说这是一次功能堆叠,不如说它重新整理了多主复制最危险的几条路径:复制进度不再依赖高频目录表写入,超大异常事务可以落盘,节点灾难后能够定位数据分歧,冲突与延迟也有了更直接的统计入口。 对于已经运行 Spock 5 的团队,升级价值主要不在“能否复制”,而在高负载...
2026-07-17
来源: aws.amazon.com
32
Grok 4.3 已可通过 Amazon Bedrock 访问。对开发团队而言,这不仅意味着多了一个模型选项,更重要的是可以在 Bedrock 的统一接口和云治理体系中,把 Grok 用于智能体与企业工作负载。常见入口包括基础对话、可调推理强度、工具调用、结构化输出、图像输入,以及需要保留上下文的多轮会话。 企业中的模型调用很少停留在单轮问答。一个采购...
2026-07-17
来源: cloud.google.com
27
Google 连续第二年进入 Gartner 2026 年对话式 AI 平台魔力象限的领导者区间,并表示自己在“愿景完整性”和“执行能力”两个维度上分别处于最远和最高位置,同时在四项关键能力用例中的三项排名第一。比排名更值得工程团队关注的是背后的产品方向:企业客户体验正在从“回答问题的聊天机器人”转向能够理解意图、检索企业知识、调用业务系统并在必要时转...
2026-07-17
来源: huggingface.co
37
NVIDIA Nemotron 3 Embed 在 RTEB 综合排名中取得第一,释放了一个值得关注的信号:面向智能体的检索模型,竞争焦点已经不只是“找出语义相近的文本”,而是能否在多轮、动态、带工具调用的任务中稳定提供正确证据。 由于来源只给出了榜单结论,没有提供模型尺寸、向量维度、许可证、延迟和各子任务分数,本文不会推断这些细节。更实际的问题是:这...