2026-09-09
来源: aws.amazon.com
30
传统服务可以靠单元测试验证确定性输出,AI Agent 却没有这么简单:同一个问题可能产生不同措辞,工具调用还会受到上下文、权限和模型版本影响。更可靠的办法,是把部署、真实提示词调用和语义评分串进 CI,让每个 Pull Request 都接受一次自动化行为检查。 Amazon Bedrock AgentCore Evaluations 与 GitHu...
2026-09-09
来源: aws.amazon.com
39
部署实时大模型服务时,GPU 型号更新并不自动等于成本下降。真正需要比较的是:在目标并发、输入长度和输出长度下,每秒能生成多少 token,用户需要等待多久,以及这些 token 最终花了多少钱。 针对 Qwen3-Coder-30B 和 NVIDIA Nemotron-3-Nano-30B 这两个 30B Mixture-of-Experts(MoE...
2026-09-09
来源: aws.amazon.com
30
灾难恢复系统的排障难点,不只是日志多,而是证据分散在复制任务、恢复点、网络、存储和基础设施状态中。HPE Zerto 基于 Amazon Bedrock 构建了一套智能体式排障系统,并把执行环境部署在客户本地。这个设计值得关注:大模型负责推理,但对实时灾备数据的采集、约束和治理留在客户环境内。 这类系统真正困难的部分,不是让模型“读懂一段日志”,而是让...
2026-09-09
来源: aws.amazon.com
34
联络中心质检真正困难的地方,不只是让模型给出一个分数,而是要让运营团队知道:为什么扣分、证据来自哪句话、规则如何调整,以及换一种语言后结果是否仍然可信。 滴滴基于 Amazon Bedrock 建设了一套自有的智能质检系统,用来替换不透明的第三方工具。根据案例摘要,系统的意图验证准确率从 38% 提升到 86%,合规评分准确率超过 90%,西班牙语和葡...
2026-09-09
来源: cloud.google.com
39
企业落地智能体并没有统一答案。需要快速部署、集中治理的团队,可以选择托管式商业平台;已经拥有专用工作流、自定义执行引擎或内部权限体系的团队,则往往更适合搭建轻量级 Agent Hub。 这类自建平台真正困难的部分并不是调用模型,而是让几十个后台智能体持续、可预测地运行:工具调用必须受限,执行过程必须可追踪,多轮状态必须能够恢复,运维人员还要在必要时阻止...
2026-09-09
来源: cloud.google.com
25
“1 月平均订单金额下降了 7%,但总收入没有变化,为什么?”这类问题难的不是写出某一条 SQL,而是答案通常散落在多个系统里:订单历史位于 BigQuery,实时客户资料保存在 Cloud SQL for PostgreSQL,营销规则则以 JSON 文件存放在 Cloud Storage。 Data Agent Kit 试图把这段调查过程收回到 I...
2026-09-09
来源: cloud.google.com
24
面向消费者的 RAG 应用很难只优化一个指标:回答要有依据、首字延迟要低,还要同时处理网页、EPUB、PDF、图片混排等内容。KDDI 在构建 Buffmee 时,把自动化质量评测与生产日志分析放进同一个优化闭环,最终将应用总响应延迟降低 38%,首字时间(TTFT)改善近 18%,groundedness 指标提升 25%。 Buffmee 汇集了超...
2026-09-08
来源: postgr.es
37
PostgreSQL 从对象存储导入大批量数据时,瓶颈往往不只在网络。CSV、Parquet 等格式的解析、类型转换、解压缩,以及数据写入 PostgreSQL 的过程,都可能消耗大量 CPU 和内存。新发布的 PostgreSQL 扩展提供了另一种实现路径:在 PostgreSQL 侧利用 chDB——一个进程内运行的 ClickHouse 引擎——...
2026-09-08
来源: huggingface.co
34
安全系统最常见的失败,不只是“放过了危险内容”,还包括“把正常内容一起挡掉”。当一个请求同时包含合法目标、敏感背景和少量高风险操作时,简单地按主题拒绝,虽然实现方便,却会让医疗、网络安全、金融和心理健康等重要场景变得不可用。 更合理的目标不是判断“这个话题能不能谈”,而是识别请求中哪些部分会实质性提高伤害能力,只拒绝那一小部分,并继续回答其余内容。 传...
2026-09-08
来源: infoq.com
38
AI 辅助编码正在改变研发流程:开发者不仅调用 CI、制品库和 Kubernetes,还会调用代码补全、聊天模型、智能代理与自动评审工具。平台团队面对的问题因此不再只是“如何提供基础设施”,而是“哪些 AI 能力应成为平台能力,以及如何在统一治理和团队自主之间划线”。 这类变化并不意味着平台团队要接管所有 AI 工具。更合理的方向,是把重复、敏感且需要...