2026-08-19
来源: cloud.google.com
48
实时流处理擅长稳定地执行固定 DAG,生成式 AI Agent 则擅长根据上下文临时规划、查询数据并调用工具。把两者直接拼在一起并不难,难的是控制成本、延迟和外部 API 配额:如果每条消息都进入大模型和多步 Agent,高吞吐数据流很快就会变成昂贵而缓慢的任务队列。 更实用的架构是设置一道“轻模型闸门”:所有事件先由 Dataflow 工作节点上的 ...
2026-08-19
来源: cloud.google.com
30
企业内容从来不只有文字。财务模型依赖表格的行列关系,临床报告同时包含照片和病理图像,工程文档用流程图表达系统逻辑,合同中的关键信息还可能藏在扫描页和批注框里。 Box 与 Google Cloud 正在把 Gemini Multimodal Embeddings 2 集成到 Box Agentic Platform。关键变化不是简单增加一种搜索模型,而...
2026-08-19
来源: infoq.com
32
MCP(Model Context Protocol)让 AI Agent 能够通过统一协议调用外部工具。读取文档、查询数据库通常风险可控,但“创建订单”“修改权限”“删除数据”这类写操作会直接改变现实系统的状态。 Cloudflare 正在私有测试阶段推出 WriteGuard,目标是为 MCP 服务器提供更细粒度的安全控制。它关注的重点不是简单地允...
2026-08-19
来源: infoq.com
46
当 AI Agent 只能搜索文档时,调用失败通常只是一次查询错误;当它能够更新工单、发送邮件、修改数据库甚至触发部署时,同一个错误就可能变成真实事故。Cloudflare 正在私有测试 WriteGuard,目标是为 MCP(Model Context Protocol)服务器提供细粒度安全控制,重点约束那些会修改数据或执行动作的工具,而不是把所有工...
2026-08-18
来源: blog.cloudflare.com
37
传统的 BGP 路由泄漏防护高度依赖人工维护的导入、导出策略。一旦运营商误配策略,原本只该发给客户的路由可能被传播给上游或对等网络。RFC 9234 引入 BGP Roles 和 Only to Customer(OTC)属性,让路由器能够根据邻居关系识别并拒绝部分泄漏,而不必等监控系统报警后再人工处置。 针对部署情况的测量表明,这套机制已经进入真实网...
2026-08-18
来源: cloud.google.com
32
生成式 AI 正在把攻击者的代码分析和漏洞利用速度推向机器级别。面对被窃取的企业代码仓库,防守方如果仍依赖完全手工的源代码审查,往往很难在攻击者之前完成定位、验证和修复。 一种更可行的思路,是把大模型放进一个严格编排的安全分析流水线:让不同智能体分别负责代码侦察、威胁建模、入口发现、上下文补全、假设生成和结果验证,再由安全专家进行最终判断。Mandia...
2026-08-18
来源: cloud.google.com
43
金融机构的运营韧性不再只是定期填写一份演练报告。随着欧盟《数字运营韧性法案》(DORA)落地,银行需要更明确地证明:关键业务服务及其数字基础设施能够承受中断,团队可以协同响应,系统能够受控恢复,而且整个过程留下了可复核、可审计的证据。 德意志银行正在探索一种更适合复杂金融系统的路径:用智能体 AI 把架构、数据流、日志、历史事件、告警和运行遥测统一成企...
2026-08-18
来源: aws.amazon.com
37
当 AI Agent 还只是回答问题时,几百毫秒的复制延迟可能只是用户偶尔看到旧数据。但当 Agent 开始执行扣款、修改权限、创建工单或更新库存时,数据层的一致性会直接决定它是否可靠。 一个 Agent 的上下文并不只来自模型推理,还来自数据库查询、工具调用和前一步操作的结果。如果这些读取落后于写入,Agent 可能基于已经过期的事实继续行动。此时,...
2026-08-18
来源: postgr.es
31
用户填写表单、点击提交,却迟迟看不到响应。于是他再次点击。问题在于:第一次请求可能已经成功写入数据库,只是响应在网络中丢失了。结果可能是两个潜客、两封确认邮件、两次 CRM 更新,以及两条分析事件。 这不是单纯的前端交互问题,而是一个缩小版的分布式系统问题。浏览器会重试,移动网络会在服务端提交成功后断开,Serverless 函数可能在提交后超时,队列...
2026-08-18
来源: aws.amazon.com
43
NVIDIA Nemotron 3.5 Lightning 现已通过 Amazon SageMaker JumpStart 提供。它面向高吞吐量的 Agentic 工作负载,采用 30B 参数的 Mixture-of-Experts 架构,但每次推理只有约 3B 参数处于激活状态。根据来源摘要,在适合的 always-on Agent 场景中,它最高可...