2026-05-28
来源: infoq.com
43
Anthropic 的 Claude Agent 能做复杂推理和多步骤任务,但真正把它放进生产环境,开发者要面对一堆琐碎问题:Agent 怎么安全地访问内网数据库?跑在哪个 runtime?执行日志怎么追踪?Cloudflare 最近上线了对 Claude Managed Agents 的支持,把这几件事打包到了同一套基础设施里——Workers 的边...
2026-05-28
来源: infoq.com
32
Anthropic 的 Claude 不只是聊天模型——它正在变成一个能自主调用工具、编排多步骤任务的 Agent。但 Agent 要落地,最难的不是模型本身,而是运行环境:它需要访问你的内部 API、需要稳定的执行沙箱、还需要有人盯着它到底干了什么。Cloudflare 最近上线了 Claude Managed Agents 支持,把这三件事一起搬到...
2026-05-28
来源: openai.com
46
2024 年,EU AI Act 正式落地,加州 SB 1047 等州级法案也在加速推进。前沿模型的能力边界每推一步,合规压力就紧一步。OpenAI 此刻公开其 Frontier Governance Framework,本质上是在回答一个问题:模型能力分级、风险评估和安全干预,能不能变成一套可操作、可审计的工程流程,而不是事后公关稿? 下面拆解这套框...
2026-05-28
来源: openai.com
33
一家总资产超过300万亿日元的银行,宣布要成为"AI原生组织"——这不是PPT上的愿景词,而是三菱UFJ金融集团(MUFG)与OpenAI合作后的明确方向。他们选择了ChatGPT Enterprise作为底座,目标是让AI渗透到工作流程和金融产品交付的每一个环节。 很多企业的AI落地路径是:先买工具,再找场景,最后写个内部通报说"已上线AI能力"。M...
2026-05-28
来源: aws.amazon.com
35
企业落地 AI Agent,最大的拦路虎不是模型能力,而是成本和运维复杂度。AWS 生成式 AI 创新中心(GenAIIC)与 Works Human Intelligence(WHI)的合作给出了一个相当硬核的答案:用 Amazon Bedrock AgentCore 搭建业务支持 Agent,成本降幅最高达 97%,同时运营效率显著提升。这篇文章拆...
2026-05-28
来源: aws.amazon.com
46
车队管理每天产生的数据量令人窒息——GPS 定位、油耗、驾驶行为、维保记录、路线偏离,一个中型车队一天就能堆出百万级事件。对运营人员来说,看仪表盘已经不够了,他们需要的是"下一步该做什么"。Verizon Connect 用 Agentic AI 把这个问题从"看数据"推进到"拿洞察",并把它稳定地推给了十万日活用户。这篇文章拆解他们走过的架构决策、实...
2026-05-28
来源: aws.amazon.com
47
AWS 内部的 Sales, Marketing and Global Services(SMGS)组织每天要处理海量业务数据——销售管线、营销 ROI、全球服务工单,数据散落在数十个系统里。传统 BI 仪表盘能看数,但没法"对话"。SMGS 团队用 Amazon Bedrock AgentCore 搭了 NarrateAI,让业务人员直接用自然语言提...
2026-05-28
来源: aws.amazon.com
42
AWS 全球销售团队部署了超过 20 个领域专用 AI Agent——报价计算、客户画像、合同审查、竞品分析……每个 Agent 都能独立产出价值,但一线销售代表却要在不同系统间反复切换,自己判断"这个问题该找谁"。认知负荷没有减少,反而从"查资料"变成了"选 Agent"。Amazon Bedrock AgentCore 正是为解决这类编排问题而生:...
2026-05-27
来源: pytorch.org
43
大模型推理的瓶颈,很多时候不在算力,而在搬运。TokenSpeed 在 GPU 上跑 Qwen3.5-397B-A17B(397B 总参数、17B 活跃参数的 MoE 架构)冲到 580 tokens/s,核心思路就一条:系统性地消灭每一处不必要的内存拷贝。对做 Agentic 工作流的团队来说,这意味着长上下文、多轮工具调用的场景终于有了不卡顿的 G...
2026-05-27
来源: cncf.io
47
跑 GPU 工作负载的开发者迟早会撞上同一堵墙:Kubernetes 默认的 HPA 只看 CPU 和内存,而你的瓶颈在 GPU。vLLM 推理服务排队不是因为 CPU 满了,而是显存吃紧、SM 占用率拉满;Triton 模型服务在 GPU 利用率 90% 时还在被 HPA 判定为"负载正常"。训练任务更离谱——一个 job 占满整张卡,HPA 对此毫...