标签

云平台

用 Amazon Bedrock AgentCore Gateway 给 MCP 服务器加一道生产级安全网

来源: aws.amazon.com 60
Model Context Protocol(MCP)正在快速成为 AI Agent 调用外部工具的标准协议,但把 MCP 服务器从开发环境推向生产,问题立刻浮现:谁有权调用哪个工具?调用日志怎么追踪?敏感数据会不会被 Agent 不小心外泄?散落在各处的 API Key 又该怎么统一管理? Amazon Bedrock AgentCore Gatew...

给 AI Agent 上锁:在 Amazon Bedrock AgentCore 中组合策略与 Lambda 拦截器

来源: aws.amazon.com 64
当 AI Agent 手里握着数据库查询、API 调用等工具时,不加限制的执行权限无异于把删库跑路的钥匙交给了大模型。Amazon Bedrock AgentCore 网关提供了两道防线来收紧 Agent 的动作边界:Policy(策略)负责确定性访问控制,Lambda interceptors(Lambda 拦截器)负责动态校验。本文以一个 Lake...

让 AI Agent 安全地花钱:Amazon Bedrock AgentCore Payments 的防护机制

来源: aws.amazon.com 46
让一个 AI Agent 帮你下单付款,听起来很方便——直到它花错了钱。Agent 自主调用支付接口的那一刻,风险就从"对话幻觉"升级成了"真实损失"。Amazon Bedrock AgentCore Payments 正是为了解决这个问题而生:在 Agent 和支付动作之间插入一层内置的防护栏(guardrails),让 agentic paymen...

固件更新后服务器重启四小时?深挖 UEFI 与 iPXE 把启动时间压到分钟级

来源: blog.cloudflare.com 67
一次常规固件更新,核心服务器重启竟然要等四个小时。这不是夸张——当数百台节点同时上线,每台都在 UEFI 阶段白白等待,累计的停机时间足以让运维团队崩溃。本文拆解一次真实排查:从定位 UEFI 数据结构中的隐藏超时,到用 iPXE 自动化跳过无用的等待步骤,最终把启动时间从小时级拉回分钟级。 服务器重启慢,直觉会怀疑 OS 层面的服务启动。但这次问题出...

给 Cognito 加一层可扩展的用户搜索

来源: aws.amazon.com 66
Amazon Cognito 解决了认证和用户池管理的问题,但它的搜索能力非常有限——只能按用户名、邮箱、子 ID 等少数字段做精确匹配,不支持模糊搜索、组合条件筛选或全文检索。当你的应用需要"按姓名拼音搜用户""按注册时间范围+角色标签过滤"这类需求时,Cognito 自身的 ListUsers API 会很快成为瓶颈。 解决方案的思路很直接:把 C...

AgentOps:让 AI Agent 在生产环境真正可控

来源: aws.amazon.com 51
Agent 不再只是按脚本跑的流水线——它会推理、会变道、会自己拍板。这意味着传统 DevOps 的监控、回滚、成本管控手段,在 Agent 场景下几乎全部失效。一次"聪明"的自主决策,可能让调用链多绕三圈,Token 费用翻十倍,而日志里只留下一句模糊的 。 Amazon 在 Bedrock AgentCore 上提出了一套 AgentOps 纪律:...

用 GPUDirect + FSx for Lustre 加速百亿参数 LLM 加载,TurboQuant 扩展上下文窗口

来源: aws.amazon.com 241
当你把一个 70B 甚至 175B 参数的大模型往 GPU HBM 里塞的时候,等待时间会随参数量线性膨胀——几百 GB 的权重文件先从存储读到 CPU 内存,再从 CPU 内存拷贝到 GPU,整个过程 GPU 干等着,推理启动慢、资源浪费大。AWS 近期把 GPUDirect Storage(GDS)与 Amazon FSx for Lustre 打...

用 MCP 让时序数据库开口说话:Amazon QuickSight + KDB-X 实战

来源: aws.amazon.com 47
时序数据从来都不缺——金融行情、IoT 传感器、DevOps 指标,每秒都在涌入。缺的是让业务人员自己拿到答案的能力。分析师想问"过去 24 小时这只股票的波动率是多少",要么等数据团队排期写 SQL/Q 查询,要么在仪表盘里翻半天。Amazon QuickSight 搭上 KDB-X 的 MCP Server,把这条链路压成一句话:用自然语言提问,直...

OpenAI 前沿模型与 Codex 正式登陆 AWS:企业落地的新路径

来源: openai.com 46
OpenAI 的前沿模型(GPT-4o、o3、o4-mini 等)和代码执行代理 Codex 终于在 AWS 上正式可用(GA)。这意味着企业不再需要绕开现有的 AWS 账户体系、安全策略和采购流程去单独对接 OpenAI——直接在熟悉的 AWS 环境里调用即可,从评估到上线的路径大幅缩短。 过去一年,不少企业在用 OpenAI 模型时遇到一个尴尬局面...