标签

云平台

GPT-5.6 Sol、Terra 与 Luna 登陆 Amazon Bedrock:如何选型并接入生产系统

来源: aws.amazon.com 32
OpenAI 的 GPT-5.6 Sol、Terra 和 Luna 现已在 Amazon Bedrock 正式可用。这意味着 AWS 用户可以通过 Bedrock 的推理基础设施使用这一模型家族,并沿用云平台提供的安全、可靠性与运维能力。对开发团队而言,真正需要解决的问题不是“多了三个模型名称”,而是如何确认区域与模型标识、建立统一调用层,并用数据决定...

把 Kubeflow 故障现场带回 Kubernetes:用 Headlamp 插件直查 CRD 与 Pod

来源: kubernetes.io 29
Kubernetes 已经承载了越来越多的 AI/ML 工作负载:Notebook、分布式训练、超参数搜索、流水线和 Spark 作业最终都会落到 Pod、存储卷、调度器与自定义资源上。Kubeflow 用 CRD 描述这些能力,但面向数据科学家的专用控制台往往隐藏了底层 Kubernetes 状态。Headlamp Kubeflow 插件补上了这层视...

把 AI 当作认知无障碍工具:为神经多样性工作者搭建执行功能支架

来源: aws.amazon.com 41
对一些神经多样性工作者来说,真正消耗精力的未必是专业任务本身,而是启动任务、拆分步骤、判断优先级、切换上下文,以及把零散想法整理成别人能理解的文字。此时,AI 不是锦上添花的效率工具,而是一种认知无障碍支持。 来源文章介绍了一套建立在 Amazon Quick 桌面端之上的日常系统。它利用 AI 桌面与 Web 助手补偿执行功能上的缺口,把模糊、混乱或...

从单点原型到六款产品:Bluesight 如何构建统一的医疗合规 AI 智能体

来源: aws.amazon.com 27
Bluesight 的实践展示了一条典型但并不轻松的企业 AI 演进路径:团队没有停留在单一产品中的 AI 原型,而是借助两次 AWS 合作和 Amazon Bedrock AgentCore,将能力扩展为统一的智能体方案 Prism,覆盖六款医疗合规产品。面向 ControlCheck 的 Prism Assistant 已于 2026 年 5 月发...

用 OBO 令牌交换为多租户 Bedrock AgentCore 智能体建立纵深授权

来源: aws.amazon.com 41
多租户智能体一旦开始调用企业 API,仅验证“请求来自某个已登录用户”就不够了。系统还需要回答三个问题:用户属于哪个租户、智能体是否可以代表该用户调用目标服务,以及这枚令牌是否只能交给指定 API 使用。 Amazon Bedrock AgentCore Gateway 的 on-behalf-of(OBO,代表用户)令牌交换把这些问题落到可执行的授权...

SageMaker AI Studio 推出生成式 AI 推理推荐界面:从基准测试到一键部署

来源: aws.amazon.com 22
生成式 AI 模型能否稳定上线,往往不取决于一次调用是否成功,而取决于实例类型、并发量、延迟和成本能否形成可接受的组合。Amazon SageMaker AI Studio 新增了面向生成式 AI 推理推荐的可视化界面,把原本需要通过 API 配置参数、读取原始基准测试结果的流程,变成由用例预设、图表比较和一键部署串联起来的低代码体验。 已有 API ...

从车端服务发现到云端智能体:用 AAOS、Bigtable 与 Nexus SDV 构建 AI 定义汽车

来源: cloud.google.com 25
汽车软件架构正在从“每个 ECU 各管一摊”转向可发现、可组合、可持续演进的服务体系。AAOS SDV 负责把车内非安全关键能力抽象为服务,Nexus SDV 连接车辆与云端,Bigtable 承接高频遥测,Gemini 与 Agent Development Kit(ADK)则把数据分析推进到推理和行动阶段。真正的变化不只是车辆联网,而是让车辆成为能...

用 k8s-aibom 盘点 Kubernetes 中真实运行的 AI 资产

来源: cloud.google.com 23
AI 供应链管理有一个长期盲区:构建系统知道团队计划部署什么,安全平台却未必知道集群此刻真正运行着什么。开发者直接部署的 vLLM、Triton、LangChain 或向量数据库,可能没有登记到资产台账,也可能绕过只扫描制品仓库的传统工具。 开源的 k8s-aibom 试图补上运行时这一层。它以非特权 Kubernetes 控制器运行,通过观察集群 A...

22 秒攻击交接之后:公共部门如何建立机器速度的持续验证防线

来源: cloud.google.com 37
2026 年公共部门面临的安全问题,已经不再是如何守住一条清晰的网络边界,而是如何保护身份、终端、SaaS 集成、虚拟化管理面和运维人员之间不断变化的信任关系。基于 Mandiant 在 2025 年超过 50 万小时的一线事件调查,最新报告给出了一个尤其严峻的数字:初始访问经纪人建立立足点后,向勒索软件操作者交接的中位时间只有 22 秒。 这意味着,...

Precursor:用持续会话信号识别高级自动化,减少真人用户摩擦

来源: blog.cloudflare.com 31
传统 Bot 管理经常围绕单次请求做判断:检查 IP、请求头、速率或某个挑战是否通过。Precursor 引入了另一种观察尺度,把客户端在完整用户旅程中的持续行为汇总为会话级检测信号,用来识别更高级的自动化,同时减少对正常用户的打扰。 单个 HTTP 请求提供的上下文很有限。一个自动化客户端可以模仿浏览器请求头、控制访问频率,甚至执行 JavaScri...