标签

GCP

把 Claude 跑进企业生产环境:Google Cloud 上的端点、安全与成本设计

来源: cloud.google.com 19
把大模型接入原型只需要一次 API 调用,但把它稳定地服务给全球用户,还要处理算力调度、尾延迟、区域故障、数据驻留、访问控制和成本波动。Claude 在 Google Cloud Agent Platform 上以托管模型服务提供,把这些问题纳入企业已经使用的 IAM、VPC Service Controls、Cloud Logging 和 Cloud...

从车端服务发现到云端智能体:用 AAOS、Bigtable 与 Nexus SDV 构建 AI 定义汽车

来源: cloud.google.com 24
汽车软件架构正在从“每个 ECU 各管一摊”转向可发现、可组合、可持续演进的服务体系。AAOS SDV 负责把车内非安全关键能力抽象为服务,Nexus SDV 连接车辆与云端,Bigtable 承接高频遥测,Gemini 与 Agent Development Kit(ADK)则把数据分析推进到推理和行动阶段。真正的变化不只是车辆联网,而是让车辆成为能...

用 k8s-aibom 盘点 Kubernetes 中真实运行的 AI 资产

来源: cloud.google.com 22
AI 供应链管理有一个长期盲区:构建系统知道团队计划部署什么,安全平台却未必知道集群此刻真正运行着什么。开发者直接部署的 vLLM、Triton、LangChain 或向量数据库,可能没有登记到资产台账,也可能绕过只扫描制品仓库的传统工具。 开源的 k8s-aibom 试图补上运行时这一层。它以非特权 Kubernetes 控制器运行,通过观察集群 A...

22 秒攻击交接之后:公共部门如何建立机器速度的持续验证防线

来源: cloud.google.com 36
2026 年公共部门面临的安全问题,已经不再是如何守住一条清晰的网络边界,而是如何保护身份、终端、SaaS 集成、虚拟化管理面和运维人员之间不断变化的信任关系。基于 Mandiant 在 2025 年超过 50 万小时的一线事件调查,最新报告给出了一个尤其严峻的数字:初始访问经纪人建立立足点后,向勒索软件操作者交接的中位时间只有 22 秒。 这意味着,...

用云区域提示优化 Smart Tiered Cache 上层缓存选择

来源: blog.cloudflare.com 31
当源站部署在 AWS、Google Cloud、Azure 或 Oracle Cloud 的特定区域时,Smart Tiered Cache 现在可以利用客户提供的云区域提示,更精确地选择上层缓存节点。这个变化看似只是增加了一项位置元数据,实际影响的是回源路径:上层缓存越贴近源站,跨区域请求、回源延迟和不必要的公网传输通常就越容易控制。 分层缓存通常把...

Apple 把 Private Cloud Compute 扩到 Google Cloud:机密 AI 基础设施进入多云验证阶段

来源: infoq.com 25
Apple 首次选择在自有数据中心之外运行 Private Cloud Compute,而落点是 Google Cloud。这个合作的重点不只是“多了一个云供应商”,而是 Apple 把面向隐私敏感 AI 计算的信任模型,扩展到了第三方云环境:NVIDIA Blackwell GPU、Intel TDX、Google Titan 芯片,以及 Apple...

Google Workspace CLI:用 Rust 写的统一命令行,100+ 技能一把梭

来源: infoq.com 33
Google 刚放出一个专门针对 Workspace 的命令行工具——把 Drive、Gmail、Calendar 等服务的操作收进同一个 CLI,还内置了超过 100 个打包好的 skill。最值得注意的点:它用 Rust 构建,能动态适配 API 变化,而不是靠硬编码的接口描述文件。这意味着 Google 那边 API 一改,CLI 这边不用等新版...

云平台控制面单点依赖的代价:Railway 八小时全平台宕机复盘

来源: infoq.com 45
一家托管了三百万用户工作负载的平台,被自家云厂商的自动化系统一键拔线——没有预警,没有人工确认,连邮件通知都是事后才到。这就是 Railway 在 Google Cloud 上遭遇的真实事故:GCP 的自动化风控系统直接冻结了 Railway 的生产账号,导致整个平台瘫痪八小时,而受影响的不仅是 GCP 上的工作负载,连部署在 AWS 和裸金属服务器上...