标签

后端

Beyond Zero:把零信任推进到 AI 代理的每个动作

来源: infoq.com 41
零信任解决的是“默认不信任、持续验证”的访问问题,但自主 AI 代理把问题推向了更细的粒度:一个代理可能代表用户读取邮件、修改代码、调用支付接口,甚至连续执行数十个工具动作。Google 在 BeyondCorp 之后提出 Beyond Zero,将零信任扩展到 AI 时代,核心变化是把访问决策从“应用能不能访问”推进到“某个主体能否对某个资源执行某个...

Beyond Zero:面向 AI 智能体的下一代零信任安全模型

来源: infoq.com 44
零信任解决的是“每次访问都要验证”的问题,但自主 AI 智能体带来了更细的安全挑战:它可能代表用户调用多个服务、读取不同资源,并根据上下文连续执行动作。Google 在最新研究中提出 Beyond Zero,将零信任模型扩展到 AI 时代,把访问决策从应用级别推进到具体资源和具体动作。 这意味着安全策略不再只回答“这个身份能否访问这个应用”,还要回答“...

Blume:把 Markdown 目录直接变成 AI 友好的文档站

来源: infoq.com 33
搭建文档站经常不是难在写内容,而是难在维护脚手架、导航、SEO、构建配置和迁移工具。Blume 试图缩短这条链路:只需要 Node.js 和一份 Markdown 文档,就能从内容目录生成完整网站。它基于 Astro 与 Vite,既保留静态内容的简单性,也为后续定制和工程化构建留下空间。 传统文档系统通常要求团队先选择主题、编写站点配置、维护路由,再...

Kubernetes v1.37:KubeletInUserNamespace Beta 化,Rootless 节点走向生产

来源: kubernetes.io 50
Kubernetes v1.37 将 特性门控提升到 Beta,并默认开启。这个变化不会自动把现有集群变成 rootless 集群,但它标志着 Kubernetes 节点组件以非 root 用户运行的方案已经从长期实验阶段进入更稳定的使用阶段。 Rootless 模式的核心目标很明确:即使 kubelet、CRI、OCI runtime、CNI 插件或...

在 SageMaker HyperPod 上搭建 NVIDIA Cosmos 3 Physical AI 模型工厂

来源: aws.amazon.com 33
Physical AI 系统不是提交一次训练任务就能完成的工程。合成数据生成、后训练、评估、失败样本回流和再次训练会持续循环,而且每个阶段对 GPU、存储和调度的要求都不同。NVIDIA Cosmos 3 可以承担这条流水线中的模型与数据处理工作,而运行在 Amazon EKS 上的 SageMaker HyperPod 则提供持久、具备故障恢复能力的...

用弹性 VM 与跨可用区调度提高 Spark 集群创建成功率

来源: cloud.google.com 41
对持续运行的大规模分析平台来说,Spark 作业能否按时开始,往往不只取决于代码和数据,还取决于指定规格的虚拟机当时是否有库存。固定机型、固定可用区的配置看似确定,遇到区域容量波动时却可能让整个数据管道停在集群创建阶段。 Yahoo 在 Google Cloud Managed Service for Apache Spark(原 Dataproc)中...

用 Antigravity CLI 批量改造 DAO:把 Spanner 双写迁移变成可验证的流水线

来源: cloud.google.com 41
数据库迁移真正棘手的部分,往往不是把历史数据复制到新库,而是在生产服务持续处理请求时,让新旧存储长期保持一致。Google 财务工程团队在迁移到 Spanner 时,需要为 30 多个 DAO 补齐转换器、双写分支、错误处理和单元测试。逐个手工修改不仅耗时,还容易在时间戳、空值和字段映射上产生细微偏差。 他们采用的办法,是先把迁移模式标准化,再通过 A...

TPU 上的 LLM 推理为何会撞墙:Gemma 3 分类与生成负载实测解析

来源: cloud.google.com 44
把大语言模型从实验环境搬到生产系统后,模型参数量并不能单独决定吞吐和成本。同一套 TPU、同一个服务框架,面对“长输入、短输出”的分类请求和“短输入、长输出”的生成请求,可能呈现完全不同的扩展曲线。 这组测试在 Google Cloud TPU v6e 上运行 Gemma 3 12B 与 27B,使用 GKE Autopilot、单主机 2×2 TPU...

把认证流程交给服务端:Airbnb 如何减少 60% 认证代码

来源: infoq.com 36
认证系统很容易变成客户端里的条件判断迷宫:不同地区支持不同登录方式,高风险请求需要额外验证,新用户与老用户走不同路径,Web、iOS 和 Android 又分别实现一遍。Airbnb 将认证架构改造成服务端驱动流程,并通过策略选择验证挑战。根据来源摘要,这套 Flexible Authentication 系统减少了 60% 的认证相关代码,使 Web...

用四类小任务检验 GPT-6 Astra 的 Python 实战能力

来源: realpython.com 48
让 AI 写一个排序函数并不难,真正有区分度的是那些规模很小、要求却不完全明确的任务。GPT-6 Astra 接受了一组带有 Real Python 风格的“手感测试”:用 Turtle 画一条正在读书的蟒蛇、判断一段 Python 代码的年代、完成一次微小修改,以及处理一个并不存在的函数。 这四类任务分别触碰了生成式编程助手的不同能力:把自然语言转成...