2026-09-05
来源: infoq.com
37
零信任解决的是“默认不信任、持续验证”的访问问题,但自主 AI 代理把问题推向了更细的粒度:一个代理可能代表用户读取邮件、修改代码、调用支付接口,甚至连续执行数十个工具动作。Google 在 BeyondCorp 之后提出 Beyond Zero,将零信任扩展到 AI 时代,核心变化是把访问决策从“应用能不能访问”推进到“某个主体能否对某个资源执行某个...
2026-09-05
来源: infoq.com
42
零信任解决的是“每次访问都要验证”的问题,但自主 AI 智能体带来了更细的安全挑战:它可能代表用户调用多个服务、读取不同资源,并根据上下文连续执行动作。Google 在最新研究中提出 Beyond Zero,将零信任模型扩展到 AI 时代,把访问决策从应用级别推进到具体资源和具体动作。 这意味着安全策略不再只回答“这个身份能否访问这个应用”,还要回答“...
2026-09-05
来源: oschina.net
39
当远程运维同时涉及 Shell、文件传输、数据库、容器和远程桌面时,工程师往往需要在多个客户端之间反复切换。uniTerm 试图把这些入口集中到一个轻量应用中:Windows 安装包仅约 14MB,并在 v1.9 中加入 Elasticsearch、WSLC 容器和 Raw TCP,将支持的协议扩展到 30 种以上,同时补充文件与监控边栏。 uniTe...
2026-09-05
来源: aws.amazon.com
40
WhatsApp 商业账号通常不缺消息入口,真正困难的是让文本、语音留言和实时语音通话共享同一套点单逻辑。基于 Amazon Bedrock AgentCore 与 Amazon Nova 2,可以把三个渠道统一接入一个业务代理,同时保持渠道层和订单层解耦,并通过共享记忆识别跨渠道出现的同一位顾客。 三类输入看似都来自同一个 WhatsApp 号码,处...
2026-09-05
来源: kubernetes.io
47
Kubernetes v1.37 将 特性门控提升到 Beta,并默认开启。这个变化不会自动把现有集群变成 rootless 集群,但它标志着 Kubernetes 节点组件以非 root 用户运行的方案已经从长期实验阶段进入更稳定的使用阶段。 Rootless 模式的核心目标很明确:即使 kubelet、CRI、OCI runtime、CNI 插件或...
2026-09-05
来源: aws.amazon.com
40
长时间运行的 AI Agent 会不断积累用户偏好、任务结论和历史上下文。记忆越多并不等于效果越好:过时信息会干扰推理,重复事实会增加检索噪声,保留不再需要的敏感数据还会扩大合规风险。 针对 Amazon Bedrock AgentCore memory,可以把记忆治理设计成一条夜间批处理流水线:先评分,再合并,最后按策略清理。AWS Step Fun...
2026-09-05
来源: aws.amazon.com
35
HyperPod InstantStart 是一个开源控制平面,将 Amazon EKS 的 Kubernetes 编排能力与 Amazon SageMaker HyperPod 的托管能力组合起来。它解决的重点不只是“让 AI Agent 执行命令”,而是让集群初始化、容量管理、训练、推理和存储操作进入同一套受约束、可重复的执行路径,并同时提供 We...
2026-09-05
来源: aws.amazon.com
41
大规模灾难恢复的难点,不只是把流量切到备用区域,而是在高压环境下同时保证决策正确、操作可控、过程可追溯。Intuit 构建的 EWOK Agent 展示了一种实践方向:值班工程师用自然语言提出生产故障转移请求,智能体负责理解意图和协调执行,同时让每一步操作保持可审计、符合策略并具备安全边界。 这类系统的关键不是让大模型直接操作生产环境,而是把它放在受约...
2026-09-05
来源: cloud.google.com
38
数据库迁移真正棘手的部分,往往不是把历史数据复制到新库,而是在生产服务持续处理请求时,让新旧存储长期保持一致。Google 财务工程团队在迁移到 Spanner 时,需要为 30 多个 DAO 补齐转换器、双写分支、错误处理和单元测试。逐个手工修改不仅耗时,还容易在时间戳、空值和字段映射上产生细微偏差。 他们采用的办法,是先把迁移模式标准化,再通过 A...
2026-09-04
来源: cloud.google.com
39
把大语言模型从实验环境搬到生产系统后,模型参数量并不能单独决定吞吐和成本。同一套 TPU、同一个服务框架,面对“长输入、短输出”的分类请求和“短输入、长输出”的生成请求,可能呈现完全不同的扩展曲线。 这组测试在 Google Cloud TPU v6e 上运行 Gemma 3 12B 与 27B,使用 GKE Autopilot、单主机 2×2 TPU...