2026-09-05
来源: aws.amazon.com
35
HyperPod InstantStart 是一个开源控制平面,将 Amazon EKS 的 Kubernetes 编排能力与 Amazon SageMaker HyperPod 的托管能力组合起来。它解决的重点不只是“让 AI Agent 执行命令”,而是让集群初始化、容量管理、训练、推理和存储操作进入同一套受约束、可重复的执行路径,并同时提供 We...
2026-09-05
来源: aws.amazon.com
34
把 PDF 直接放进知识库,并不等于文档已经被正确理解。面对跨页表格、扫描图片、多栏排版和字段密集的水电账单,检索质量往往先受制于文本提取,而不是大语言模型本身。 一种更稳妥的处理方式,是把 Amazon Textract 放在 Amazon Bedrock Knowledge Bases 之前:先提取页面文本、表格与表单字段,再将标准化结果写入知识库...
2026-09-05
来源: aws.amazon.com
41
大规模灾难恢复的难点,不只是把流量切到备用区域,而是在高压环境下同时保证决策正确、操作可控、过程可追溯。Intuit 构建的 EWOK Agent 展示了一种实践方向:值班工程师用自然语言提出生产故障转移请求,智能体负责理解意图和协调执行,同时让每一步操作保持可审计、符合策略并具备安全边界。 这类系统的关键不是让大模型直接操作生产环境,而是把它放在受约...
2026-09-05
来源: cloud.google.com
39
对持续运行的大规模分析平台来说,Spark 作业能否按时开始,往往不只取决于代码和数据,还取决于指定规格的虚拟机当时是否有库存。固定机型、固定可用区的配置看似确定,遇到区域容量波动时却可能让整个数据管道停在集群创建阶段。 Yahoo 在 Google Cloud Managed Service for Apache Spark(原 Dataproc)中...
2026-09-05
来源: cloud.google.com
38
数据库迁移真正棘手的部分,往往不是把历史数据复制到新库,而是在生产服务持续处理请求时,让新旧存储长期保持一致。Google 财务工程团队在迁移到 Spanner 时,需要为 30 多个 DAO 补齐转换器、双写分支、错误处理和单元测试。逐个手工修改不仅耗时,还容易在时间戳、空值和字段映射上产生细微偏差。 他们采用的办法,是先把迁移模式标准化,再通过 A...
2026-09-04
来源: cloud.google.com
39
把大语言模型从实验环境搬到生产系统后,模型参数量并不能单独决定吞吐和成本。同一套 TPU、同一个服务框架,面对“长输入、短输出”的分类请求和“短输入、长输出”的生成请求,可能呈现完全不同的扩展曲线。 这组测试在 Google Cloud TPU v6e 上运行 Gemma 3 12B 与 27B,使用 GKE Autopilot、单主机 2×2 TPU...
2026-09-04
来源: realpython.com
46
让 AI 写一个排序函数并不难,真正有区分度的是那些规模很小、要求却不完全明确的任务。GPT-6 Astra 接受了一组带有 Real Python 风格的“手感测试”:用 Turtle 画一条正在读书的蟒蛇、判断一段 Python 代码的年代、完成一次微小修改,以及处理一个并不存在的函数。 这四类任务分别触碰了生成式编程助手的不同能力:把自然语言转成...
2026-09-04
来源: infoq.com
32
GitHub Copilot 代码审查现已面向所有 Azure DevOps 客户开放,并可用于 Azure Repos。这个变化照顾了暂时无法迁移到 GitHub 的团队,但也引入了一套需要单独治理的运行模型:审查按次计费、费用经关联的 Azure 订阅结算、成本数据最多延迟约 48 小时出现,而且每个组织最多只能同时执行五次审查。 这意味着团队不能...
2026-09-04
来源: infoq.com
35
Microsoft 已向所有 Azure DevOps 客户开放 GitHub Copilot code review for Azure Repos。这项变化很现实:不少团队短期内不会迁移到 GitHub,但仍希望在现有 Azure Repos 拉取请求流程中引入 AI 审查。 真正需要工程团队关注的,不只是功能是否可用,而是它的计费和容量模型:审查...
2026-09-04
来源: blog.cloudflare.com
48
传统漏洞扫描擅长回答“代码里可能有什么问题”,却不一定知道“攻击者此刻正在打哪里”。Cloudflare 将 Managed Defense 的 WAF 数据、生产流量和安全信号与 OpenAI Daybreak 模型结合,让漏洞发现从静态告警列表转向上下文驱动的处置流程:优先确认正在被利用或暴露程度较高的问题,在安全条件允许时准备边缘缓解规则,同时生...