来源: aws.amazon.com
37
多 Region 灾备方案真正难的地方,不是把基础设施复制到另一个 Region,而是证明故障发生时,Terraform Enterprise 能否在可接受的时间内恢复,并且不会丢失关键状态。AWS、HashiCorp 与 Athenahealth 通过 AWS Fault Injection Service(AWS FIS)设计并执行了分阶段的故障注...
来源: aws.amazon.com
33
2026 年 8 月,AWS 面向 AI 开发者的一批更新集中落在三个方向:更大的模型上下文、更持久的智能体运行环境,以及从云端向政府区域和物理设备扩展的部署能力。涉及的产品包括 Amazon Bedrock、Amazon Bedrock AgentCore 和 Strands,其中包括 OpenAI 模型的百万 Token 上下文、跨区域推理、最长可...
来源: aws.amazon.com
43
Heurist Finance 把投资研究从“聊天问答”推进成了一个可以执行任务的 AI 工作台。用户可以用自然语言提出研究问题,系统按需购买高级市场数据,在隔离沙箱中运行分析,并记录每一次关键动作。 这套方案的重点不只是接入一个大模型,而是把支付、身份、记忆、代码执行和可观测性放进同一个代理运行环境。对于小团队来说,这种组合能减少自建基础设施的范围,...
来源: aws.amazon.com
28
TorchServe 已不再维护,继续使用它意味着团队需要自行承担推理服务、GPU 运行时、依赖版本和故障排查的全部责任。对于已经运行在 Amazon EKS 上的团队,AWS Ray Serve Deep Learning Container(DLC)提供了一条更稳妥的迁移路径:把框架、GPU 驱动相关运行时和服务层预先组装在受支持、经过测试的容器中...
来源: aws.amazon.com
28
Amazon Quick 的自定义权限可以按用户开关功能,把“所有人都能用”改成“每个人只能用到需要的部分”。真正困难的地方不在于创建一组权限,而在于让权限贯穿用户注册、角色分配、事件处理和历史用户治理这条完整生命周期。 本文整理四种可落地的自动化模式:在 调用时指定权限、配置账户或角色默认值、通过 Amazon EventBridge 与 AWS L...
来源: aws.amazon.com
43
OpenAI 的 GPT-6 Astra 现已在 Amazon Bedrock 正式可用。对已经把身份权限、审计、网络和模型调用统一放在 AWS 上的团队而言,这意味着可以通过 Bedrock 的推理基础设施,将更强的推理与判断能力用于复杂任务,而不必额外维护一套独立的模型服务接入层。 “正式可用”解决的是采购和生产接入问题,却不等于模型会自动改善业务...
来源: aws.amazon.com
31
大语言模型通常把“思考过程”展开成一串 chain-of-thought(CoT)文本,而 Pathway 的 Baby Dragon Hatchling(BDH)选择了另一条路线:让推理发生在潜空间中,不必逐步输出推理 token。这种脑启发、后 Transformer 架构不仅改变了推理接口,也改变了训练、评测和基础设施优化的重点。Pathway ...
来源: aws.amazon.com
21
大语言模型通常通过不断生成 token 来展开推理,而 Pathway 的 Baby Dragon Hatchling(BDH)选择了另一条路线:它是一种受大脑启发的后 Transformer 架构,在潜空间中进行推理,而不是把完整的思维链逐 token 输出。这个变化不仅影响模型结构,也会改变训练、扩展和成本评估的方式。 Pathway 在 Amaz...
来源: aws.amazon.com
46
Amazon SageMaker Feature Store 新增了 API。应用现在可以在一次请求中更新一项或多项特征值,不必先读取整条记录,再把未修改的字段原样写回。 这项能力同时适用于两种在线存储层:基于 Amazon DynamoDB 的 Standard tier,以及基于 Amazon ElastiCache 的 In-Memory tie...
来源: aws.amazon.com
38
自动把 MLflow 模型注册到 Amazon SageMaker AI Model Registry,只解决了“模型如何进入注册表”的问题。当开发、治理和生产环境分布在不同 AWS 账户后,真正棘手的是:谁拥有模型组、谁可以修改审批状态、推理制品放在哪里,以及账户被回收后模型是否仍可部署。 围绕跨账户治理,可以考虑两种拓扑:通过 AWS Resour...