标签

AWS

Outpost VFX 如何用 AWS 多 GPU 训练把换脸模型提速 8 倍

来源: aws.amazon.com 28
视觉特效里的 AI 换脸不是“跑一个模型”那么简单。镜头多、角色多、光照和表情变化复杂,训练时间会直接影响制作排期。Outpost VFX 的案例值得关注:他们把原本受单 GPU 限制的换脸训练流程迁移到 AWS 多 GPU 基础设施上,训练速度提升到约 8 倍,让模型迭代从瓶颈变成可调度的生产能力。 换脸模型训练通常会遇到三个硬问题: 数据量大:一个...

用 Amazon Bedrock 蒸馏双语货运 NER:从大模型到可部署小模型

来源: aws.amazon.com 35
货运物流里的实体识别不是普通 NER。提单、航班、机场、ULD、商品描述、客户备注经常混着英文缩写、本地语言、行业黑话和不完整句子。来源文章分享了 IBS Software 使用 Amazon Bedrock 知识蒸馏能力构建双语货运 NER 的技术路线:用更强的教师模型生成 token 级标注,再训练更轻、更稳定、成本更可控的学生模型。 这类方案的价...

用 SageMaker 微调 Amazon Nova,让邮件抽取从“差不多”变成“字段级准确”

来源: aws.amazon.com 34
邮件数据抽取看起来像一个简单的文本理解任务:把发件人、订单号、金额、日期、地址、客户意图从邮件里拿出来。但真实业务邮件往往格式混乱、字段相似、表达重复,通用大模型很容易把“账单地址”和“收货地址”混在一起,或者把邮件正文里的历史引用当成最新请求。 这篇内容关注一个具体方向:用 Amazon SageMaker AI 微调 Amazon Nova 模型,...

AWS Lambda MicroVMs:给每个 Agent 一台隔离的 Firecracker 小虚机

来源: infoq.com 24
AWS 推出了 Lambda MicroVMs,这不是又一个普通的函数运行时,而是一个面向“每个用户会话、每个 AI Agent 都需要独立沙箱”的 serverless 计算原语。它把执行单元放进独立的 Firecracker 虚拟机里,强调硬件级隔离、基于快照的快速启动,以及最长 8 小时的状态保留。 这件事之所以值得关注,是因为 AI Agent...

给 Amazon QuickSight BI 资产做一套可恢复的备份方案

来源: aws.amazon.com 37
QuickSight 里的仪表板、分析、数据集、数据源和主题一旦进入生产,就不只是“报表配置”,而是 BI 交付链路的一部分。备份策略的目标不是把所有东西定期导出那么简单,而是在误删、错误发布、跨账号迁移或灾难恢复时,能明确知道备份了什么、在哪里、能不能恢复。 QuickSight 资产之间有依赖关系。一个 dashboard 可能依赖 analysi...

用 Nova 2 Lite 和 Claude 搭一条低成本扫描件数字化流水线

来源: aws.amazon.com 27
扫描件数字化最容易被低估的地方,不是 OCR 本身,而是“页面上这些文字到底对应哪张脸、哪个表格、哪个区域”。这篇方案的核心变化是把任务拆给两个模型:Amazon Nova 2 Lite 先做原生多模态抽取,在一次调用里识别照片、可见姓名、坐标和页面级元数据;Claude Sonnet 4.6 再根据版面做空间推理,把名字和人脸配对。这样既控制成本,也...

用三道防线构建多租户 LLM 分析系统:SigV4、语义校验与行级隔离

来源: aws.amazon.com 37
多租户分析系统接入 LLM 后,最危险的变化不是“模型会不会答错”,而是“模型会不会被诱导越权”。如果一个租户通过自然语言问出了另一个租户的数据,传统的应用层权限判断很容易被 prompt injection、工具调用参数污染或 SQL 生成错误绕过。 PAR 的做法值得关注:他们把安全边界拆成三层,而且每一层都独立工作。请求入口用 AWS SigV4...

用 Amazon Bedrock 和 AWS HealthLake 搭建智能理赔流水线

来源: aws.amazon.com 34
医疗理赔处理最怕两件事:表单信息散落在 PDF、扫描件和附件里,人工录入又慢又容易出错。这个方案的核心变化是把“读单据、抽字段、校验、转成标准医疗数据”串成一条自动化流水线:Amazon Bedrock Data Automation 负责从理赔表单中提取结构化信息,Amazon Bedrock AgentCore 托管 AI Agent 来做校验和转...

用 Amazon Bedrock AgentCore Observability 排查生产 Agent 故障

来源: aws.amazon.com 25
Agent 进入生产环境后,最难处理的不是“模型答错了”这种显性问题,而是它为什么反复调用同一个工具、为什么一次工具调用没有返回、为什么用户看到超时但后端日志看起来正常。Amazon Bedrock AgentCore Observability 的价值就在这里:把 Agent 的执行轨迹、工具调用和运行指标放到同一个可分析的上下文里,让排障从猜测变成...

把 Lambda 扩到百万级:Serverless SaaS 真正难的是配额、账户和归零

来源: aws.amazon.com 32
当一个 Serverless SaaS 平台从几千个 Lambda 函数增长到超过一百万个函数时,问题会从“函数怎么写”变成“系统怎么活”。来源摘要里提到的几个经验很关键:真正的 scale-to-zero、配额管理、多账户架构,以及尽早和 AWS 服务团队沟通。这些不是架构图上的装饰,而是大规模运行时避免账单失控、部署卡死和突发故障的基本功。 Ser...