2026-07-14
来源: aws.amazon.com
22
生成式 AI 模型能否稳定上线,往往不取决于一次调用是否成功,而取决于实例类型、并发量、延迟和成本能否形成可接受的组合。Amazon SageMaker AI Studio 新增了面向生成式 AI 推理推荐的可视化界面,把原本需要通过 API 配置参数、读取原始基准测试结果的流程,变成由用例预设、图表比较和一键部署串联起来的低代码体验。 已有 API ...
2026-07-13
来源: infoq.com
35
一套 API 即使部署在多个 AWS 区域,也不等于已经具备全局故障转移能力。连续发生的区域故障迫使团队重新检查请求链路,最终发现阻碍并不在主业务 API,而是藏在客户端会话初始化阶段:每次会话都会先发起一次预检发现请求,再根据返回结果访问真正的 API。 这个调用源于多年前的技术限制,当时它可能是唯一可行的接入方式。多年后,服务端已经演进,客户端却继...
2026-07-13
来源: aws.amazon.com
42
零售、银行、快餐、便利店和交通网络正在持续产生海量监控视频。当摄像头分散在数千个地点、数据规模进入 PB 级、留存周期不断延长时,传统本地存储面对的不只是容量不足,还包括设备维护、跨站点检索、数据保护和成本预测等问题。March Networks 将云存储与 AWS 结合,反映出企业视频平台正在从“每个站点各自保存录像”转向集中管理、按策略分层的存储模...
2026-07-13
来源: aws.amazon.com
36
保险欺诈不仅推高赔付成本,还会挤占调查团队的处理能力。MAPFRE USA 使用 Amazon EMR Serverless 推进欺诈理赔分析现代化,反映出一个明确趋势:保险公司正在把依赖固定规则、人工触发和历史结构化数据的流程,转向可弹性扩展的数据处理平台。 来源摘要没有披露 MAPFRE USA 的完整架构、模型算法或性能指标,因此下面不会推测其内...
2026-07-10
来源: aws.amazon.com
19
NVIDIA Nemotron 3 的定制不再意味着团队必须先搭建训练集群、编写分布式启动脚本,再长期维护 GPU 基础设施。Amazon SageMaker AI 的无服务器模型定制把更多资源调度工作交给平台,让开发者可以在 SageMaker Studio 中围绕数据集、微调策略和评估结果推进实验。真正需要工程团队把握的,是模型架构适配、训练数据质...
2026-07-10
来源: aws.amazon.com
34
牙科 X 光片的质量问题,往往要到医生查看或后续流程中才暴露。此时患者可能已经离开拍摄位置,重新拍摄会增加等待时间、操作成本和不必要的辐射暴露。Henry Schein One 构建的 Image Verify 将 AI 质量验证前移到影像采集时:系统基于 Amazon SageMaker AI 实时评估 X 光片,并把结果反馈给现场人员。 这套系统在...
2026-07-10
来源: aws.amazon.com
39
企业数据很少整齐地待在一个系统里:客户主数据和交易记录可能位于 Amazon Aurora,分析结果、行为指标又沉淀在 Amazon Redshift。传统客户 360 项目通常先复制数据、统一字段,再交给应用查询;这篇方案展示了另一条路径:让 Stardog 在两个数据源之上提供统一语义层,再由运行在 Amazon Bedrock AgentCore...
2026-07-10
来源: aws.amazon.com
20
智能体工作流进入企业生产环境后,难点很快会从“模型能否完成任务”转向“任务由谁负责、处理到哪一步、异常如何恢复、何时需要人工介入”。Amazon Quick Automate 的原生案件管理把每项业务工作包装成可跟踪的 case,并将创建、处理、人工审核和解决串成完整生命周期,使自动化能够从单次演示扩展到持续运行的企业流程。 普通自动化常把一次输入直接...
2026-07-10
来源: aws.amazon.com
41
模型完成量化,只解决了显存占用和推理成本的一部分问题。真正进入生产环境时,还要决定由谁管理实例、如何扩缩容、怎样接入现有容器平台,以及如何监控冷启动、显存和请求延迟。对于已经通过 Unsloth 量化的模型,可以根据团队现有基础设施,在 Amazon EC2、Amazon SageMaker AI 推理端点、Amazon EKS 和 Amazon EC...
2026-07-10
来源: aws.amazon.com
42
KTern.AI 从传统 SaaS 平台转向智能体 AI 平台时,面对的并不是简单地给产品接入一个大模型。SAP 转型项目往往持续数月甚至更久,涉及需求分析、流程设计、测试、迁移和上线等阶段。系统需要让多个专业智能体协同工作,同时保留持久上下文、限制工具权限,并达到企业生产环境要求的可靠性。 KTern.AI 选择 Amazon Bedrock Age...