标签

AWS

让 Amazon Bedrock 知识库理解视频:用 Marengo 3.0 做多媒体语义搜索

来源: aws.amazon.com 35
过去,知识库检索通常围绕 PDF、网页和纯文本展开。现在,TwelveLabs Marengo Embed 3.0 已在 Amazon Bedrock Knowledge Bases 中正式可用,应用可以用自然语言搜索视频、图片和音频内容,而不必先为每种媒体单独搭建一套索引服务。 这项能力的价值不只是"给视频加个向量"。它把媒体内容纳入了知识库的检索链...

Amazon Quick 桌面版正式可用:企业 AI 助手开始进入日常工作流

来源: aws.amazon.com 36
Amazon Quick 桌面应用现已在 macOS 和 Windows 上正式可用。相比停留在浏览器标签页中的聊天工具,桌面客户端更容易进入员工每天处理邮件、会议和客户信息的工作路径。与此同时,iOS 与 Android 移动端新增活动信息流,用于集中呈现来自邮件、日历和 CRM 等系统的信息。 这次更新的重点并不只是多了几个客户端,而是让 AI 助...

用 DynamoDB 分布式租约构建可自动接管的 Fargate WebSocket 工作集群

来源: aws.amazon.com 26
实时流处理服务经常需要维护数百条持久 WebSocket 连接。把这些连接分散到 Amazon ECS 和 AWS Fargate 任务后,单个任务崩溃、扩缩容或滚动发布都可能让部分数据流暂时无人消费。解决问题的关键不是保存 WebSocket 连接本身,而是把每条逻辑数据流的所有权、租约期限和消费进度放进一个可协调、可恢复的控制面。 DynamoDB...

用 Amazon Quick Automate 把多工作表 RFI 问卷自动整理为 CSV

来源: aws.amazon.com 30
RFI(信息请求)问卷经常以 Excel 工作簿流转:不同主题分散在多个工作表里,表头位置不统一,还夹杂说明文字、合并单元格和空行。真正费时间的往往不是读取文件,而是判断哪些行属于问题、如何统一字段,以及怎样输出可供后续系统消费的结构化数据。 Amazon Quick Automate 提供了一条更短的实现路径:从 Amazon S3 读取多工作表 R...

用 Amazon Bedrock 构建与模型无关的 PII 检测器

来源: aws.amazon.com 30
PII 检测不应该被某个固定模型或写死的实体列表绑住。这个方案的核心思路很直接:把待识别的实体类型放进提示词,把 Amazon Bedrock 上的任意大型语言模型当作检测引擎。这样,新增“客户编号”“内部项目代号”或某类业务敏感字段时,主要修改配置和提示词,不需要重新训练检测模型。 传统 PII 检测器通常在代码、规则或模型标签中固定实体集合,例如姓...

用 AEM 拆解多轮 Agent 失败:找到真正出错的那一轮

来源: aws.amazon.com 37
多轮 Agent 的失败通常不是“最后一轮突然答错”这么简单。一个早期决策如果写错了状态、误解了用户意图,或者调用了错误的工具,后续多轮可能只是沿着错误前提继续推理。只看最终结果,评估者很难判断问题究竟发生在哪里。 Agent Evaluation Metric(AEM)提供了一种更适合多轮对话的拆解方式:把 Agent 质量按轮次观察,并将“造成失败...

用 Amazon Bedrock AgentCore 把航班运行数据变成可执行的周转洞察

来源: aws.amazon.com 42
航班周转延误往往不是某一个环节单独失效,而是登机、行李、加油、清洁、机组和放行等多个事件在时间线上相互影响。AvioBook 是 Thales Group 旗下公司,其 Connected Analytics 原型展示了一种实用方向:基于 AvioBook Connect 的运行数据,通过 Amazon Bedrock AgentCore 生成面向航空...

在 Amazon SageMaker HyperPod 上用 vLLM 部署 Qwen3.8-2.4T-A95B

来源: aws.amazon.com 38
Qwen3.8-2.4T-A95B 是一个拥有 2.4 万亿参数的开放权重模型。要把这类模型稳定地运行起来,难点不只是启动一个容器,还包括多节点 GPU 集群规划、模型权重分发、NVFP4 量化、推理并行,以及如何把推理、工具调用和 MTP 投机解码暴露成可用的 API。 Amazon SageMaker HyperPod 负责提供可扩展的训练和推理基...

用 AWS FIS 和 SQS 做渐进式混沌实验,验证应用韧性

来源: aws.amazon.com 40
重试逻辑、熔断器和死信队列,不能只在代码评审或单元测试中“看起来正确”。应用真正遇到消息积压、消费者异常或下游不可用时,系统是否能降级、恢复并保留失败消息,需要通过接近真实环境的故障实验来验证。 AWS Fault Injection Service(FIS)可以注入受控故障,AWS Systems Manager Automation 则适合编排渐进...