标签

LLM

OpenRouter 加入 Stripe:LLM 统一接入层正在成为基础设施

来源: oschina.net 52
OpenRouter 正式加入 Stripe,这件事的意味不只是一次 AI 公司的并购或团队整合。一个长期被开发者称为“LLM 的 Stripe”的模型路由平台,如今成为 Stripe 的一部分,说明模型选择、调用路由、计费和供应商管理,正在从应用层的临时工程,变成 AI 产品需要依赖的基础设施。 OpenRouter 的公开规模也超过了许多人的直觉:...

用 Amazon Bedrock AgentCore 构建可持续运行的 AI 销售代理:从配方部署到弹性会话

来源: aws.amazon.com 41
AI 销售代理真正进入生产环境后,难点不再是“能不能生成一段像样的销售话术”,而是能否持续工作、稳定调用业务工具,并在大量并发会话中保持上下文。AgentFlo 的实践围绕 Amazon Bedrock AgentCore 和 Strands Agents SDK 展开,提炼出生产级代理的三个支柱:速度、标准化和可扩展性。 这三个目标彼此牵制。部署速度...

固定期限、设计资源不足:Stampli 如何用 ChatGPT Work 与 Codex 加速产品发布

来源: openai.com 35
产品发布最棘手的阶段,往往不是写出核心功能,而是在固定期限内完成页面、文案、代码、校验和交付物的最后一公里。Stampli 面临的约束很具体:发布日期已经确定,设计资源又投入到其他工作中。团队借助 Codex 和 ChatGPT Work,把原本需要数周的发布生产压缩到数天。 这个案例的价值不只是“AI 写得更快”。更关键的变化是,团队把发布工作拆成可...

AgentCore Web Search 新增按域名与发布日期过滤:让智能体只查可信且新鲜的内容

来源: aws.amazon.com 45
Amazon Bedrock AgentCore 的 Web Search 现在支持在运行时按域名和发布日期过滤搜索结果。开发者可以针对每一次请求决定智能体允许查询哪些网站、内容需要新到什么程度,而且这些约束由服务端执行。与此同时,Web Search 的可用区域扩展到了欧洲(爱尔兰)和亚太(东京)。 这次更新的关键不是“又多了两个搜索参数”,而是过滤...

在无服务器流水线中异步调用 Amazon Bedrock AgentCore Agent 的三种模式

来源: aws.amazon.com 35
当 Step Functions 调用 AI Agent 后需要等待较长时间,持续占用 Lambda 或其他计算资源会让流水线变贵,也会增加超时和重试处理的复杂度。针对 Amazon Bedrock AgentCore Agent,AWS 提供的思路是把“发起请求”和“等待结果”拆开,让 Agent 在后台处理,流水线只在真正需要时恢复执行。 本文围绕...

在 AWS 上构建多智能体客服:应对体育博彩的地域规则、实时风控与流量洪峰

来源: aws.amazon.com 41
体育博彩客服不是普通的 FAQ 系统。用户提出“为什么不能下注”时,答案可能取决于所在州、账户状态、赛事阶段和实时风控信号;涉及责任博彩的问题,还必须立即进入受控流程。Fanatics Betting and Gaming 因此在 AWS 上构建了多智能体客服系统,把复杂任务交给职责明确的专业智能体,并针对重大赛事期间的流量突增设计弹性架构。 体育博彩...

前沿模型的零数据保留:在安全处理与隐私之间取得平衡

来源: openai.com 39
对于处理敏感业务数据的团队来说,模型能力只是采购决策的一半,数据在调用后如何处理同样关键。OpenAI 再次确认,为符合条件的 API 客户提供 Zero Data Retention(零数据保留,ZDR),并预览 Private Safety Processing,让高级 AI 安全能力可以在不牺牲数据隐私的前提下继续运行。 普通 API 集成通常会...

面向前沿模型的零数据保留:在高级安全处理与隐私之间取得平衡

来源: openai.com 46
对于处理敏感代码、内部文档或客户数据的企业来说,是否保留 API 请求数据往往和模型能力同样重要。OpenAI 重申:符合条件的 API 客户可以使用 Zero Data Retention(ZDR,零数据保留),同时预览 Private Safety Processing,让更先进的 AI 安全能力能够在不牺牲数据隐私的前提下参与处理。 这项变化的重...

在 Google Cloud 上运行 Serverless Apache Spark:架构选择、成本调优与 AI 故障排查

来源: cloud.google.com 44
Apache Spark 仍然是企业级大数据处理的核心工具,但集群创建、YARN 调优、节点扩缩容以及闲置计算资源,会把数据工程团队拖入基础设施运维。Google Cloud 的 Managed Service for Apache Spark 提供了托管集群和 Serverless 两种路径,让团队可以根据工作负载、生态依赖、延迟要求和成本模型做出更...