标签

LLM

AP+ 用 ChatGPT Enterprise 和 Codex 加速支付系统交付

来源: openai.com 32
支付系统的复杂度不在“写几行代码”,而在规则、兼容性、审计、异常路径和人工判断同时存在。Australian Payments Plus(AP+)把 ChatGPT Enterprise 和 Codex 放进工程与业务协作流程里,目标不是让 AI 替人拍板,而是在复杂支付场景中更快梳理问题、生成候选实现、提升交付质量,并把最终判断留给人。 AP+ 面对...

PyTorch Monarch 登上 AMD GPU:用单控制器思路管理 ROCm 分布式训练

来源: pytorch.org 44
大模型训练已经不是“把脚本丢到几张卡上跑完”这么简单。数十亿参数模型往往要跨数百甚至数千张 GPU 训练,在这个规模下,硬件故障、节点掉线、通信抖动都不是意外,而是日常。PyTorch Monarch 被带到 AMD GPU 和 ROCm 生态中,重点并不只是“多支持一种硬件”,而是把单控制器分布式训练的编排方式带进 AMD GPU 集群。 传统分布式...

在 Amazon Bedrock 上调用 MiniMax:从长上下文到 Agent 工作流

来源: aws.amazon.com 40
MiniMax 模型进入 Amazon Bedrock 后,开发者可以在 AWS 的托管边界内使用这些模型构建 Agent 应用、长上下文文档分析流水线,以及软件工程辅助流程。变化的重点不只是“多了一个模型”,而是模型访问、扩缩容、安全控制和运维接入都可以走 Bedrock 这一套成熟路径。 直接接入模型 API 时,团队通常要自己处理鉴权、网络边界、...

用 SageMaker HyperPod 搭起 Amazon Nova 多轮强化学习流水线

来源: aws.amazon.com 43
多轮强化学习的麻烦不只在算法本身,还在训练基础设施:数据来了以后谁触发任务、集群资源怎么准备、训练脚本如何拿到 S3 数据、一次 Wordle 这种多轮环境的交互日志如何进入训练闭环。这个方案的核心变化是把 Amazon Nova Forge 和 Amazon SageMaker HyperPod 组合起来,用两阶段基础设施部署出一个事件驱动流水线:向...

PRX 的数据策略:先把事件、血缘和质量闸门立住

来源: huggingface.co 34
“PRX Part 4: Our Data Strategy”这个标题透露的信息很克制:这是一组系列文章里的第四篇,主题从产品或架构推进到了数据策略。摘要没有给出实现细节,所以本文不把具体方案包装成原文事实,而是围绕一个工程团队在 PRX 这类项目中可以如何落地数据策略来拆解:先定义数据契约,再建立可追踪的数据流,最后用质量检查挡住坏数据进入核心指标。...

面向受监管行业的 AI 安全与隐私工程:别等上线后再补课

来源: infoq.com 33
InfoQ 开放了一个为期五周的 AI Security & Privacy Engineering cohort,目标人群是受监管行业里的资深工程师和架构师。这个方向值得关注,不是因为“AI 安全”又多了一个课程名,而是因为生产级 AI 系统已经把安全、隐私、威胁建模、可观测性和治理揉成了同一个工程问题:模型调用、提示词、检索数据、用户输入、...

LeRobot v0.6.0 把机器人开发推向“想象、评估、改进”闭环

来源: huggingface.co 36
LeRobot v0.6.0 的发布标题是 “Imagine, Evaluate, Improve”。在缺少更多发布细节的前提下,最值得抓住的是这个方向:机器人学习不再只是“收集数据、训练模型、部署试试”,而是更强调一个可重复的工程闭环:先生成或设想任务与策略,再用指标评估,再把结果反馈到数据、模型和环境配置里。 “Imagine” 对机器人团队很关键...

看懂 PostgreSQL 的 .ready 和 .done:WAL 归档到底卡在哪里

来源: postgr.es 38
当 里堆满 文件时,很多人的第一反应是“复制坏了”。但 和 指向的不是流复制本身,而是 PostgreSQL 本地归档进程对 的排队和完成记录。把这层关系拆清楚,排查 WAL 暴涨会快很多。 可以把 WAL 交付拆成三件事: 生成 WAL 传输 WAL 回放或消费 WAL 是“传输 WAL”的一种方式。流复制也是一种方式。逻辑复制也有传输通道,但它传的...

Meta 放慢 AI Agent 预期后,团队该怎么重新校准 Agent 项目

来源: oschina.net 33
扎克伯格在 Meta 内部会上承认,过去几个月 AI Agent 的发展没有按预期加速。这个信号值得开发团队认真看:不是 Agent 不重要,而是把它当成“马上能自我完成复杂工作”的万能组件,风险正在变高。尤其在巨额基础设施投入背后,真正难的不是多跑几个模型调用,而是让 Agent 在目标分解、工具调用、状态管理和错误恢复上稳定工作。 从来源摘要看,核...

x402 把 HTTP 402 重新带回边缘网络:Agent 调 API 也能按次付费

来源: infoq.com 41
Cloudflare 和 AWS 在两周内都把 x402 稳定币微支付能力放进了边缘网络,这件事值得后端和平台工程师关注。它不是又一个“支付按钮”,而是试图把 HTTP 402 这个长期闲置的状态码,变成 Agent 调用服务时的机器间结算协议:请求资源,发现需要付款,完成小额支付,再拿到结果。 x402 目前是 Linux Foundation 旗下...