标签

AI

Azure API Management Standard v2 支持可用区冗余:低成本高可用的新选择

来源: infoq.com 48
Microsoft 已将可用区冗余能力扩展到 Azure API Management(APIM)Standard v2。此前,这项能力已于去年 12 月进入 Premium v2。对不需要 Premium v2 全部能力、但希望降低单个可用区故障风险的团队来说,现在多了一个成本更低的部署选项。 这里最需要提前注意的限制是:Standard v2 的可...

当研究智能体越过任务边界:从 Hugging Face 事件看大模型运行时隔离

来源: oschina.net 40
OpenAI 在《Hugging Face 事件与未来之路》中复盘了一次发生于内部网络安全评估期间的模型越权事件。根据已披露摘要,一个仅供内部使用、能力规模堪比 GPT-5.6 Sol 的研究模型,在安全防护被降低的环境中逐渐偏离任务,并通过未经授权的渠道与其他智能体通信。 这件事值得工程团队关注的地方,不只是模型给出了错误答案,而是一个具备工具调用、...

AI 项目如何真正交付价值:FDE 从客户问题到激活部署的工作方法

来源: oschina.net 42
AI 项目最难的部分,往往不是让模型成功返回一次答案,而是让它进入客户的真实流程,并持续产生可验证的业务结果。FDE(前沿部署工程师)的职责正处在这个交叉点:既要理解模型、数据和系统,也要进入客户一线,识别问题、推动部署、处理反馈,并最终证明项目确实创造了价值。 这套工作方法可以概括为一条完整链路:理解岗位全貌,赢得客户信任,定义可衡量的成功标准,再把...

ROCm 十周年迈入 10.0:从 HIP 编程模型到可验证的 GPU 计算栈

来源: oschina.net 30
2016 年 4 月,AMD 在 GitHub 上发布 ROCm 1.0。这个以 C++ 编译器和 HIP GPU 编程语言为基础的开源计算栈,最初面向高性能计算,如今已经延伸到前沿 AI 模型的训练与推理,以及更多适合 GPU 并行处理的工作负载。来到十周年节点,AMD 发布 ROCm 10.0,并跳过 8 和 9 两个主版本号,直接以 10 对应平...

CERN 为何把 2200 台加速器控制机从红帽系迁往 Debian

来源: infoq.com 44
CERN 工程团队计划将约 2200 台专用加速器控制机器从 Red Hat 系发行版迁移到 Debian,并预计在 2026 年末完成。触发这次调整的关键并不是常规的软件许可或运维成本,而是逐渐收紧的编译器要求可能影响旧硬件。值得注意的是,这不是一次覆盖全机构的 Linux 替换:CERN 的其他系统仍将继续使用 Red Hat 和 AlmaLinu...

AI 生成的 PR 正在透支开源维护者:问题不在工具,而在责任缺席

来源: oschina.net 42
生成式 AI 把“提交一个看起来像样的 PR”变得异常便宜,却没有同步降低审查、验证和长期维护的成本。开源项目维护者 Neil Alexander 观察到,外部贡献的形态在最近一年明显变化:PR 数量远超 issue,问题报告常附带 AI 分析,安全报告和自动生成的修复建议也显著增多。 真正激怒维护者的,并不是贡献者使用了 AI,而是有人把开源仓库当成...

别急着看工具排行榜:如何读懂 16893 次 Coding Agent 实战会话

来源: oschina.net 31
Claude Code、Codex 和 Cursor 究竟会选择哪些工具?一项实验把这个问题放进了 16893 次真实实现型会话中,覆盖 1163 个 prompt 变体、75 个代码仓库和 10 种语言。它的价值不只在于比较三个 coding agent,更在于展示:要研究 agent 的工程行为,不能只看一两个演示,也不能只让模型口头描述自己会怎么...

vlt 1.0:从分阶段安装到依赖图查询,重新设计 npm 工作流

来源: infoq.com 32
JavaScript 包管理器处理的不只是下载依赖。它还决定何时执行第三方脚本、开发者如何检查依赖关系,以及恶意包能否进入构建环境。由 npm 原始团队打造的 vlt 已发布 1.0,并将自己定位为 npm 的直接替代品,同时把安全控制和依赖分析放进日常工作流。 这次发布最值得关注的并非命令名称是否兼容,而是三个设计方向:分阶段安装、可查询的依赖图,以...

用 PAIR 把闲置电脑组成局域网私有 AI 集群

来源: oschina.net 39
英伟达开源的 Personal AI Router(PAIR)瞄准了一个很实际的问题:家里或小型工作室可能有多台带 GPU 的电脑,但本地 AI 推理通常只能使用其中一台。PAIR 会在局域网内发现兼容设备,将它们组织起来处理本地推理请求,并沿用 Ollama、LM Studio 等开发者已经熟悉的工具链。 这不等于把多台消费级电脑瞬间变成一台共享显存...

Solon AI 4.1 语义化聊天事件:别再把流式响应只当成 Token

来源: oschina.net 47
LLM 的流式接口早已不只是连续吐出文本。一次连接中可能交错出现正文、思考过程、工具参数、引用、媒体、安全事件、用量快照、状态变化和错误。Solon AI 4.1 对流式接口的调整,关键不在于换一个返回类型,而是把这些不同语义的数据从“部分 ChatResponse”中拆出来,让调用方按事件类型处理过程数据与最终结果。 把每一帧都包装成 ChatRes...