标签

AI

NOAA 将核心天气预报迁上云:云端 HPC 如何支撑下一代数值天气预测

来源: cloud.google.com 24
美国国家海洋和大气管理局(NOAA)选择 Google Cloud 作为天气与气候业务超级计算系统(WCOSS)的主要高性能计算基础设施提供商。这不只是一次机房搬迁,而是业务级数值天气预测(Numerical Weather Prediction,NWP)从传统本地超算向云优先架构转型的重要案例。 天气预报系统必须在固定时间窗口内处理海量观测数据、运行...

用 Google Antigravity CLI 审阅与重构 Python:一套可验证的终端工作流

来源: realpython.com 24
Google Antigravity CLI 是一个运行在终端中的 AI 编码代理,适合读取、审查和重构 Python 代码。真正值得关注的并不是“让 AI 写出更多代码”,而是如何把代理放进现有工程流程:先限定任务,再检查改动,最后用测试验证结果。 由于来源摘要没有给出具体版本的安装方式和子命令,下面不会假定某个固定 CLI 接口。实际使用前应先执行...

用 AI Gateway 隔离模型剧变:面向智能体系统的演进式架构

来源: infoq.com 15
传统 API Gateway 建立在两个稳定假设之上:服务会产生相对确定的结果,接口契约也能用简单 schema 描述。智能体 AI 打破了这些假设。一次请求可能触发多轮推理、调用外部工具、修改业务数据,甚至因为模型升级而改变决策路径。企业需要的不只是一个转发模型请求的代理,而是一个能够集中执行护栏、模型路由、智能体身份、动作策略和语义审计的控制平面。...

别急着拆微服务:AI 时代 Java 后端的模块化单体瘦身法

来源: my.oschina.net 24
移动互联网高速增长时期,微服务解决了一个非常现实的问题:当业务、代码和团队同时膨胀时,通过业务域拆分、独立部署和团队自治,把集中式协调变成明确的技术契约。 但架构不会脱离组织规模而独立成立。当团队缩小、业务增速趋稳,或者 AI 工具开始显著提高单个工程师的交付能力后,几十个服务带来的注册发现、链路追踪、接口兼容、部署编排和故障排查成本,可能已经超过它们...

NocoBase 审批通知渠道支持按标题远程搜索:大数据量配置不再靠翻页

来源: oschina.net 29
NocoBase 最新一周产品更新中,审批通知渠道新增了按标题远程搜索的能力。这个变化看似集中在一个选择框里,实际解决的是配置规模扩大后的核心问题:当通知渠道越来越多时,用户不必加载完整列表或逐页查找,可以直接输入标题,由服务端筛选候选项。 普通下拉框通常在页面初始化时拉取全部选项,再由浏览器执行本地过滤。数据量较小时,这种方案简单有效;当通知渠道达到...

Cosmos-H-Dreams:实时生成式仿真如何进入手术机器人研发流程

来源: huggingface.co 29
NVIDIA Cosmos-H-Dreams 把“实时生成式仿真”带到手术机器人这一高风险领域。这里的关键变化不是生成更逼真的演示视频,而是让仿真环境能够持续响应机器人动作,为策略训练、异常场景构造和回归测试提供动态数据。由于来源没有给出公开 API、模型结构或性能指标,下面不会假定具体接口,而是围绕标题所指向的工程方向,给出一套可落地的集成思路。 传...

从万条攻击日志到本地取证:开源模型如何改变安全响应

来源: oschina.net 26
来源摘要将这起事件置于 2026 年 7 月:Hugging Face 面对大量疑似由模型自主发起的攻击日志,商业模型分析受阻,安全团队随后在本地部署中国模型 GLM-5.2,并在数小时内完成取证分析。由于这一时间点和部分技术细节尚无法从摘要中独立核验,更稳妥的读法是把它视为一个安全工程案例:当数据敏感、日志量大、外部 API 受限时,本地开源模型可能...

Kimi-K3 开放权重:3 万亿参数之外,更值得关注的是仓库级上下文架构

来源: oschina.net 33
根据已公开的模型卡信息,月之暗面计划开放 Kimi-K3 的模型权重。它最醒目的数字是 3 万亿参数,但对开发者来说,更值得追踪的是两个架构关键词:自研的 Kimi Delta Attention 与 Attention Residuals,以及面向超长上下文、仓库级任务的设计目标。 权重开放不等于普通开发机可以直接运行。一个 3T 级模型会把下载、存...

Netflix 如何用 Triton 与 vLLM 构建内部大模型推理平台

来源: infoq.com 29
把大语言模型接入生产环境,难点远不止启动一个推理服务。Netflix 分享的核心经验指向了更棘手的问题:模型尺寸不同、GPU 需求不同、推理引擎快速演进,而业务方仍然希望通过稳定、统一的平台调用模型。Triton 与 vLLM 的价值,正是在模型运行时与平台接口之间建立一个可治理的服务层。 传统机器学习平台通常围绕相对稳定的模型格式、批处理策略和硬件配...

从一封公开信到 70 多家签署方:开放权重模型为何成为 AI 产业共识

来源: oschina.net 24
7 月 24 日,黄仁勋发布了自己的第一条推文,内容不是产品宣传,而是 NVIDIA 参与签署的一封公开信:开放权重模型对 AI 生态至关重要,产业界应共同支持。公开信最初列出 25 家签署方,48 小时内扩展到 70 多家;微软 CEO 萨提亚·纳德拉公开表态支持,OpenAI 也出现在签署名单中。 这件事的价值不只在于名单有多长。它把一个长期存在的...