标签

架构设计

把 gVisor 变成 Ray 集群里的沙箱原语:为强化学习安全执行动态代码

来源: cloud.google.com 45
强化学习和后训练工作流正在大量采用 Ray:训练器、推理引擎、rollout worker、数据管道和评估任务可以由同一个分布式运行时统一调度。但随着 agentic workflow 变得更复杂,模型生成的代码、工具调用和多轮交互也带来了新的问题:如何在不暴露宿主机的前提下,大规模、低延迟地执行不可信代码? Google 与 Anyscale 正在推...

法律 AI 真正的门槛:把 Gemini Enterprise 变成受治理的工作系统

来源: cloud.google.com 47
法律行业使用 AI,难点从来不只是模型能不能读懂合同。律师处理的是受特权保护的通信、带有伦理墙的案件资料、律所自己的审阅规则,以及持续变化的法律与监管要求。一个通用聊天机器人可以给出看似合理的答案,却无法自动满足权限继承、可追溯引用、保密和专业判断这些生产环境要求。 Gemini Enterprise for Legal 的核心思路,是在模型之外构建一...

Gemini Enterprise 进军金融服务:真正的门槛不是模型,而是可审计的工作流

来源: cloud.google.com 46
金融机构并不缺少能写摘要、生成表格的模型,真正稀缺的是能进入生产环境的 AI:它必须读取获授权的实时数据,遵守既有权限,在研究、授信和 KYC 流程中执行任务,并留下足够完整的证据链。Gemini Enterprise for Financial Services 的重点因此不是单独升级模型能力,而是把金融技能、MCP 数据连接、可执行 Agent、合...

智算云开源项目怎么做:从 GPU 池化到推理 Token 成本控制

来源: oschina.net 46
2026 上海开源软件应用创新大赛设置了 AI+工业软件、智算云、开源 AI 工具三个赛道,总奖池 100 万元。其中,智算云赛道关注的不是单一模型能力,而是如何用云基础设施加速、简化并稳定 AI 运行。异构算力调度、GPU 池化、分布式训练、应用开发平台、模型部署服务和 Serverless 推理,都属于这一方向可以覆盖的工程问题。 对准备参赛或建设...

用声明式滚动更新管理 Kubernetes 上的 PostgreSQL:扩容、扩副本与升级

来源: postgr.es 24
在 Kubernetes 上部署 PostgreSQL 只是起点。真正考验运维体系的,是运行数周或数月后出现的日常变更:实例内存不足、读流量需要更多副本、镜像需要更新。CYBERTEC PG Operator(CPO)将这些操作收敛为 PostgreSQL 自定义资源的期望状态修改,再由 Operator 配合 Patroni 执行有序切换,而不是由人...

DuckDB v2.0 走向网络化:嵌入式分析引擎开始具备分布式架构入口

来源: infoq.com 39
DuckDB Labs 预览了代号为 Cyanoptera 的 DuckDB v2.0。这个版本包含超过 10,000 次提交,最值得架构师关注的变化不是某一条 SQL 优化,而是新增的客户端/服务端模式:DuckDB 不再只能作为进程内嵌入式数据库存在,也开始具备通过网络被其他客户端访问的能力。正式可用版本预计将在 2026 年秋季发布。 这不意味着...

别让 AI 只看仪表盘:为 PostgreSQL 构建可模拟的平台数字孪生

来源: postgr.es 44
PostgreSQL 平台通常不缺遥测数据:监控指标、日志、链路追踪、慢查询、复制状态、配置清单和告警都已经很常见。但当团队准备让 AI 从“解释现象”走向“建议索引、调整参数、执行迁移甚至触发故障切换”时,仅有可观测性并不够。 真正需要补上的,是一个与生产环境持续同步、能表达依赖关系、保留历史并支持变更演练的平台数字孪生。它不是另一个塞满时序指标的数...

从台北连接全球:COSCUP 2026 的 PostgreSQL 社区实践与启示

来源: postgr.es 35
COSCUP 2026 于 8 月 8 日至 9 日在台北国立台湾科技大学举行。对 PostgreSQL 社区而言,这不只是一次技术分享会:国际贡献者、台湾本地用户和其他开源社区在同一个场地相遇,让一个地区性用户群体有机会接入更大的全球协作网络。 这次活动也说明,开源项目的影响力并不只来自代码。展台、演讲、用户组、文档、代码审查和面对面的闲聊,都会成为...

MetaRoCE:为大规模 AI 集群重做 RDMA 以太网传输

来源: engineering.fb.com 41
训练和推理前沿模型时,GPU 之间的数据交换往往比单卡算力更早成为瓶颈。集体通信、参数同步和专家路由都要求网络以极低延迟稳定传输数据;一旦拥塞、丢包恢复或协议开销处理不当,昂贵的 GPU 就会等待网络。 Meta 公布的 MetaRoCE 是一套面向 AI 工作负载、基于通用以太网的全新 RDMA 传输协议。除规范外,项目还发布了参考软件实现与合规测试...