分类

文章

跨集群联邦:让 Kubernetes 区域故障真正做到无停机切换

来源: cncf.io 25
多区域部署最容易制造一种危险的安全感:服务已经在两个 Kubernetes 集群中运行,但其中一个集群消失时,用户流量仍然固执地发往故障区域。副本存在,不等于故障转移已经成立。要让备用集群真正接管请求,必须把工作负载、流量入口、健康判断和数据状态一起纳入设计。 跨集群联邦的核心目标,是把多个独立集群视为同一个服务的运行位置,同时保留故障隔离边界。每个集...

用 AI Gateway 隔离模型剧变:面向智能体系统的演进式架构

来源: infoq.com 16
传统 API Gateway 建立在两个稳定假设之上:服务会产生相对确定的结果,接口契约也能用简单 schema 描述。智能体 AI 打破了这些假设。一次请求可能触发多轮推理、调用外部工具、修改业务数据,甚至因为模型升级而改变决策路径。企业需要的不只是一个转发模型请求的代理,而是一个能够集中执行护栏、模型路由、智能体身份、动作策略和语义审计的控制平面。...

从参赛项目到可持续业务:创客营真正要验证什么

来源: oschina.net 16
第十一届“创客中国”元宇宙中小企业创新创业大赛以“元启新探索·智创新宇宙”为主题,面向元宇宙、人工智能及相关数字科技领域的中小企业和创业项目。相比只看路演表现,这类创客营更值得关注的变化,是把项目展示、创新交流、资源链接和成长服务串成一条从技术成果走向市场的路径。 “不招学员,只招创业同行者”也意味着参与者不能只带着一个等待点评的方案入场。团队需要带来...

别急着拆微服务:AI 时代 Java 后端的模块化单体瘦身法

来源: my.oschina.net 24
移动互联网高速增长时期,微服务解决了一个非常现实的问题:当业务、代码和团队同时膨胀时,通过业务域拆分、独立部署和团队自治,把集中式协调变成明确的技术契约。 但架构不会脱离组织规模而独立成立。当团队缩小、业务增速趋稳,或者 AI 工具开始显著提高单个工程师的交付能力后,几十个服务带来的注册发现、链路追踪、接口兼容、部署编排和故障排查成本,可能已经超过它们...

NocoBase 审批通知渠道支持按标题远程搜索:大数据量配置不再靠翻页

来源: oschina.net 29
NocoBase 最新一周产品更新中,审批通知渠道新增了按标题远程搜索的能力。这个变化看似集中在一个选择框里,实际解决的是配置规模扩大后的核心问题:当通知渠道越来越多时,用户不必加载完整列表或逐页查找,可以直接输入标题,由服务端筛选候选项。 普通下拉框通常在页面初始化时拉取全部选项,再由浏览器执行本地过滤。数据量较小时,这种方案简单有效;当通知渠道达到...

Cosmos-H-Dreams:实时生成式仿真如何进入手术机器人研发流程

来源: huggingface.co 30
NVIDIA Cosmos-H-Dreams 把“实时生成式仿真”带到手术机器人这一高风险领域。这里的关键变化不是生成更逼真的演示视频,而是让仿真环境能够持续响应机器人动作,为策略训练、异常场景构造和回归测试提供动态数据。由于来源没有给出公开 API、模型结构或性能指标,下面不会假定具体接口,而是围绕标题所指向的工程方向,给出一套可落地的集成思路。 传...

Wine 11.14 发布:补齐 7.1 声道转换、AES-GMAC 与 FreeBSD WoW64

来源: oschina.net 37
Wine 11.14 已正式发布。这次更新没有集中在单一大型功能上,而是继续补齐 Windows 应用依赖的底层能力:DirectSound 增加 7.1 格式转换,BCrypt 支持 AES-GMAC,FreeBSD 获得 WoW64 模式,同时开始菜单图标也得到改进,并包含多项错误修复。对游戏、音频软件以及依赖 Windows 加密 API 的程序...

从万条攻击日志到本地取证:开源模型如何改变安全响应

来源: oschina.net 26
来源摘要将这起事件置于 2026 年 7 月:Hugging Face 面对大量疑似由模型自主发起的攻击日志,商业模型分析受阻,安全团队随后在本地部署中国模型 GLM-5.2,并在数小时内完成取证分析。由于这一时间点和部分技术细节尚无法从摘要中独立核验,更稳妥的读法是把它视为一个安全工程案例:当数据敏感、日志量大、外部 API 受限时,本地开源模型可能...

Kimi-K3 开放权重:3 万亿参数之外,更值得关注的是仓库级上下文架构

来源: oschina.net 33
根据已公开的模型卡信息,月之暗面计划开放 Kimi-K3 的模型权重。它最醒目的数字是 3 万亿参数,但对开发者来说,更值得追踪的是两个架构关键词:自研的 Kimi Delta Attention 与 Attention Residuals,以及面向超长上下文、仓库级任务的设计目标。 权重开放不等于普通开发机可以直接运行。一个 3T 级模型会把下载、存...

Netflix 如何用 Triton 与 vLLM 构建内部大模型推理平台

来源: infoq.com 29
把大语言模型接入生产环境,难点远不止启动一个推理服务。Netflix 分享的核心经验指向了更棘手的问题:模型尺寸不同、GPU 需求不同、推理引擎快速演进,而业务方仍然希望通过稳定、统一的平台调用模型。Triton 与 vLLM 的价值,正是在模型运行时与平台接口之间建立一个可治理的服务层。 传统机器学习平台通常围绕相对稳定的模型格式、批处理策略和硬件配...