标签

架构设计

HubSpot 用规则引擎重构 JITA 授权:把条件判断变成可观测的决策图

来源: infoq.com 39
Just-In-Time Access(JITA)要解决的是一个看似简单、实际很难维护的问题:用户在特定时间、特定理由和特定审批条件下,能否临时获得某项权限。随着例外、审批链和安全策略不断增加,集中式条件判断很容易演变成难以解释的授权代码。 HubSpot 的重构思路是把访问请求交给一组相互独立的规则评估,并将规则组织成有向无环图(DAG)。与此同时,...

用规则 DAG 重构即时访问授权:HubSpot JITA 架构的工程价值

来源: infoq.com 31
即时访问授权(Just-In-Time Access,JITA)解决的是一个敏感问题:用户只在需要时获得权限,并在条件不再满足后失去权限。随着审批条件、资源类型和治理要求增加,把所有判断堆进一段条件代码,很快会形成难以解释、难以测试、也难以审计的授权逻辑。 HubSpot 对 JITA 授权系统的重构给出了一条清晰路径:把访问决策拆成独立规则,再用有向...

把 Agent Skill 当成产品:Google 如何构建、评测并规模化治理智能体技能

来源: cloud.google.com 35
AI 编码智能体的能力上限,不只由模型决定,还取决于它拿到了什么指令、上下文和工具。Google Agent Skills 的核心思路,是把 Google Cloud 等领域知识编码成结构化、开源、可被智能体读取的操作说明,让智能体减少幻觉、遵循最佳实践,并更稳定地完成真实任务。 真正困难的部分并不是写出第一批 Skill,而是在越来越多团队参与后,仍...

守住变更局部性:让演进式架构不再依赖跨团队协调

来源: infoq.com 57
一个看似简单的功能,如果突然需要三个团队开会、修改四个服务并协调同一天发布,问题往往不在需求本身,而在系统已经失去了变更局部性:一项业务变化无法被限制在拥有该业务能力的边界内。边界漂移通常悄无声息,却会持续增加认知负担,最终让“演进式架构”只剩下口号。 假设电商系统要增加一条规则:VIP 客户可以免除订单取消手续费。理想情况下,这条规则应由订单或取消策...

WebAssembly 走进 JVM:从解释执行、JIT 到 Endive 的服务端演进

来源: infoq.com 38
WebAssembly 已经不再只是浏览器中的编译目标。Andrea Peruffo 的讨论把视角转向服务端 JVM:Wasm 运行时正在从解释执行走向更高效的即时编译,并开始承担边缘计算、插件隔离和模块化扩展等生产任务。与此同时,向 Endive 的过渡也提醒 JVM 开发者,评估 Wasm 不能只看单次基准测试,还要看运行时架构、宿主边界和长期维护...

Dgraph v25.4.0:用 Zero 的 security superflag 集中管理安全参数

来源: oschina.net 55
Dgraph v25.4.0 已发布。本次公开更新中,一个值得集群运维人员注意的变化是:Zero 现在支持 superflag,可以通过 的形式集中传入安全配置。它看起来只是启动参数调整,却会直接影响容器编排、Secret 管理、升级脚本和故障排查方式。 Dgraph 是带图后端的原生 GraphQL 数据库。它不仅提供 GraphQL 接口,也会控制...

AgentDesk v1.6.3:用 Agent First 架构串起客服、人工接管与工单

来源: oschina.net 44
客服 Agent 真正困难的部分,不是生成一句流畅回答,而是判断何时检索知识库、何时继续追问、何时转给人工,以及如何把整个过程沉淀为可追溯的工单。AgentDesk v1.6.3 将运行时升级为 Agent First 架构,试图用统一的自主循环和上下文评估,把在线咨询、知识库问答、人工接管与工单处理放进同一条业务链路。 传统客服机器人通常按固定流程工...

六个月构建实时语音 AI:无轮次模型与低延迟链路如何配合

来源: openai.com 42
GPT-Live 的目标不是让传统聊天机器人多一个语音输入框,而是支持持续、自然的语音交互。它把“等用户说完再回答”的固定轮次,改造成能够持续接收声音、增量生成响应并处理打断的实时系统。要让这种体验成立,模型能力和传输架构必须同时满足低延迟要求。 传统语音助手通常按顺序执行一条完整流水线: 录制一段音频。 检测用户是否停止说话。 将整段音频交给语音识别...

Qwen3.8-Max 把万亿参数与百万上下文带到开源模型:开发者该如何准备

来源: oschina.net 44
千问宣布推出 Qwen3.8-Max,并计划同步开放 Qwen3.8-Max 与 Qwen3.8-27B 的模型权重。按已披露的信息,Max 版本建立在 Qwen 3.5 架构基础上,总参数规模达到 2.4 万亿、单次激活参数约 95B,并支持最高 100 万 Token 上下文。对开发者来说,真正值得关注的不只是参数数字,而是模型选型、推理基础设施和...

MiniMax H3 开源:33B 全模态模型把 2K 视频、立体声与开放权重放进同一套架构

来源: oschina.net 32
MiniMax H3 的开源值得关注,不只是因为它拥有 33B 参数,也不只是因为它能生成 2K 视频和原生立体声。更关键的变化是:国内视频生成模型不再只展示成片或追逐榜单,而是开始把架构、权重和许可放到开发者面前。H3 由三个模块组成,其中两个开源;这让团队第一次有机会把它当成可检查、可部署、可改造的工程系统,而不只是一个网页里的生成按钮。 从已披露...