标签

工程效能

From Projects to Products: Turning Platforms into Products People Use

来源: infoq.com 36
我先把摘要里的核心判断抓稳,再把它整理成中英双语的短文 JSON,正文会补一个可直接改造的示例,方便落地。{"title_zh":"从平台到产品:让能力真的被人用起来","body_zh":"平台不是交付完就结束,真正的门槛是:别人能不能看懂、用得顺、愿不愿意持续用。一个能力只有在能被他人可靠使用时,才算真正完成。衡量进展时,别只问“做完了吗”,更该问...

LitmusChaos 2026 年上半年观察:社区协作如何推动混沌工程落地

来源: cncf.io 46
LitmusChaos 是一个面向云原生环境的开源混沌工程平台,通过受控的故障实验帮助团队发现基础设施中的薄弱点和潜在中断风险。2026 年第一、第二季度的更新重点,可以从社区参与、代码贡献和项目推进三个角度理解:混沌工程正在从少数专家的专项活动,逐步变成平台工程、SRE 和开发团队都能参与的工程实践。 对于 LitmusChaos 这类开源项目,社区...

CosmosEscape 之后:云数据库客户究竟能防住什么

来源: infoq.com 50
Wiz Research 披露的 CosmosEscape 并不是一次普通的数据库密钥泄露。攻击链从 Azure Cosmos DB 的 Gremlin 沙箱逃逸,最终获得一个平台级密钥,可读写该服务中的所有数据库。微软在两天内封堵入口,但来源摘要指出,直到 2026 年 7 月才移除该密钥。这个事件真正棘手的地方,在于客户能否通过配置降低风险,以及哪...

Cloudflare 同时入选 2026 SASE 与 SSE 魔力象限愿景者,企业该如何解读

来源: blog.cloudflare.com 55
Cloudflare 宣布,它是唯一同时在 2026 年 Gartner® SASE Platforms 魔力象限和 Security Service Edge(SSE)魔力象限中被评为“愿景者”(Visionary)的厂商。这个消息的价值不只在于榜单排名,更在于它把企业长期面对的两个问题放到了一起:如何构建覆盖网络与安全的 SASE 架构,以及如何通...

PostgreSQL 中的 DISTINCT 为什么会让 COUNT 失去并行能力

来源: postgr.es 47
看起来只是一个普通的统计查询,但在 PostgreSQL 中, 会改变聚合的执行方式。对于大型事件表,这个变化可能意味着查询从多核并行扫描退化为单进程排序,并把临时数据写入磁盘。 问题不在索引配置,也不在 没有调大,而在于精确去重本身需要一个能够合并的全局状态。理解这一点后,很多 查询都可以通过改写重新获得并行执行能力。 可以用下面的 SQL 创建一个...

从用户行为序列到规模定律:广告排序系统的多阶段架构

来源: engineering.fb.com 59
当推荐系统每天处理数十亿次用户互动时,用户刚刚看过什么、点击过什么、停留了多久,以及这些行为发生的先后顺序,往往比一组静态标签更能说明当前意图。Meta 关于广告排序的最新实践,将讨论重点从“如何加入序列特征”推进到了“如何让序列建模在大规模系统中持续扩展”:模型结构、数据处理和计算预算需要一起设计。 传统广告排序系统通常依赖稀疏特征,例如用户兴趣标签...

用分片 Hub-and-Spoke 架构隔离多租户平台中的“吵闹邻居”

来源: cloud.google.com 49
在多租户 SaaS、企业内部数据平台和混合负载处理系统中,基础设施共享可以降低成本,却也会引入一个危险的连锁反应:某个租户突然产生大量数据,或者它的数据库实例出现故障,最终拖慢整个平台,造成队列积压和全局 SLA 违约。 分片式 Hub-and-Spoke 架构的核心价值,是把“所有租户共用一条处理链路”改造成“统一路由、分区缓冲、隔离执行”。这样,一...

从按需扩容到共享 GPU 池:UiPath 如何支撑企业级 Agentic AI

来源: cloud.google.com 53
当自动化系统从执行固定步骤,升级为能够理解文档、识别界面、调用模型并自主决策的 Agentic AI,基础设施面对的已经不只是“多部署几张 GPU”。训练任务需要大量高性能算力,在线推理要求稳定低延迟,全球化服务还要兼顾区域容量与成本。 UiPath 为智能文档处理和自主智能体重新设计了 GPU 平台:不再为每个产品维护独立集群,而是通过机器学习服务平...

Cloudflare OS:让智能体、应用与组织工作流共用一套开放平台

来源: blog.cloudflare.com 51
Cloudflare OS 试图解决一个现实问题:企业里真正有价值的应用和自动化,往往依赖组织内部积累的知识、流程与系统权限。平台的核心方向,是让公司中的每个人都能构建应用、自动化工作,并在安全边界内访问内部系统。 这并不只是增加一个聊天机器人入口。更重要的是,把“组织知道什么”“工作如何运转”以及“哪些系统可以被访问”组合成可持续维护的平台能力。 传...

Cloudflare OS:用计算与零信任重新设计 AI 时代的工作方式

来源: blog.cloudflare.com 51
AI 正在改变团队完成工作的方式,但真正的难点并不是接入一个聊天机器人,而是让 AI 工具进入真实工作流,同时满足权限、数据保护、审计和可靠性要求。Cloudflare OS 的思路,是把计算能力与 Zero Trust 安全能力放在同一个平台中,让团队可以更安全地重新思考工作流程,并为用户提供更完整的 AI 工具体验。 很多团队的 AI 落地停留在单...