标签

Go

单日 8 万亿 tokens:DeepSeek Flash 热度背后的用量、成本与可观测性

来源: oschina.net 46
OpenCode 公布的一组数字把 DeepSeek Flash 推上了热搜:8 月 1 日单日处理 8 万亿 tokens,其中 5 万亿来自免费使用,另外 3 万亿来自 OpenCode Go。相关帖子获得 79.8 万次浏览,随后出现了“DeepSeek 一天消耗了 8 万亿”的微博话题。 这个数字足够惊人,但对开发团队更有价值的问题不是“8 万...

Rust Nightly 启用 Polonius Alpha:借用检查开始理解控制流

来源: blog.rust-lang.org 37
Rust 正在 Nightly 工具链中默认启用下一代借用检查器的首个可稳定版本 Polonius Alpha。它并没有推翻现有的 NLL 实现,而是在其基础上加入对生命周期 outlives 关系的流敏感分析,让编译器能够区分不同控制流分支中的借用状态。 这次切换仍处于验证阶段。Rust 团队希望在稳定前发现三类问题:严重的编译性能回退、尚未识别的可...

Meta GEM 训练扩展到数千张 GPU:四倍算力规模下如何把 MFU 提升到 20%–25%

来源: engineering.fb.com 65
Meta 的生成式广告推荐模型 GEM,是 Instagram 和 Facebook 广告推荐背后的基础模型。它的训练已经进入 LLM 规模:使用数千张最新一代 GPU,并在训练 FLOPs 扩大 4 倍的同时,将端到端训练效率提高一倍,使模型 FLOPs 利用率(Model FLOPs Utilization,MFU)达到 20%–25%。 这组数字...

大型机现代化不只是 COBOL 转 Java:用 AI、双轨验证与渐进迁移控制风险

来源: cloud.google.com 61
企业过去常在两种高风险选择之间摇摆:继续维护大型机,把现代化问题留给未来;或者启动一次“大爆炸”式迁移,同时改写应用、数据和基础设施。更现实的路线,是把现代化拆成可验证、可回退的连续过程,用 AI 理解遗留系统,用云平台承载新系统,再用真实生产流量证明两边行为一致。 这套思路的关键不是让模型生成更多代码,而是先解决大型机系统中真正棘手的问题:隐藏依赖、...

Cortex Framework v7 正式发布:把 SAP 数据变成可供 AI Agent 执行的业务上下文

来源: cloud.google.com 52
企业部署 AI Agent 时,真正棘手的通常不是调用大模型,而是如何让 Agent 准确理解订单、库存、采购和财务数据,同时不把额外压力施加到 SAP ECC 或 S/4HANA 等关键系统上。Google Cloud Cortex Framework v7 已正式可用,其核心变化是将 SAP 数据整理成部署在 BigQuery 和 Knowledg...

用 Spanner Graph 打通公有与私有数据:构建可扩展的企业知识图谱

来源: cloud.google.com 51
企业很少缺数据,真正困难的是让不同数据描述同一个现实世界。门店销售记录、供应链指标和客户分群位于内部系统,人口、就业、气候与 GDP 等参考数据则散落在公共机构的数据集中。Data Commons on Spanner Graph 正式可用,以及新版 Data Commons Platform 进入预览,试图用统一实体、标准化统计变量和图关系把这两个世...

PostgreSQL 真死锁还是连接池失活?五分钟完成故障定性

来源: postgr.es 53
凌晨告警里,“应用连不上数据库”通常会被直接翻译成“PostgreSQL 挂了”。但这个现象至少对应两类完全不同的故障:数据库主机真的无法响应,或者应用连接池里保存了一条早已失效的 TCP 连接。两者需要不同的处理方式,混淆它们,很容易浪费事故发生后的关键十分钟。 真正的 PostgreSQL 卡死发生在服务端或更底层。此时无论从哪个应用、连接池或网络...

HubSpot 用规则引擎重构 JITA 授权:把条件判断变成可观测的决策图

来源: infoq.com 39
Just-In-Time Access(JITA)要解决的是一个看似简单、实际很难维护的问题:用户在特定时间、特定理由和特定审批条件下,能否临时获得某项权限。随着例外、审批链和安全策略不断增加,集中式条件判断很容易演变成难以解释的授权代码。 HubSpot 的重构思路是把访问请求交给一组相互独立的规则评估,并将规则组织成有向无环图(DAG)。与此同时,...