标签

全栈

Higress 进入 CNCF Sandbox 后,v2.2.3 把重点放在 AI Gateway 与 Gateway API

来源: my.oschina.net 29
Higress 最近发布 v2.2.3,同时项目迈入 CNCF Sandbox。这个节点值得关注:它不只是一次版本号更新,主仓库有 48 项更新,Higress Console 有 8 项更新,方向也很明确——继续扩展 AI Gateway 能力,并增强对 Kubernetes Gateway API 的兼容。 对正在把大模型能力接入生产流量的团队来说...

别再刷 Token 了:AI 使用率该从消耗转向产出

来源: oschina.net 28
去年有公司把员工的 Token 消耗量写进绩效考核,结果并没有自动带来生产力,反而催生了荒诞操作:有人让两个 Agent 互相聊天一整天,只为了把用量刷上去。这个现象被称为 tokenmaxxing:用行政指标逼团队“用 AI”,哪怕消耗本身没有任何业务意义。 更有意思的是,复盘者的判断不是“AI 没用”,而是“第一阶段的 tokenmaxxing 已...

Kimi ARR 破 3 亿美元:开发者 API 正在改写大模型公司的收入曲线

来源: oschina.net 40
月之暗面 Kimi 的融资节奏和收入数据,让国内大模型公司的商业化讨论从“流量有多大”转向“开发者到底愿不愿意付费”。据报道,Kimi 上一轮 200 亿美元估值融资近日完成交割,新一轮融资已启动,投前估值升至 315 亿美元;其在融资沟通中披露,6 月中旬 ARR,也就是年度经常性收入,突破 3 亿美元。本轮收入增长的关键来源,是模型迭代带来的开发者...

Electron 42.5.1 发布:一个小版本里值得关注的协议响应修复

来源: oschina.net 33
Electron 42.5.1 已经发布。作为一个基于 Chromium 和 Node.js 的跨平台桌面应用框架,Electron 的小版本更新通常不会改变开发方式,但会修掉一些足以影响真实应用稳定性的边角问题。这次摘要里明确提到的修复点,是当 未设置时的相关问题。 Electron 应用经常会注册自定义协议,用来加载本地资源、隔离前端资源访问、实现...

ScreenCapture 2.4.6:截图工具轻到 778KB,还把录屏补上了

来源: oschina.net 30
ScreenCapture 2.4.6 这次不是常见的“小修小补”。它放弃了 Qt 框架,重写项目代码,改为直接基于系统 API 工作;结果是安装体积缩小到约 778KB,号称比之前小了 10 倍,同时性能也因为硬件加速而有明显提升。更关键的是,它不再只是截图工具,还加入了可选区域录屏,并支持导出 MP4 和 GIF。 桌面截图工具看起来简单,实际涉及...

HTTP QUERY:终于有了能带 Body 的安全查询方法

来源: oschina.net 33
IETF 发布 RFC 10008,正式给 HTTP 增加了一个新方法:。它瞄准的是一个长期尴尬的问题:很多查询操作本质上像 一样安全、幂等,不应该修改服务器状态,但查询条件又复杂到不适合塞进 URL。过去大家只能在“超长 GET”和“语义不准的 POST”之间二选一,现在多了一个更贴切的选择。 的优势很清楚:语义简单、安全、可缓存、容易被代理和浏览器...

LongCat-2.0 开源:1.6 万亿参数 MoE 模型背后的工程信号

来源: oschina.net 38
美团正式发布并开源 LongCat-2.0,把一个总参数量 1.6 万亿、每个 token 约激活 480 亿参数的 MoE 语言模型推到开发者面前。比起单纯刷新参数规模,这次更值得关注的是两个工程信号:模型架构继续向稀疏激活演进,完整训练流程和大规模部署全部跑在国产算力集群上。 LongCat-2.0 是 MoE,也就是 Mixture of Exp...

SQLAlchemy 2.1.0b3:ORM 加载更快,正式版前值得提前试跑

来源: oschina.net 39
SQLAlchemy 2.1 系列的第三个测试版已经发布。这个版本带来了一组新功能、性能改进和错误修复,并预计会成为 2.1.0 正式版发布前的最后一个测试版。对多数后端团队来说,最值得关注的是 ORM 加载路径的性能变化:ORM 加载器改用基于位置的访问,获取 ORM 结果行时可以以普通元组形式处理,绕开 Row 接口带来的额外开销。 SQLAlch...

DeepSeek V4 的峰谷计价:别只等模型升级,也要重排调用时钟

来源: oschina.net 21
DeepSeek V4 正式版预计在 7 月中旬上线。相比发布时间,更值得工程团队提前处理的是新的 API 峰谷计价:按北京时间分时段收费,上午 9 点到 12 点、下午 2 点到 6 点属于峰时,价格翻倍;其他时段维持基准价。对调用量稳定的业务来说,这不是财务备注,而是架构参数。 过去很多团队优化 LLM 成本,主要盯着 token、缓存、模型选择和...

分布式系统性能优化:从慢请求到可观测的提速闭环

来源: my.oschina.net 33
性能不是系统上线后的“锦上添花”,而是分布式架构能否承载真实业务的基本能力。电商页面多等一秒,用户可能直接离开;物联网控制链路慢几秒,用户会选择手动按按钮。分布式系统的难点在于:慢不一定慢在代码,也可能慢在网络、数据库、缓存、队列、序列化、线程池,甚至是一次不合理的跨服务调用。 性能优化最常见的误区,是看到响应慢就扩容。扩容当然有用,但如果瓶颈在数据库...