2026-06-05
来源: infoq.com
104
在端侧跑大模型,推理速度一直是最大的拦路虎。Google 最新发布的 LiteRT-LM 框架引入了对 Gemma 4 Multi-Token Prediction(MTP)drafter 的原生支持,在本地推理场景下最高可达 2.2 倍加速。与此同时,框架的 API 覆盖面也在拓宽——新增了 Swift 和 JavaScript 绑定,不再局限于 K...
2026-06-05
来源: infoq.com
70
端侧跑大模型,瓶颈从来不是模型有多聪明,而是 token 一个一个往外蹦的速度够不够用。Google 最新发布的 LiteRT-LM 把 Gemma 4 的 Multi-Token Prediction(MTP)drafter 原生接进推理引擎,实测推理速度最高提升 2.2 倍——不是靠砍精度,而是靠更聪明的投机解码策略。同时,框架的 API 版图也在...
2026-06-05
来源: oschina.net
63
自托管 AI 智能体平台的选择正在变多。OpenClaw 打开了"Agent 即服务"的思路,但对 Go 技术栈的团队来说,Python 生态的依赖链始终是个部署负担。今天正式发布 v1.0 的 TPClaw,由 TeamBuf 和 RuleGo 团队联合打造,用 Go 从零写起,把规则引擎和智能体框架揉在一起——核心一句话:规则链即智能体,智能体即服...
2026-06-04
来源: jfg-mysql.blogspot.com
208
拆表是常见的优化手段——把一张宽表拆成两张窄表,减少冗余、提升查询效率。但拆表之后,原本一条 就能搞定的事,变成了需要事务包裹的两条 。从自动提交的单条写入,变成一个事务块,工作负载的形态变了,锁的持有时间也变了。 MySQL 9.7 的 JSON Duality View 给了另一种解法:对着视图做一条 ,数据库在内部把数据拆到两张表里,原子性由视图...
2026-06-04
来源: postgr.es
82
大多数被归咎于"数据库挂了"的 PostgreSQL 宕机,真正的故障点在更底层——内核的文件描述符(file descriptor)用完了,PostgreSQL 只是第一个倒下的进程。这篇文章拆解整个故障链路:从连接数膨胀到 FD 耗尽,从日志特征到诊断命令,再到根治方案和临时止血手段。 Linux 内核把几乎所有 I/O 对象都抽象为文件描述符:T...
2026-06-04
来源: oschina.net
93
Go 语言生态里的代码生成器不少,但主打"动词算子式"通用生成的开源项目并不多见。仙童(Fairchild)通用代码生成器阵列近期发布了 Beta2 版,核心改进集中在 HTML 原型模式——修复了圆形模式下复杂版面的多处缺陷,生成结果更稳定、更少出错。 仙童的设计思路和常见的模板填充型生成器不同。它把业务动作抽象为"动词算子",比如增、删、改、查、导...
2026-06-04
来源: oschina.net
60
互联网每天传输数十亿张图片,但承载这些图片的编码格式,二十多年来几乎没变过。JPEG 在 1992 年成为标准后,统治了整个 Web 图像生态——直到带宽与画质的矛盾越来越不可调和:要么压缩到糊成一团,要么体积大到拖慢页面。 JPEG XL 就是为终结这个矛盾而生的。它不是某天突然冒出来的标准提案,而是 Google 一个研究团队用十年时间、通过一系列...
2026-06-04
来源: postgr.es
52
Percona 之前发过一篇博客,说 pgBackRest 配合 pg_tde(透明数据加密扩展)时,异步归档不可用——原因是对加密的 WAL 段做归档会出问题。Stefan Fercot 在会议走廊里听到这个说法后觉得不对劲:pgBackRest 应该能透明处理加密 WAL。于是他亲手搭了一套环境跑了一遍,结论是:异步归档完全可用,之前说的限制并不成...
2026-06-04
来源: oschina.net
61
2026 高通 & 瑞莎 AI 开发者日刚在深圳落幕,主题一句话概括——AI 共进,开源新生。现场最吸引嵌入式开发者的不是演讲台,而是 deepin 的体验展位:deepin 25 操作系统已经跑在瑞莎(Radxa)多款开发板上,Dragon Q8B 也带来了最新适配进展。这意味着,国产桌面 Linux 不再只停留在 x86 笔记本里,它正在向...
2026-06-04
来源: oschina.net
43
Google 在 6 月 3 日放出了 Gemma 4 12B——一个把视觉和音频直接塞进语言模型本体、不再依赖外部编码器的统一多模态模型。更关键的是:16GB 显存或统一内存就能本地跑,高端笔记本直接部署,不需要云端算力兜底。 这件事值得认真看,不只是因为"又出了一个新模型",而是因为它代表了一条正在成型的架构路线:把多模态能力内化到语言模型本身,而...