标签

Go

LiteRT-LM 搭上 Gemma 4 多 token 预测,端侧推理提速 2.2 倍

来源: infoq.com 70
端侧跑大模型,瓶颈从来不是模型有多聪明,而是 token 一个一个往外蹦的速度够不够用。Google 最新发布的 LiteRT-LM 把 Gemma 4 的 Multi-Token Prediction(MTP)drafter 原生接进推理引擎,实测推理速度最高提升 2.2 倍——不是靠砍精度,而是靠更聪明的投机解码策略。同时,框架的 API 版图也在...

用 Go 搭一个会记忆、能进化的 Agent 平台:TPClaw v1.0 实战拆解

来源: oschina.net 63
自托管 AI 智能体平台的选择正在变多。OpenClaw 打开了"Agent 即服务"的思路,但对 Go 技术栈的团队来说,Python 生态的依赖链始终是个部署负担。今天正式发布 v1.0 的 TPClaw,由 TeamBuf 和 RuleGo 团队联合打造,用 Go 从零写起,把规则引擎和智能体框架揉在一起——核心一句话:规则链即智能体,智能体即服...

MySQL 9.7 JSON Duality View:一次往返插入两张表

来源: jfg-mysql.blogspot.com 208
拆表是常见的优化手段——把一张宽表拆成两张窄表,减少冗余、提升查询效率。但拆表之后,原本一条 就能搞定的事,变成了需要事务包裹的两条 。从自动提交的单条写入,变成一个事务块,工作负载的形态变了,锁的持有时间也变了。 MySQL 9.7 的 JSON Duality View 给了另一种解法:对着视图做一条 ,数据库在内部把数据拆到两张表里,原子性由视图...

文件描述符耗尽:那个把 PostgreSQL 拉垮的内核限制

来源: postgr.es 82
大多数被归咎于"数据库挂了"的 PostgreSQL 宕机,真正的故障点在更底层——内核的文件描述符(file descriptor)用完了,PostgreSQL 只是第一个倒下的进程。这篇文章拆解整个故障链路:从连接数膨胀到 FD 耗尽,从日志特征到诊断命令,再到根治方案和临时止血手段。 Linux 内核把几乎所有 I/O 对象都抽象为文件描述符:T...

仙童代码生成器 Beta2:HTML 原型模式修复,复杂版面不再翻车

来源: oschina.net 93
Go 语言生态里的代码生成器不少,但主打"动词算子式"通用生成的开源项目并不多见。仙童(Fairchild)通用代码生成器阵列近期发布了 Beta2 版,核心改进集中在 HTML 原型模式——修复了圆形模式下复杂版面的多处缺陷,生成结果更稳定、更少出错。 仙童的设计思路和常见的模板填充型生成器不同。它把业务动作抽象为"动词算子",比如增、删、改、查、导...

JPEG XL 的十年长跑:从 Google 实验室到下一代图像编码

来源: oschina.net 60
互联网每天传输数十亿张图片,但承载这些图片的编码格式,二十多年来几乎没变过。JPEG 在 1992 年成为标准后,统治了整个 Web 图像生态——直到带宽与画质的矛盾越来越不可调和:要么压缩到糊成一团,要么体积大到拖慢页面。 JPEG XL 就是为终结这个矛盾而生的。它不是某天突然冒出来的标准提案,而是 Google 一个研究团队用十年时间、通过一系列...

pgBackRest + pg_tde:加密数据库的备份还原实测

来源: postgr.es 52
Percona 之前发过一篇博客,说 pgBackRest 配合 pg_tde(透明数据加密扩展)时,异步归档不可用——原因是对加密的 WAL 段做归档会出问题。Stefan Fercot 在会议走廊里听到这个说法后觉得不对劲:pgBackRest 应该能透明处理加密 WAL。于是他亲手搭了一套环境跑了一遍,结论是:异步归档完全可用,之前说的限制并不成...

deepin 25 跑在瑞莎开发板上:从展台到你的桌面

来源: oschina.net 61
2026 高通 & 瑞莎 AI 开发者日刚在深圳落幕,主题一句话概括——AI 共进,开源新生。现场最吸引嵌入式开发者的不是演讲台,而是 deepin 的体验展位:deepin 25 操作系统已经跑在瑞莎(Radxa)多款开发板上,Dragon Q8B 也带来了最新适配进展。这意味着,国产桌面 Linux 不再只停留在 x86 笔记本里,它正在向...

Gemma 4 12B:扔掉编码器,用 16GB 显存跑多模态

来源: oschina.net 43
Google 在 6 月 3 日放出了 Gemma 4 12B——一个把视觉和音频直接塞进语言模型本体、不再依赖外部编码器的统一多模态模型。更关键的是:16GB 显存或统一内存就能本地跑,高端笔记本直接部署,不需要云端算力兜底。 这件事值得认真看,不只是因为"又出了一个新模型",而是因为它代表了一条正在成型的架构路线:把多模态能力内化到语言模型本身,而...