来源: oschina.net
36
Uber 刚给员工踩了一脚急刹车。彭博社报道,Uber 对每位员工每月使用每款 AI 编程工具——包括 Anthropic 的 Claude Code 和 Cursor——设定了 1500 美元上限。几个月前,这家公司还在内部鼓励员工"尽可能多地"使用 AI,甚至搞排行榜来刺激用量。从全力踩油门到猛踩刹车,中间发生了什么?答案很简单:预算超支了。 Ub...
来源: oschina.net
36
视频生成模型经常在复杂指令上翻车——提示词写“一只戴着墨镜的猫在雨中奔跑”,结果画面里墨镜飞了、雨滴变成雪花、帧间闪烁不断。根本原因在于,传统模型直接从文本跳到像素,缺乏对指令的深度拆解与时空规划。字节跳动商业化技术团队近日开源的 Bernini 框架,把工作流硬生生拆成了“语义规划”与“视觉渲染”两步,主打“先理解、再生成”,试图从架构层面根治画面失...
来源: postgr.es
32
关系数据库里存的是表,但很多业务问题本质上是图——"谁认识谁的朋友"、"订单经过哪些环节流转"。过去要么把数据导到专门的图数据库,要么手写多层 JOIN 把自己绕晕。PostgreSQL 19 引入了 SQL/PGQ(ISO/IEC 9075-16 (2023) 标准),让你在现有的关系表上定义图语义,然后用图模式匹配语法来查询。不需要安装扩展,不需要...
来源: postgr.es
45
每个用 PostgreSQL 的人都会开 。它便宜、即时、不用装额外组件——查一下就知道哪个查询最慢、哪个调用最多。但用久了你会发现一些诡异的事:昨天还在列表里的关键查询今天消失了;p99 突然飙升但平均值纹丝不动;一个跑了 30 秒然后超时崩溃的查询,在视图里根本找不到踪迹。 这些不是 bug,而是 作为"一堆聚合计数器"的固有边界。上一篇文章讲了它...
来源: infoq.com
39
从 2026 年 10 月的 Node 27 开始,Node.js 将告别"半年一个大版本、偶数 LTS、奇数实验"的双轨节奏,改为每年只发布一个主要版本——并且每个版本都进入长期支持。同时新增 Alpha 通道,供早期特性尝鲜。这一调整直指维护成本和用户实际节奏之间的长期矛盾。 过去多年,Node.js 每年推出两个大版本:偶数版本(如 18、20、...
来源: oschina.net
40
NVIDIA H100 几乎成了大模型推理的"默认答案",但 AMD Instinct MI300X 的 192 GB HBM3 内存和理论上更高的 FP8 吞吐,让它一直是个被低估的选项。Doubleword 的技术博客最近记录了一次将 DeepSeek-V4-Flash 部署到 MI300X 的完整过程——不是跑个 benchmark 截图就收工,...
来源: my.oschina.net
36
大模型上线后,"慢"和"贵"是最常见的两个抱怨。但慢在哪、贵在哪——是 prompt 太长?是推理排队?还是 GPU 已经跑满了?传统监控只告诉你 P99 延迟升高,却不告诉你为什么。ES|QL 配合 OpenTelemetry traces,能让你从一条慢请求一路追到具体的 token 计数、模型调用和 GPU 利用率,拿到根因而不是症状。 假设你的...
来源: oschina.net
35
终端工具正在从"命令输入框"演变为"交互式工作台"。微软最新发布的 Intelligent Terminal 0.1 是一个信号——它基于 Windows Terminal 开出了一个实验性分支,把原生 Agent 能力直接嵌进了终端窗口。这意味着终端不再只是被动等待你敲命令,而是可以主动理解意图、辅助操作。 Intelligent Terminal ...
来源: oschina.net
28
6 月 2 日,微软超级智能团队发布了 MAI-Code-1-Flash。名字里的 "Flash" 已经点明了意图——快、省、狠。但更值得关注的是它背后的设计哲学:为开发者而生,而非为榜单而生。 这不是一句营销口号。MAI-Code-1-Flash 直接在 GitHub Copilot 生产环境使用的测试框架中训练,意味着模型的优化目标不是跑分刷榜,而...
来源: postgr.es
43
大概是 PostgreSQL 生态里最常用的扩展之一。它随 contrib 一起发布,开启成本几乎为零,大多数人的第一反应就是——"数据库到底在干什么?"打开它看一眼,心里就有底了。 但如果你是从其他数据库过来的,可能会期待它像一个真正的 Query Store:记录每条查询的执行历史、保留计划演进、能按时间窗口回溯。它不是。 一旦你深度依赖它,就会发...