来源: oschina.net
34
2025 年 6 月初,马斯克旗下的人工智能公司 xAI 启动了一项 3 亿美元的股份出售交易,将公司整体估值锚定在 1130 亿美元。这笔交易不是传统融资,而是二级市场要约收购(tender offer)——允许内部员工向新投资者出让手中股份。方式变了,信号也就变了。 一级市场融资是公司发行新股、拿钱进公司账户;二级市场要约收购是现有股东把手里股份卖...
来源: infoq.com
33
把 Spark 作业从传统集群搬上 Kubernetes,看起来只是换了个运行环境——实际上底层资源模型的差异远比想象中大。Pranav Bhasker 在将 Spark 管道迁移到 Azure Kubernetes Service(AKS)后,遇到了一种标准诊断手段几乎无法捕捉的 OOM 故障:作业反复被杀,日志里没有明显的内存溢出线索,Spark ...
来源: oschina.net
50
OpenAI 在 6 月 2 日公布了一组数字:Codex 周活跃用户突破 500 万。这个量级已经把它推到了 AI 编程工具的第一梯队。但更值得关注的不是用户数本身,而是伴随这个节点推出的新特性——面向特定角色的插件体系。数据分析、创意写作、产品策划……Codex 正在从"写代码的助手"变成"按角色分工的通用执行引擎"。 Codex 最初是 Open...
来源: oschina.net
36
Uber 刚给员工踩了一脚急刹车。彭博社报道,Uber 对每位员工每月使用每款 AI 编程工具——包括 Anthropic 的 Claude Code 和 Cursor——设定了 1500 美元上限。几个月前,这家公司还在内部鼓励员工"尽可能多地"使用 AI,甚至搞排行榜来刺激用量。从全力踩油门到猛踩刹车,中间发生了什么?答案很简单:预算超支了。 Ub...
来源: oschina.net
36
视频生成模型经常在复杂指令上翻车——提示词写“一只戴着墨镜的猫在雨中奔跑”,结果画面里墨镜飞了、雨滴变成雪花、帧间闪烁不断。根本原因在于,传统模型直接从文本跳到像素,缺乏对指令的深度拆解与时空规划。字节跳动商业化技术团队近日开源的 Bernini 框架,把工作流硬生生拆成了“语义规划”与“视觉渲染”两步,主打“先理解、再生成”,试图从架构层面根治画面失...
来源: postgr.es
32
关系数据库里存的是表,但很多业务问题本质上是图——"谁认识谁的朋友"、"订单经过哪些环节流转"。过去要么把数据导到专门的图数据库,要么手写多层 JOIN 把自己绕晕。PostgreSQL 19 引入了 SQL/PGQ(ISO/IEC 9075-16 (2023) 标准),让你在现有的关系表上定义图语义,然后用图模式匹配语法来查询。不需要安装扩展,不需要...
来源: postgr.es
45
每个用 PostgreSQL 的人都会开 。它便宜、即时、不用装额外组件——查一下就知道哪个查询最慢、哪个调用最多。但用久了你会发现一些诡异的事:昨天还在列表里的关键查询今天消失了;p99 突然飙升但平均值纹丝不动;一个跑了 30 秒然后超时崩溃的查询,在视图里根本找不到踪迹。 这些不是 bug,而是 作为"一堆聚合计数器"的固有边界。上一篇文章讲了它...
来源: infoq.com
39
从 2026 年 10 月的 Node 27 开始,Node.js 将告别"半年一个大版本、偶数 LTS、奇数实验"的双轨节奏,改为每年只发布一个主要版本——并且每个版本都进入长期支持。同时新增 Alpha 通道,供早期特性尝鲜。这一调整直指维护成本和用户实际节奏之间的长期矛盾。 过去多年,Node.js 每年推出两个大版本:偶数版本(如 18、20、...
来源: oschina.net
40
NVIDIA H100 几乎成了大模型推理的"默认答案",但 AMD Instinct MI300X 的 192 GB HBM3 内存和理论上更高的 FP8 吞吐,让它一直是个被低估的选项。Doubleword 的技术博客最近记录了一次将 DeepSeek-V4-Flash 部署到 MI300X 的完整过程——不是跑个 benchmark 截图就收工,...
来源: my.oschina.net
36
大模型上线后,"慢"和"贵"是最常见的两个抱怨。但慢在哪、贵在哪——是 prompt 太长?是推理排队?还是 GPU 已经跑满了?传统监控只告诉你 P99 延迟升高,却不告诉你为什么。ES|QL 配合 OpenTelemetry traces,能让你从一条慢请求一路追到具体的 token 计数、模型调用和 GPU 利用率,拿到根因而不是症状。 假设你的...