标签

LLM

AWS Lambda MicroVMs:给每个 Agent 一台隔离的 Firecracker 小虚机

来源: infoq.com 25
AWS 推出了 Lambda MicroVMs,这不是又一个普通的函数运行时,而是一个面向“每个用户会话、每个 AI Agent 都需要独立沙箱”的 serverless 计算原语。它把执行单元放进独立的 Firecracker 虚拟机里,强调硬件级隔离、基于快照的快速启动,以及最长 8 小时的状态保留。 这件事之所以值得关注,是因为 AI Agent...

ChatGPT 采用率正在全球扩散:从“尝鲜工具”到日常工作入口

来源: openai.com 41
OpenAI Signals 的新数据指出,ChatGPT 的采用正在全球范围内继续增长:用户使用频率更高,探索的能力更多,增长也跨越了不同地区和语言。这件事的意义不只在于“用户数变多”,而在于 ChatGPT 正从一个单点工具,逐渐变成很多人处理信息、写作、学习、编程和决策前准备的日常入口。 看 AI 产品采用率时,最容易盯着注册用户或访问量。但这类...

Java 实时系统的事件驱动扩展:Kafka 背后的生产级取舍

来源: infoq.com 26
事件驱动架构很容易被描述成“天然可扩展”:生产者写事件,消费者水平扩容,Kafka 扛住吞吐。但在 Java 实时系统里,真正棘手的问题往往不是消息能不能进队列,而是状态放哪里、分区怎么切、重复事件如何处理、JVM 抖动会不会拖垮实时链路。 这篇文章基于一个 Java/Kafka 联络中心平台的经验展开:系统需要支撑约 80k BHCC(busy ho...

Cursor 上手机:Cloud Agent 让代码审查不再绑在笔记本前

来源: oschina.net 21
Cursor 把 iOS 移动应用推向公开测试后,一个很具体的开发场景变得更顺手:你合上笔记本,Agent 继续在云端跑;CI 结束后,手机收到通知;你在路上看 diff、审 PR,甚至完成 merge。它不是把完整 IDE 塞进小屏幕,而是把“等待 Agent、检查结果、处理 PR”这段碎片化工作迁到手机上。 这次变化的核心不是 iOS App 本身...

别再刷 Token 了:AI 使用率该从消耗转向产出

来源: oschina.net 28
去年有公司把员工的 Token 消耗量写进绩效考核,结果并没有自动带来生产力,反而催生了荒诞操作:有人让两个 Agent 互相聊天一整天,只为了把用量刷上去。这个现象被称为 tokenmaxxing:用行政指标逼团队“用 AI”,哪怕消耗本身没有任何业务意义。 更有意思的是,复盘者的判断不是“AI 没用”,而是“第一阶段的 tokenmaxxing 已...

PostgreSQL 表太多时,内存和元数据查询会先撑不住

来源: postgr.es 28
“表很多”听起来像是建模风格问题,但在 PostgreSQL 里,它也可能变成实打实的内存和 CPU 问题。一次故障排查中,Linux OOM killer 会偶发杀掉 PostgreSQL,另一些长查询则持续占用 CPU、拖慢应用;最后问题都指向同一个根因:单个数据库里有成千上万张表以及随之膨胀的元数据对象。 排查 PostgreSQL 内存问题时,...

ACL v1.0:当 AI Agent 开始读仓库,商业许可证也要补课了

来源: oschina.net 30
AI 编程工具已经不只是“看几行代码给补全”了。Copilot 在 IDE 里联想,Codex 类工具能重构项目,企业内部 agent 还会轮询仓库、索引依赖、生成补丁。问题是:很多商业源码许可证诞生时,并没有认真描述“AI 可以拿这些代码做什么”。 ACL v1.0 的发布,正是冲着这个空白来的。它试图回答一个新问题:在 AI 时代,代码“可见、可用...

TaiXu-Admin V0.1.1:把 Skill、RAG 和 Agent 的工程边界补齐

来源: oschina.net 41
TaiXu-Admin V0.1.1 的更新重点不在“又接了一个模型”,而在应用系统真正跑起来后会遇到的工程问题:技能怎么加载,知识库怎么重构,历史记忆怎么管,RAG 和 Agent 出错时怎么兜底。这些能力看起来不如模型参数醒目,却直接决定一个 LLM 应用能不能稳定交付。 这次发布实现了 skill 技能加载,并支持在 YAML 中配置全局 ski...

Hugging Face 模型页展示 Every Eval Ever:选模型时少翻几张表

来源: huggingface.co 35
Hugging Face 模型页开始展示 Every Eval Ever 的评测结果,这件事对日常选型很实际:开发者不用只靠模型卡里的自述、排行榜截图或社区帖子来判断模型能力,而是可以在模型页面附近看到更多结构化评测信号。它不会替你做最终决策,但能把“先筛一轮候选模型”的成本降下来。 大模型选型最麻烦的地方,不是找不到模型,而是同名、同尺寸、同架构变体...