我们已超越理论阶段。 有史以来第一次,Figure的机器人数量超过了人类员工数量。
05:55 Rohan Paul @ rohanpaul_ai 精选 78 Brett Adcock : For the first time, robots now outnumber humans at Figure 具身智能 行业动态 推荐理由: Figure 的机器人数量首次超过人类员工,这不是公关噱头,而是人形机器人从 demo 走向规模制造的真信号,做硬件的同行该认真关注了。
AI and technology watch
聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。
05:55 Rohan Paul @ rohanpaul_ai 精选 78 Brett Adcock : For the first time, robots now outnumber humans at Figure 具身智能 行业动态 推荐理由: Figure 的机器人数量首次超过人类员工,这不是公关噱头,而是人形机器人从 demo 走向规模制造的真信号,做硬件的同行该认真关注了。
03:55 Hacker News 热门(buzzing.cc 中文翻译) 精选 75 上周,参议员Ted Cruz和Ron Wyden提出两党法案JAWBONE Act,为受政府胁迫的广播商、互动计算机服务商及AI提供商创建针对政府官员的联邦诉讼权,并建立政府与中间方就用户表达问题沟通的透明度体系。法案旨在应对政府施压私营公司审查受第一修正案保护的言论。EFF支持该法案,并举证:2025年6月联邦高官威胁起诉ICEBlock创建者,同年10月司法部长要求苹果下架该应用。EFF还提起信息自由诉讼,要求披露政府与苹果、谷歌、Meta的沟通记录。 政策/监管 推荐理由: 一项两党法案将允许起诉政府官员胁迫平台审查合法言论,并建立透明沟通记录制度,EFF 以 ICEBlock 被下架案为例说明其必要性,但平衡合法沟通与过度干预是关键,值得关注立法进程。
01:14 Dwarkesh Patel:Podcast & Blog(RSS) 精选 60 智能的一种定义是样本效率,但近年AI进步主要靠扩充数据分布和增加算力。强化学习本质是合成数据生成——投入大量算力通过验证器筛选“好”数据,再训练模型预测正确输出。这一过程需要每个领域和技能的海量人类专家示例,数据行业年收入已达数十亿美元。近日Epoch报告,开源模型仅落后前沿闭源模型4个月,原因在于数据可从公开API蒸馏,而超参数等不易复制。人类一生接触约2亿token,前沿模型训练在数十到数百T token之间,相差近百万倍——机器人、自动驾驶等领域同样存在巨大效率差距。 大佬观点 数据/训练 现象/趋势 推荐理由: Dwarkesh 把 AI 的‘笨’归因于数据效率远低于人类,计算虽简但直指要害,他给出的一个逆向洞察是开源模型四个月追上闭源,正是数据驱动进步的最好证据。
02:53 宝玉 @ dotey 精选 75 宝玉分享 baoyu-design Skill 的迭代过程:用户测试发现导出问题(样式表未铺满整页、渐变色丢失),他在本地复现后让 Agent 分析原因、给出解决方案并添加测试覆盖,修复后效果改善。该 Skill 可在制作 PPT、动画视频或网站时调用 AI 生图配图,支持 Codex 内置画图或配合 baoyu-image-gen Skill 调用 Codex CLI 画图,并能连同图片一起导出为 PPTX,在 PowerPoint/Keynote 中二次编辑。迭代循环:自己用 → 发现问题 → 让 Agent 分析 → 出方案 → 确认 → 更新 Skill。 宝玉 : baoyu-design skill 更新:可以在制作 PPT、动画视频或者网站时调用 AI 生图技能配图了,当然需要你本地 Agent 有配置画图 Skill。 如果是 Codex 可以直接调用内置画图工具,如果你用 Claude Cod... 智能体 教程/实践 推荐理由: 宝玉分享了一套用 Agent 自我诊断、自动修复 Skill 的迭代方法,从复现 bug 到让 AI 提出解决方案,开发者的打磨循环变成纯对话了,做 Agent 工具的人可以直接套用。
18:01 公众号:卡尔的AI沃茨 精选 77 Humanize PPT v0.9 是一款专为演讲场景设计的PPT Skill,核心通过AST(Audience, State, Transfer)逻辑重新编排大纲,将页面渲染外包给下游Skill。渲染前先输出4张真实预览页,并将图片、视频素材的占位与生成prompt写入大纲。新增质检环节自动修复常见渲染问题,并支持演讲模式:按S键在独立窗口显示演讲稿备注,按ESC键打开全局索引快速跳页。项目已开源至github.com/LearnPrompt/humanize-ppt,由卡尔 & yc星辰开发。 GitHub MCP/工具 开源/仓库 推荐理由: 卡尔把 AI 做 PPT 的坑全趟了一遍,这套工具体系让页面从‘好看’变成‘能讲’,做演讲的人可以抄作业了。
20:51 elvis @ omarsar0 精选 75 开源/仓库 教程/实践 视频 推荐理由: Elvis 新做的 /youtube-notetaker skill 能直接从 YouTube 视频提取幻灯和笔记,学生和 UP 主会很受用,对业界整体没什么推动,但实用度很高。
21:59 Nathan Lambert:Interconnects(RSS) 精选 56 近期行政命令、国会提案及对Anthropic最先进模型的境外访问限制,可能开启新一轮AI监管。开源软件已支撑全球90%以上软件并创造8万亿美元经济价值,在教育、创新和竞争三方面持续赋能。Anthropic与OpenAI的封闭模型加剧市场集中,开源(尤其开放权重)是初创公司、教育机构和企业获得替代方案的唯一平衡力量。开源透明性使其更安全,更多工程师可剔除不需要的模型行为或修复漏洞。以中国竞争为由监管开源将适得其反,美国初创公司正依赖包括中国在内的开源模型提升效率。 大佬观点 开源生态 政策/监管 推荐理由: 在华盛顿弥漫监管 AI 空气的当下,这篇文章是对‘禁止开源 AI’冲动的清晰反驳。它系统梳理了开源在教育、创新和竞争中不可替代的价值,尤其适合对政策走向摇摆不定的人阅读。
22:00 Cloudflare Blog 精选 62 Cloudflare 在 Workers 上推出临时账户(Temporary Accounts),允许 AI 智能体直接运行 `wrangler deploy --temporary`,在数秒内获取一个可用的实时 Worker,无需绕开面向人类设计的部署流程。该功能旨在降低智能体部署门槛。 智能体 MCP/工具 产品更新 部署/工程 关联讨论 1 条 Simon Willison 博客 推荐理由: Cloudflare 给 agent 开临时账号这个功能很聪明,一步解决了身份验证和资源清理的麻烦,做智能体部署的可以认真试试。 21:59 Nathan Lambert:Interconnects(RSS) 精选 56 禁止开源AI将是一个错误 近期行政命令、国会提案及对Anthropic最先进模型的境外访问限制,可能开启新一轮AI监管。开源软件已支撑全球90%以上软件并创造8万亿美元经济价值,在教育、创新和竞争三方面持续赋能。Anthropic与OpenAI的封闭模型加剧市场集中,开源(尤其开放权重)是初创公司、教育机构和企业获得替代方案的唯一平衡力量。开源透明性使其更安全,更多工程师可剔除不需要的模型行为或修复漏洞。以中国竞争为由监管开源将适得其反,美国初创公司正依赖包括中国在内的开源模型提升效率。 大佬观点 开源生态 政策/监管 推荐理由: 在华盛顿弥漫监管 AI 空气的当下,这篇文章是对‘禁止开源 AI’冲动的清晰反驳。它系统梳理了开源在教育、创新和竞争中不可替代的价值,尤其适合对政策走向摇摆不定的人阅读。 20:51 elvis @ omarsar0 精选 75 YT 视频 -> Artifacts 看看我如何使用新的 /youtube-notetaker 技能从 YT 视频生成 Artifacts。 捕获幻灯片、笔记、转录内容…… 快去试试 ↓ 开源/仓库 教程/实践 视频 推荐理由: Elvis 新做的 /youtube-notetaker skill 能直接从 YouTube 视频提取幻灯和笔记,学生和 UP 主会很受用,对业界整体没什么推动,但实用度很高。 18:01 公众号:卡尔的AI沃茨 精选 77 Humanize PPT v0.9:为演讲而生的开源PPT Skill Humanize PPT v0.9 是一款专为演讲场景设计的PPT Skill,核心通过AST(Audience, State, Transfer)逻辑重新编排大纲,将页面渲染外包给下游Skill。渲染前先输出4张真实预览页,并将图片、视频素材的占位与生成prompt写入大纲。新增质检环节自动修复常见渲染问题,并支持演讲模式:按S键在独立窗口显示演讲稿备注,按ESC键打开全局索引快速跳页。项目已开源至github.c
00:21 Demis Hassabis @ demishassabis 精选 72 John Jumper : A bit of news: After nearly 9 years, I have decided to leave Google DeepMind and join Anthropic (after taking some time ... Anthropic Google 行业动态 关联讨论 5 条 X:Kim (@kimmonismus) X:阿易 AI Notes (@AYi_AInotes) Hacker News 热门(buzzing.cc 中文翻译) IT之家(RSS) X:Berry Xia (@berryxia) 推荐理由: John Jumper 是 AlphaFold 背后的关键科学家,他离开 DeepMind 转投 Anthropic,是个不大不小的信号,顶级 AI 人才正在重新站队,对安全和对齐的重视可能成为新一轮人才争夺的核心。
13:19 AYi @ AYi_AInotes 精选 79 阿里开源内部向量数据库Zvec,pip install zvec免费使用,对标Pinecone每月70美元能力。支持十亿向量毫秒级检索,无需单独起服务,全平台兼容;v0.5.0新增原生全文混合搜索。UCSD黄碧薇教授(causal-learn作者)提出AI四代范式:相关性小模型→因果小模型→相关性大模型(LLM)→因果大模型,认为当前正站在第四代门口。其创立的Aether AI完成首轮融资,致力于从视频中自动抽取物理规律,探索下一代因果AI范式。 AYi : 人类到今天都写不出一颗煎蛋的物理方程, 一颗鸡蛋打进热油锅,它怎么凝固、怎么摊开、边缘怎么变焦, 没有任何一个公式能描述清楚,这种例子在物理世界里多到数不过来。 而这恰恰是当下通用 AI 范式的天花板,视频生成、VLA 学的都是像素层面的统... 检索增强 产品更新 开源生态 搜索 推荐理由: 阿里把内部跑了多年的向量数据库开源了,pip一行直接跑,十亿级毫秒检索还不占额外服务,做RAG和搜索的不用再每月给Pinecone交钱,虽然刚起步,但免费生产级轮子值得一试。
13:29 Hacker News 热门(buzzing.cc 中文翻译) 精选 73 Agent Builder 正式上市(GA)。基于 Elasticsearch 的持久化内存层将记忆分为情景、语义、程序三类,分别存入独立索引,各设不同写速率与过期规则。召回采用 BM25 与 Jina v5 稠密向量的 RRF 融合,再经交叉编码器重排序。在 168 道 QA 题评估中,R@10 平均 0.89,零跨租户泄漏。该层可通过支持 MCP 协议的客户端访问,不绑定特定运行时,已开源至 GitHub。 智能体 GitHub MCP/工具 教程/实践 推荐理由: Elastic 把这套代理记忆架构连同评估数据一次性放出来,三种记忆类型、混合召回、衰减和隔离全挤在一个查询里,做 Agent 持久记忆的开发者可以直接抄,召回 0.89 的工程决策讲得清楚。
15:55 HuggingFace Daily Papers(社区热门论文) 精选 75 HumanScale项目比较了自我中心人类视频与遥操作真实机器人轨迹作为具身基础模型预训练数据源。经精心设计的过滤与标注流程后,基于自我中心数据预训练的模型在真实机器人动作预测上验证损失降低24%,分布内任务成功率高52.5%,分布外任务成功率高90%。研究验证了一种可扩展范式:先以人类视频预训练学习多样世界表征,再以少量标注机器人数据微调对齐动作空间。 具身智能 数据/训练 论文/研究 推荐理由: 让机器人看人类干活视频,预训练效果居然比直接用真实机器人数据更好,这个反直觉发现可能彻底改变具身智能的数据策略,做机器人的值得认真读一读。
今日热点 TOP 1 1 6 信源 · 21小时前
12:19 AYi @ AYi_AInotes 精选 76 DeepSeek研究员Deli Chen将AutoResearch协议开源,并发布Self-play综述论文。其AI智能体首次完全自主地在DeepSeek 285B模型上完成完整RL研究闭环——从实验设计、写代码、提交GPU任务、debug到结论总结,全程零人工干预。系统调用了GRPO工具,被视为持续学习研究的开端。 Deli Chen : 🧵 Deli AutoResearch SKILL is now officially open source! 🎉 https://victorchen96.github.io/auto_research/framework.html... 智能体 DeepSeek 开源/仓库 推荐理由: Deli Chen 开源的不是模型,是能让 AI 自己跑通 RL 研究全流程的「后厨系统」,从实验设计到 debug 全自动,五个工程思路可以直接抄作业。
10:56 MarkTechPost(RSS) 精选 75 本教程实现一个基于Salesforce CodeGen的端到端代码生成工作流。从HuggingFace加载CodeGen模型(支持350M、2B、codegen2-1B、codegen25-7b等版本),通过自然语言提示生成Python函数,随后进行函数提取、语法检查、静态安全检查、单元测试验证、best-of-N候选重排序、多步程序合成、提示词实验、基准可视化及导出。展示了CodeGen作为结构化代码生成流水线的能力,不仅完成代码补全,还能评估、筛选和组织生成结果。 Hugging Face 开源生态 教程/实践 编码 推荐理由: 这篇教程把CodeGen从单纯补全变成一个带安全检查、单元测试和候选重排序的工程化代码生成管道,读完能直接套用到日常写代码里,对想落地的开发者非常友好。
09:27 OpenRouter:Announcements(RSS) 精选 55 一个 OpenRouter API 密钥即可在 SillyTavern 的下拉菜单中解锁 300 多个模型,其中许多免费。指南包含五步连接流程、推荐尝试的角色扮演模型以及常见错误的修复方法。 教程/实践 推荐理由: 如果你用 SillyTavern 玩角色扮演,这篇官方教程能让你五分钟接上 300+ 模型,但本身只是基础操作指南,没给出新认知。
2 4 信源 · 23小时前
3 4 信源 · 9小时前
2 8 信源 · 1天前
09:27 OpenRouter:Announcements(RSS) 精选 60 OpenClaw 已内置 OpenRouter 支持,一条命令即可为 AI 智能体配置统一密钥、统一账单,并实现跨 300 多个模型的自动故障转移。同时提供具体设置步骤以及常见错误的修复方法。 智能体 教程/实践 部署/工程 推荐理由: 给用 OpenClaw 搭 agent 的人一个直接可用的集成指南,还附带了常见报错修复,比零散摸索省时间。
有任何建议或问题,欢迎告诉我们
感谢您的反馈!