AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

Sir Demis Hassabis vs Sir Demis Hassabis

22:30 Gary Marcus:The Road to AI We Can Trust(RSS) 精选 59 DeepMind 大佬观点 现象/趋势 推荐理由: Gary Marcus 翻出 Hassabis 自己的话,两条 AI 时间线互相打脸,这对 DeepMind 的 AGI 叙事是个精准回击。

DeepMind 大佬观点 现象/趋势
AI HOT ·

Nemotron 3 Ultra 现已面向 Perplexity 和 Computer 上的 Pro 和 Max 订阅用户开放。 这是@nvidia 为长期运行的智能体打造的全新开源模型。

03:19 Perplexity @ perplexity_ai 精选 69 智能体 产品更新 开源/仓库 推荐理由: Nemotron 3 Ultra 加入 Perplexity,主打长任务代理且完全开放,Pro 用户点开侧边栏就能用,对重度依赖 AI 做多步工作流的人算个实在更新。

智能体 产品更新 开源/仓库
AI HOT ·

Gemma 4 QAT 模型:优化压缩以提升移动设备和笔记本电脑的能效

03:21 Hacker News 热门(buzzing.cc 中文翻译) 精选 70 Google 发布 Gemma 4 QAT 模型,该模型通过量化感知训练(QAT)技术优化压缩,旨在提升移动设备和笔记本电脑上的运行效率与能效。文章来源于 Google 官方博客,介绍了这一面向移动端和笔记本端的模型优化方案。 Google 模型发布 端侧 部署/工程 推荐理由: Google 给 Gemma 4 做了量化感知训练版,在手机上跑能效提升明显,做移动端 AI 应用的直接下权重就能用,这周最实在的端侧优化。 03:21 Hacker News 热门(buzzing.cc 中文翻译) 精选 70 Claude 是否增加了 rsync 中的错误? 一篇 Hacker News 热门帖子(105 分)提出了 Claude 是否导致 rsync 工具中 bug 增加的问题,并附有分析链接。 Anthropic 现象/趋势 编码 推荐理由: 不是给Claude泼脏水,而是用rsync项目真实数据拉警报,AI辅助也许正在增加低级bug,做底层工具的开发者该紧绷这根弦。 03:19 Perplexity @ perplexity_ai 精选 69 Nemotron 3 Ultra 现已面向 Perplexity 和 Computer 上的 Pro 和 Max 订阅用户开放。 这是@nvidia 为长期运行的智能体打造的全新开源模型。 智能体 产品更新 开源/仓库 推荐理由: Nemotron 3 Ultra 加入 Perplexity,主打长任务代理且完全开放,Pro 用户点开侧边栏就能用,对重度依赖 AI 做多步工作流的人算个实在更新。 01:50 Michael Truell @ mntruell 精选 80 与 AI 智能体协作应感觉像与同事协作一样。你应能"与它们交谈"--不仅通过文本聊天,还能一起对着屏幕做手势、实时对话等。 Cursor : With Design Mode, you can now point, draw, or talk to update your UI. 智能体 产品更新 多模态 编码 推荐理由: Cursor 新加的 Design Mode 让改 UI 像跟同事比划屏幕一样自然,手势、画框、说话都能驱动 agent,AI 编程工具第一次有了‘面对面’的感觉。 01:20 Google AI @ GoogleAI 精选 78 Google AI 本周产品更新:Nano Banana 2、Co-Scientist、dreambeans、Gemma 4 等 Google AI 本周发布多项更新:Nano Banana 2 及 Pro 正式 GA,可通过 Gemini Enterprise Agent Platform、Gemini API

Google 模型发布 端侧 部署/工程 Anthropic 现象/趋势 编码 智能体 产品更新 开源/仓库 多模态 MCP/工具 OpenAI 图像生成 行业动态 大佬观点
AI HOT ·

社区基于MiniCPM-V 4.6打造财务分析工具AccountingLLM

21:36 OpenBMB @ OpenBMB 精选 66 社区开发者使用面壁智能MiniCPM-V 4.6构建了AccountingLLM(quaesto.com),用于自动化财务文档分析。该工具可上传IPO招股书、年报或审计文件,自动从复杂PDF中提取财务表格、重建跨页表格、对照会计等式检查关键数据,并标记可疑条目供人工审核。开发者已将其商业化,成为实际可用的产品。 产品更新 多模态 行业动态 推荐理由: 这不是又一个AI读财报的demo,而是直接上线接客的商业产品。做财务、审计的可以试试它从招股书里自动扒表格和勾稽检查的实用性。

产品更新 多模态 行业动态
AI HOT ·

Meta 智能眼镜 App 暗藏人脸识别代码,NameTag 功能已推送至超 5000 万设备

22:15 IT之家(RSS) 精选 76 据《连线》今日报道,Meta 通过多次应用更新将人脸识别代码推送到智能眼镜配套 App 中,代号“NameTag”。该功能利用已部署的三个 AI 模型将人脸转换为“人脸特征模板”,与手机本地数据库匹配,识别成功后向佩戴者发送通知。App 下载量超 5000 万次。Meta 回应称代码仅为探索,尚未决定推出,且不会建立中央人脸数据库。此前 Meta 曾因人脸识别问题在伊利诺伊州和得克萨斯州分别达成 6.5 亿美元和 14 亿美元和解。 Meta 多模态 端侧 行业动态 推荐理由: Meta一边付近百亿美元和解金,一边把完整人脸识别代码塞进 5000 万用户的眼镜里,「探索」这个解释太轻巧——代码都推送了,离功能上线只差一个开关。

Meta 多模态 端侧 行业动态
AI HOT ·

开源鸿蒙 OpenHarmony 具身智能版本 EmbodiedAI 1.0.1 发布

22:15 IT之家(RSS) 精选 72 6月5日,开源鸿蒙具身智能PMC(筹)发布EmbodiedAI 1.0.1版本。该版本聚焦机器人控制与智能体应用,升级导航规划、运动控制、仿真开发、硬件适配等核心能力,兼容ROS生态、机器人模拟器及多种本体形态。集成开源鸿蒙原生模拟器、MuJoCo、Gazebo三大仿真环境,打通从代码开发到真机验证的全流程链路。人形机器人、四足机器狗、商用服务机器人等已完成适配验证。目前具身智能方向已组建18个专项SIG工作组,版本源码已正式开放。 产品更新 具身智能 开源生态 推荐理由: 开源鸿蒙的具身智能框架终于从概念走向工程交付,EmbodiedAI 1.0.1 打通仿真和真机,对于不想被ROS绑架的机器人团队是个新选择。

产品更新 具身智能 开源生态
AI HOT ·

你的 Agent 还在全网垃圾里捞内容?不如先喂它 375 个高质量微信公众号 RSS 源。 🔽

14:07 ginobefun @ hongming731 精选 78 ginobefun : http://x.com/i/article/2062762354149146624 智能体 检索增强 搜索 教程/实践 推荐理由: 这个整理直接命中了 Agent 在中文垃圾信息里捞内容的痛点,375 个高质量公众号 RSS 源,做中文信息追踪的可以直接导入,比全网乱爬靠谱太多。

智能体 检索增强 搜索 教程/实践
AI HOT ·

PolarDB-X Zero 上线了! 无需注册。无需配置。只需一次 API 调用。 30 秒内获得一个全分布式数据库。 原生 HNSW 向量索引--内置兼容 MySQL 的引擎。 关系型 + 语义搜索--一条 SQL 语句。 AI 智能体就绪--MCP 协议、AI IDE 兼容(Cursor、Claude、Qoder、Qodex 等) 立即尝试:https://zero.polardbx.com #AlibabaCloud #PolarDB #ApsaraDB

14:22 Alibaba Cloud @ alibaba_cloud 精选 76 MCP/工具 产品更新 部署/工程 推荐理由: PolarDB-X Zero 把分布式数据库、向量索引和 MCP 协议打包成一行 API,30 秒就能跑一个 AI Agent 可用的混合搜索后端,做 agent 开发的可以试一下。

MCP/工具 产品更新 部署/工程
AI HOT ·

阿里云发布SkillClaw与Nacos的Agent技能进化循环

14:22 Alibaba Cloud @ alibaba_cloud 精选 65 阿里云推出SkillClaw与Nacos结合,构建AI智能体技能进化流水线。关键特性:自动从真实对话中提取经验并封装为可复用技能(Skill);Nacos负责集中化版本管理、审核与审计;打破本地孤岛,实现团队安全共享与分发;形成完整的"生成-治理-分发"持续进化闭环。目标是将个人洞察转化为团队的AI资产。 智能体 产品更新 部署/工程 推荐理由: 阿里云把 Agent 经验沉淀做成了闭环,从个人踩坑到团队共享一条龙,这对企业 AI 落地是个真信号,做 Agent 平台的可以看看架构。

智能体 产品更新 部署/工程
AI HOT ·

腾讯混元联合人大开源PlanningBench评估框架

15:57 Tencent Hy @ TencentHunyuan 精选 74 腾讯混元(Tencent Hunyuan)与中国人民大学高瓴人工智能学院合作,开源PlanningBench——一个可扩展、可验证的LLM规划能力评估与训练框架。该框架包含30+真实世界规划任务,支持自动验证和训练。PlanningBench旨在推动LLM从“说”到“做”的规划能力发展。资源已发布于arXiv、GitHub及HuggingFace。 智能体 arXiv GitHub 开源/仓库 推荐理由: 腾讯混元联合人大开源的 PlanningBench,补上了 LLM 从「会说」到「会做」之间规划能力评估的缺口,做 Agent 的同学可以直接用来评测和训练,开源即用。

智能体 arXiv GitHub 开源/仓库
AI HOT ·

Satya Nadella 在 Latent Space 发布最新访谈,链接见原文。原推文仅评论"chat is he cooked"。

19:19 swyx @ swyx 精选 75 swyx : @MatthewBerman @saranormous @NoPriorsPod @latentspacepod @satyanadella @Microsoft here! https://www.latent.space/p/satya... Microsoft 大佬观点 推荐理由: swyx 对 Satya 的一对一访谈,微软 CEO 谈 AI 战略的一手信息远比新闻稿有温度,关心大厂路线的人值得读完原文。

Microsoft 大佬观点
AI HOT ·

腾讯高级执行副总裁汤道生:今年腾讯大部分代码都由 AI 生成

11:14 IT之家(RSS) 精选 71 在 6 月 5 日的腾讯云 AI 产业应用大会上,腾讯高级执行副总裁汤道生表示,今年腾讯大部分代码都由 AI 生成,工程师将更多时间用于架构设计,定期指导与修正 AI 输出。腾讯 2026 年 Q1 财报显示,重组后的 AI 研发团队重构了基础设施,并搭建了 Hy3 preview 模型。腾讯总裁刘炽平今年 3 月透露,去年腾讯在 AI 新产品上投入 180 亿元,今年投入至少翻倍。 编码 行业动态 推荐理由: 腾讯高管公开说今年大部分代码是AI写的,这个数据比谷歌微软还激进,对国内开发者的信号很明确,会写代码不再是护城河,能设计架构才是。

编码 行业动态
AI HOT ·

Open Code Review - 一款基于人工智能的代码审查命令行工具

13:19 Hacker News 热门(buzzing.cc 中文翻译) 精选 80 Open Code Review 是一个基于人工智能的代码审查命令行(CLI)工具,旨在帮助开发者通过自动化的方式提升代码审查效率。 GitHub 开源/仓库 编码 推荐理由: 阿里出的 AI 代码审查 CLI,直接把 review 塞进终端,命令行党会喜欢。但这类工具已不新鲜,关键看它能不能比 GitHub Copilot 的 review 更懂你的代码。

GitHub 开源/仓库 编码
AI HOT ·

NVIDIA CEO 黄仁勋访问首尔:与韩国共建 AI 未来

14:04 NVIDIA AI Blog 精选 63 NVIDIA 创始人兼 CEO 黄仁勋本周到访首尔,会见韩国的 AI 建造者、主权基础设施合作伙伴及游戏社区。黄仁勋表示,为应对下半年繁忙的 AI 基础设施建设,需对齐 AI 供应链。他指出 Grace Blackwell 系统表现良好,Vera Rubin 已全面投产。他还强调机器人技术将成为韩国的下一个重要产业,并呼吁韩国投资 AI。 具身智能 行业动态 部署/工程 推荐理由: 老黄这次去韩国,关键信息是 Vera Rubin 已经全面量产,下半年 AI 基础设施大扩建,这对整个供应链的节奏是个明确信号,另外他点名机器人是韩国下个爆发点,做硬件的可以留意。

具身智能 行业动态 部署/工程
AI HOT ·

Anthropic 称其最新 AI 模型 Mythos 显现脱离人类控制迹象,呼吁全球暂缓先进 AI 研发

10:14 IT之家(RSS) 精选 79 Anthropic 发布报告称其最新 AI 模型已显现脱离人类控制迹象,呼吁全球暂缓前沿 AI 开发,以便社会制度建设和对齐研究跟上进展。该公司主张美国、中国等主要 AI 公司达成共识,发布可验证的规则,并类比“核武器不扩散条约”,但指出 AI 更难监管。该观点引发美国白宫部分官员不满,批评其夸大风险。Anthropic 计划未来数月召集各方探讨全球协调机制如何运作。 Anthropic 安全/对齐 行业动态 推荐理由: Anthropic呼吁暂缓AI研发,虽然被白宫官员批「夸大风险」「给对手使绊」,但Mythos模型确实够强。这份报告是道德信号还是商业博弈,值得细看。

Anthropic 安全/对齐 行业动态
AI HOT ·

Anthropic 开源 AI 驱动漏洞发现框架

05:47 Hacker News 热门(buzzing.cc 中文翻译) 精选 70 Anthropic 将其用于 AI 驱动漏洞发现的开源框架代码托管在 GitHub 上。该框架借助 AI 技术进行漏洞发现,旨在帮助识别软件中的安全缺陷。 Anthropic 安全/对齐 开源生态 推荐理由: Anthropic 开源了一个专门测试 AI 编码助手漏洞发现能力的框架,做安全方向的开发者和红队成员可以直接用,比空谈对齐务实的多。

Anthropic 安全/对齐 开源生态
AI HOT ·

共存与协同智能的终结

05:56 Ethan Mollick:One Useful Thing(RSS) 精选 73 Ethan Mollick 在 One Useful Thing 博客中,以“共存与协同智能的终结”为题,并附带介绍了如何向 AI 推销一本书。 智能体 大佬观点 推荐理由: Ethan Mollick 宣告「协同智能」时代结束,这个判断如果成立,所有依赖人机协作的产品设计都得重新思考。他的观点总是超前的,这篇值得点开看看。

智能体 大佬观点
AI HOT ·

今天,我们推出又一项呼声很高的功能:来源归属!🥳 无需再猜测。现在你可以看到每个创作物背后所用的确切公式(提示词 + 来源)。想要调整?只需轻点"迭代",随心定制 💖

06:03 NotebookLM @ NotebookLM 精选 68 Google 产品更新 推荐理由: NotebookLM 终于开放了 Source Attribution,能看到每个 artifact 背后的 prompt 和来源,还能直接迭代,对经常用做资料整理的重度用户是个实在的升级。

Google 产品更新
AI HOT ·

使用适用于 macOS 的 Gemini 应用,获取针对屏幕内容的定制帮助。💻 只需同时按下两个 Command ⌘ 键,即可将当前活动窗口无缝附加到聊天中,无需手动截图或切换标签页。

06:07 Google Gemini @ GeminiApp 精选 73 Google 产品更新 推荐理由: Gemini for macOS 这个按双 Command 就分享当前窗口的功能,比手动截图快得多,如果你已经把 Gemini 当日常助手,更新后交互会更无缝。

Google 产品更新
AI HOT ·

OpenRouter 翻遍 11 款 LLM 找最快的决策模型:Claude vs. Grok 领衔

06:28 OpenRouter:Announcements(RSS) 精选 66 OpenRouter 用总价 482 美元的推理花费,让 11 款大语言模型在 30 轮实时决策的“大逃杀”挑战中正面竞争。实验结果表明,传统的静态 benchmark 排名无法反映模型在需要即时反应的智能体任务(如自主控制机器人)中的真实表现,Claude 和 Grok 系列模型在决策速度与任务成功率上表现突出,而多项高分模型的实时调度能力未达预期。 智能体 评测/基准 推荐理由: OpenRouter 让 11 个模型打了 30 局生存竞技,发现直播胜率和榜单差异很大,以后选模型不能只看跑分,得看它在压力下用谁的脑子。

智能体 评测/基准