AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

微软与OpenAI分道扬镳--如今双方准备正面交锋

22:07 The Verge:订阅版科技(RSS) 精选 82 微软与OpenAI的合作关系已彻底破裂,双方进入正面竞争态势。前DeepMind高管、现任微软AI主管Mustafa Suleyman明确表示,微软现在必须从头证明自己能独立完成所有必需的任务。这标志着两家科技巨头从紧密合作伙伴转变为直接竞争对手。 Microsoft OpenAI 行业动态 推荐理由: 微软和OpenAI正式分手,Mustafa Suleyman放话要从头自研。这对整个AI生态的重构不亚于当年谷歌收购DeepMind,开发者选边站的压力一下子变真实了。

Microsoft OpenAI 行业动态
AI HOT ·

超越聊天机器人的直接偏好优化

21:41 Hugging Face:Blog(RSS) 精选 57 Dharma-AI 在 Hugging Face 博客发文,探讨直接偏好优化(Direct Preference Optimization,DPO)在聊天机器人之外的更广泛应用场景。 Hugging Face 数据/训练 现象/趋势 推荐理由: DPO 不只用在聊天机器人调参上,这篇文章把它的边界推到了其他生成任务,做对齐和偏好优化的开发者值得一读,但别指望读完就能用。

Hugging Face 数据/训练 现象/趋势
AI HOT ·

NVIDIA CVPR 2026发布三篇Physical AI论文

23:35 NVIDIA @ nvidia 精选 65 NVIDIA Research在CVPR 2026展示三篇Physical AI论文:GraspGen-X是首个零样本抓取基础模型,基于数十亿模拟抓取训练;LCDrive用紧凑潜在表示取代昂贵文本推理;NitroGen是通用游戏AI基础模型,基于NVIDIA Isaac GR00T训练具身智能体。 具身智能 论文/研究 推荐理由: NVIDIA在CVPR一口气放了三篇物理AI论文,GraspGen-X是第一个零样本抓取基础模型,做机器人抓取的人可以开香槟了。

具身智能 论文/研究
AI HOT ·

首届Qwen Cloud全球AI黑客马拉松现已启动! 参与5大高级赛道,在全球舞台上挑战AI智能体极限。 总奖金池超过70,000美元(赛道冠军1万美元)。 立即在Devpost报名:https://click.qwencloud.com/m/20000000281/

18:10 Alibaba Cloud @ alibaba_cloud 精选 65 智能体 行业动态 推荐理由: 阿里云首次搞全球AI黑客马拉松,5赛道、70k美金,对想在真实云环境把agent跑通落地的人是个不错的练手机会,直接报名就行。

智能体 行业动态
AI HOT ·

欧盟公布全面技术主权计划,推动芯片与AI自主发展

20:21 Bloomberg:Technology(RSS) 精选 76 欧盟公布一项全面技术主权计划,旨在扩大本土半导体、人工智能和云计算供应链,以减少对美国和亚洲的依赖。该计划覆盖芯片制造、AI基础设施及云计算服务等多个关键领域,目标是增强欧洲在核心技术上的自主能力。 政策/监管 推荐理由: 欧盟这次技术主权计划,打包了芯片、AI和云计算的整套方案,不只是政策口号,更可能是一份强制性的采购清单,做欧洲市场生意的都得重新看合规成本。

政策/监管
AI HOT ·

介绍 Claude Partner Network 的 Services Track 和 Partner Hub

21:30 Anthropic:Newsroom(网页) 精选 59 Anthropic 扩展 Claude Partner Network,推出 Services Track 分级体系和 Partner Hub 门户。Services Track 设 Select、Preferred、Global Premier 三级,按认证人数、投产客户数及客户推荐信量化评定。Partner Hub 提供每日更新仪表盘和公开目录,方便合作伙伴查看进展、客户寻找供应商。该网络三月启动以来已有超 4 万家公司申请,逾 1 万顾问获认证;Accenture 训练 3 万人,Cognizant 部署约 35 万员工,Deloitte 惠及 47 万人,KPMG 覆盖 27.6 万,Infosys 构建行业智能体,PwC 先在美推广再扩至全球。 Anthropic 产品更新 行业动态 部署/工程 推荐理由: Anthropic 给合作伙伴画了一条明确的爬升阶梯,从 Select 到 Global Premier,企业客户终于有个公开透明的渠道找靠谱的实施团队,做 AI 咨询的可以认真评估入局了。

Anthropic 产品更新 行业动态 部署/工程
AI HOT ·

智能性价比

21:37 Tomer Tunguz 博客(VC 分析) 精选 66 微软在模型发布卡中首次加入平均token使用量指标。其模型在SWE-Bench Verified上达71.6分,仅消耗约Claude Haiku 4.5三分之一的token。Artificial Analysis的Intelligence Index显示GPT 5.5与Claude Opus 4.8得分相近(约60分),但Opus 4.8运行成本高出40%($4,685 vs $3,357)。Uber因四个月内AI预算超支而限制员工使用;Salesforce花费$3亿购买Anthropic tokens并冻结工程招聘。模型公司如今需同时在性能和成本两个维度竞争。 Microsoft OpenAI 推理 现象/趋势 推荐理由: 微软在模型发布卡上悄悄加了“平均token消耗”这个指标,这不是小改动,而是宣告AI从堆算力转向算账时代。Uber和Salesforce的预算教训已经很清楚了。

Microsoft OpenAI 推理 现象/趋势
AI HOT ·

🏆 Cosmos 3 刚刚登顶 7 个物理 AI 排行榜。 NVIDIA CosmosTM 3,面向物理 AI 的开放全模态模型,在世界生成、机器人行动策略和工业视觉理解方面均排名第一。 🌎 世界生成:Artificial Analysis、PAI-Bench、Physics-IQ、R-Bench 🤖 机器人策略:RoboLab 👁️ 视觉:VANTAGE-Bench、TAR 一个模型。覆盖物理 AI 的每个领域。 现已可通过 Hugging Face 获取 ▶️ https://nvda.ws/4e09TbR

01:06 NVIDIA @ nvidia 精选 84 Hugging Face 具身智能 开源生态 模型发布 推荐理由: NVIDIA 把一个开放模型同时推到世界生成、机器人策略和工业视觉第一,做物理 AI 的人今天就该下载试一下。

Hugging Face 具身智能 开源生态 模型发布
AI HOT ·

OpenAI 提出前沿 AI 民主治理蓝图,呼吁建立联邦安全框架

01:10 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 67 OpenAI 发布了一份针对美国前沿 AI 治理的蓝图,提出建立联邦层面的框架,以保障安全性、韧性和国家安全。该蓝图聚焦于前沿 AI 的民主治理,强调通过政府监管与行业协作来应对潜在风险。 OpenAI 安全/对齐 政策/监管 推荐理由: OpenAI主动抛出联邦监管蓝图,在硅谷普遍抵触管制的氛围下算是反直觉,政策制定者和AI公司都得仔细看看。

OpenAI 安全/对齐 政策/监管
AI HOT ·

OpenAI 公共政策议程

01:10 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 63 OpenAI 公布其 AI 公共政策议程,涵盖安全、青少年保护、劳动力转型和全球标准四大领域,旨在确保 AI 技术造福全社会。 OpenAI 安全/对齐 政策/监管 推荐理由: OpenAI 首次系统性地拿出政策议程,安全、青年保护、劳动力转型这些切口很精准,做 AI 治理和政策的人应该认真看一下。 01:10 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 67 OpenAI 提出前沿 AI 民主治理蓝图,呼吁建立联邦安全框架 OpenAI 发布了一份针对美国前沿 AI 治理的蓝图,提出建立联邦层面的框架,以保障安全性、韧性和国家安全。该蓝图聚焦于前沿 AI 的民主治理,强调通过政府监管与行业协作来应对潜在风险。 OpenAI 安全/对齐 政策/监管 推荐理由: OpenAI主动抛出联邦监管蓝图,在硅谷普遍抵触管制的氛围下算是反直觉,政策制定者和AI公司都得仔细看看。 01:08 xAI @ xai 精选 70 试试 @Vapi_AI 上最自然的TTS和性价比最高的STT API。 来自 @xai 的Grok STT和Grok TTS现已在企业语音AI平台Vapi上线。基于Vapi构建自定义语音智能体,可让它们用客户的语言交流、在受监管的工作流中捕捉重要细节,并在每次通话中明显更具人性化。 Vapi : Grok STT and Grok TTS from @xai are now live on Vapi, the platform for enterprise voice AI. Build on Vapi to create cust... xAI 产品更新 语音 推荐理由: xAI 的语音 API 首次通过平台落地,对正在搭建语音代理的团队是低门槛尝鲜选择,但功能和生态还在早期。 01:06 NVIDIA @ nvidia 精选 84 🏆 Cosmos 3 刚刚登顶 7 个物理 AI 排行榜。 NVIDIA CosmosTM 3,面向物理 AI 的开放全模态模型,在世界生成、机器人行动策略和工业视觉理解方面均排名第一。 🌎 世界生成:Artificial Analysis、PAI-Bench、Physics-IQ、R-Bench 🤖 机器人策略:RoboLab 👁️ 视觉:VANTAGE-Bench、TAR 一个模型。覆盖物理 AI 的每个领域。 现已可通过 Hugging Face 获取 ▶️ https://nvda.ws/4e09TbR Hugging Face 具身智能 开源生态 模型发布 推荐理由: NVIDIA 把一个开放模型同时推到世界生成、机器人策略和工业视觉第一,做物理 AI 的人今天就该下载试一下。 00:58 Replit ⠕

OpenAI 安全/对齐 政策/监管 xAI 产品更新 语音 Hugging Face 具身智能 开源生态 模型发布 部署/工程 端侧 论文/研究 智能体 Google 开源/仓库 Microsoft 推理
AI HOT ·

Sensor Tower:OpenAI 旗下 ChatGPT 月活已破 10 亿,史上最快

10:09 IT之家(RSS) 精选 75 据市场情报机构 Sensor Tower 估计,OpenAI 旗下 ChatGPT 全球月活跃用户在 2025 年 5 月突破 10 亿,成为达成此里程碑最快的应用,增速超过 Google Maps、TikTok 等。同期,其竞争对手 Anthropic 的 Claude 月活达 5600 万,同比增幅约 640%,增长势头迅猛。数据显示,部分用户已开始在 Claude 与 ChatGPT 间切换使用。在达成用户里程碑之际,Anthropic 已秘密递交 IPO 申请,OpenAI 也计划筹备上市。 Anthropic OpenAI 现象/趋势 行业动态 推荐理由: ChatGPT 月活破 10 亿是 AI 从工具变成基础设施的关键节点,但 Claude 年增 640% 信号更凶猛,做 AI 应用的人得开始看谁在蚕食谁的时间。

Anthropic OpenAI 现象/趋势 行业动态
AI HOT ·

斯坦福大学法学院研究:人工智能的表现优于法学教授

11:05 Hacker News 热门(buzzing.cc 中文翻译) 精选 75 斯坦福大学法学院的一项研究表明,人工智能的表现优于法学教授。该发现引发了广泛关注,在Hacker News平台获得了104个Points。 推理 论文/研究 推荐理由: 斯坦福法学院自己下场测的,AI在法律考试上超过教授,虽然不是什么新题型,但官方自己出这种结果,对法律科技赛道是个真信号。

推理 论文/研究
AI HOT ·

世界模型与语言模型:论具体推理与抽象推理的互补性

12:42 HuggingFace Daily Papers(社区热门论文) 精选 70 本研究探讨了世界模型与多模态大语言模型在预测未来状态时的互补性。世界模型可生成具体的视觉未来轨迹,但可能视觉合理却任务错误;多模态大语言模型则擅长抽象推理。为此,研究提出了“受控的具体推理”框架,并构建了VRQABench和OpenWorldQA两个基准。同时,提出了Privileged-Future On-Policy Self-Distillation(PF-OPSD)方法,该方法在训练时利用真实未来视频作为特权上下文评估推理轨迹,但部署时无需真实未来。实验结果显示,PF-OPSD在两个基准上分别比基线高出10.6%和10.9%,并提升了对噪声或冲突轨迹的鲁棒性。 智能体 多模态 开源/仓库 推理 推荐理由: 世界模型靠视觉预测,语言模型靠抽象推理,这篇把两者真正拧在一起了。用未来视频做自我蒸馏提升 10%,还给全开源,做 agent 决策的可以认真看看‘什么时候不信自己的眼睛’是怎么训出来的。

智能体 多模态 开源/仓库 推理
AI HOT ·

消息称 DeepSeek 首轮融资拟筹集 500 亿元,腾讯、宁德时代等参投

13:09 IT之家(RSS) 精选 70 DeepSeek 计划在首轮融资中从腾讯、宁德时代等投资方处筹集约 500 亿元人民币。融资落地后,其投后估值预计在 3500 亿至 4000 亿元。创始人梁文峰将出资 200 亿元,腾讯和宁德时代分别拟投资 100 亿元和 50 亿元,成为最大外部投资者。DeepSeek 去年凭借 V3 大模型与 R1 推理模型获得广泛认可。此次融资凸显了中国正打造从大模型到算力能源基建的全链条 AI 产业。 DeepSeek 行业动态 推荐理由: DeepSeek 第一轮就 500 亿、估值直奔 4000 亿,腾讯和宁德时代入局,这已经不是一家公司的融资,而是中国 AI 产业链上下游的一次正式组队。

DeepSeek 行业动态
AI HOT ·

官方 Hermes Agent 桌面应用现已推出!

14:06 SiliconFlow @ SiliconFlowAI 精选 71 Nous Research : The next evolution of Hermes Agent is here! Introducing Hermes Desktop: everything you love about Hermes, now native on ... 智能体 产品更新 开源生态 推荐理由: Hermes 的桌面版把 Agent 能力直接装进本地,不用折腾环境,开发者可以立刻体验在 GTC 上演示的体验,公测阶段值得尝鲜。

智能体 产品更新 开源生态
AI HOT ·

@karpathy 的 llm-wiki 在几周内获得了 5,000+ 颗星。 其理念是:停止在每个会话中重新发现知识。让一个大语言模型构建并维护一个维基,每次使用时它都会变得更智能。 以下是如何使用 @opencode + @justsisyphus OMO + SiliconFlow 构建你自己的版本 🧵

14:36 SiliconFlow @ SiliconFlowAI 精选 67 开源生态 教程/实践 推荐理由: 把 karpathy 的 llm-wiki 创意拆成了可复制的 recipe,跟着教程用 SiliconFlow + opencode + OMO 就能搭一个自进化的知识库,相当实用。

开源生态 教程/实践
AI HOT ·

Anthropic 分析 832 个 AI 恶意账户:中高风险攻击者半年从 33% 跃至 56%

17:51 Anthropic:Research(发表成果 · 网页) 精选 69 Anthropic 分析 2025 年 3 月至 2026 年 3 月间 832 个被封禁的恶意账户,映射至 MITRE ATT&CK 框架。67.3% 使用 AI 编写恶意软件,6.5% 用于横向移动。六个月间中高风险攻击者占比从 33% 升至 56%。AI 用于账户发现增长 8.9%,AI 辅助钓鱼下降 8.6%。传统基于技术数量或平台(Claude Code、API、聊天界面)的威胁评估失效,而 MITRE ATT&CK 框架尚未收录此类智能体编排行为。 Anthropic 安全/对齐 论文/研究 关联讨论 1 条 Anthropic:Newsroom(网页) 推荐理由: 这份报告用一整年的真实案例揭示了AI攻击正从初始入侵转向深度潜伏,连MITRE ATT&CK框架都开始跟不上。安全从业者值得一读,它告诉你下一波威胁长什么样。

Anthropic 安全/对齐 论文/研究
AI HOT ·

这项行政令是加强美国AI领导地位的重要一步。 我们期待与白宫合作,支持其实施。 https://www.whitehouse.gov/presidential-actions/2026/06/promoting-advanced-artificial-intelligence-innovation-and-security/

05:55 Anthropic @ AnthropicAI 精选 69 Anthropic 政策/监管 行业动态 关联讨论 5 条 TechCrunch:AI(RSS) The Verge:AI(RSS) Bloomberg:Technology(RSS) IT之家(RSS) X:Rohan Paul (@rohanpaul_ai) 推荐理由: Anthropic 对白宫 AI 行政令的官方表态,信号意义大于实质内容,但头部公司主动拥抱政策制定是趋势,值得留意后续落地细节。

Anthropic 政策/监管 行业动态