AI HOT
·
2026-06-27 00:00
00:10 Google Blog:AI(RSS) 精选 57 本周,Google Finance 推出正式版 Android 应用,同步上线全球投资组合跟踪功能。用户可通过截图、CSV/PDF 上传或文字描述创建组合,并利用 AI 研究工具提问资产配置、固定收益影响等问题。新增市场情报简报功能:用户设定任务(如每日盘前简报),后台自动生成并推送至 Google 应用(Android/iOS)及网页端。Android 应用包含 watchlist、实时数据、金融新闻 feed、AI 研究工具及 AI 驱动的“关键时刻”解释股价波动。未来数月将把更多 web 功能(如财报电话、投资组合与任务)迁移至移动端,今年晚些推出 iOS 应用。 Google 产品更新 推荐理由: 虽然对 AI 行业算不上大新闻,但对散户投资者是个实用升级,能自动盯盘、生成个性化简报,还能用对话式研究挖掘持仓问题,比大多数 AI 功能都更落地。
Google
产品更新
AI HOT
·
2026-06-26 22:19
00:08 The Decoder:AI News(RSS) 精选 73 华盛顿邮报调查显示,多数主流AI聊天机器人在政治问题上明显偏左。OpenAI GPT-5.5在80%回答中仅呈现左派论据;DeepSeek V4 Pro为70%;Anthropic Claude Opus 4.8有43%纯左、57%给出双方观点。xAI的Grok 4.3左倾回答仍多于右倾。右翼平台Gab的Arya左倾回答是右倾的12倍。Google Gemini 3.1 Pro是例外,93%回答同时呈现双方立场。特朗普推动的“反觉醒”AI未能改变这一格局。 Google OpenAI 安全/对齐 评测/基准 推荐理由: 华盛顿邮报对六款主流模型的实测是个重要信号,所有模型默认左倾,连反觉醒的Grok也不例外,只有Gemini坚持给出两边观点。做对齐和治理的人该好好看看这些数据。
Google
OpenAI
安全/对齐
评测/基准
AI HOT
·
2026-06-26 20:10
20:05 Chubby♨️ @ kimmonismus 精选 77 Ornith : Aloha! 🌺 Meet Ornith-1.0, a family of open-source LLMs specialized for agentic coding. Ornith-1.0 spans the full parame... 开源生态 模型发布 编码 推荐理由: 宣称在 agentic coding 上超越 Claude Opus 4.8 的开源 397B 模型,MIT 协议,benchmark 数字漂亮,但如果属实将彻底改变 agent 开发格局,目前最需要独立验证,谨慎对待「好得不像真的」时刻。 13:59 IT之家(RSS) 精选 70 小鹏 CEO 何小鹏:2026 年底自动驾驶可以合法进入全球 小鹏汽车 CEO 何小鹏微博透露,VLA 2.0 走向全球进入确定模式。联合国 WP29 缔约国会议批准了 DCAS UNR 171 series 02(对应城区 NGP 法规)与 UNR ADS(对应 L3-L5 自动驾驶法规)。DCAS 将在六个月后成为欧盟强制法规,即 2026 年底自动驾驶可合法进入全球;UNR ADS 为框架性法规,加速 L4 级 Robotaxi 落地。何小鹏称 2027 年海外小鹏汽车将搭载 VLA 和 VLM,支持中英文混合语音对话。 具身智能 行业动态 推荐理由: 联合国层面批准自动驾驶核心法规,L3以上合法上路进入倒计时,这对小鹏等中国车企出海是实质利好,自动驾驶全球化终于有了法律基础。 12:59 IT之家(RSS) 精选 74 近400家美国报纸起诉微软和OpenAI:未经授权抓取新闻内容训练AI 代表近400家纸媒的出版商联盟向美国纽约南区联邦地区法院起诉微软和OpenAI,指控其未经授权抓取新闻内容用于训练Copilot、ChatGPT等AI模型,侵犯版权并触犯《数字千年版权法》。起诉书称被告“系统性且秘密地”爬取网站,复制文章并删除版权管理信息。原告表示AI产品基于其内容创造数十亿美元价值,但出版商分文未得,称此举或成地方新闻业“丧钟”。OpenAI回应训练数据基于公开可获取内容且符合合理使用原则,微软未置评。 Microsoft OpenAI 行业动态 推荐理由: 近400家报纸集体起诉是迄今为止最大的AI版权诉讼,结果可能决定新闻数据在训练中的合法性边界,媒体和AI公司都该盯着。 12:00 公众号:龙猫LongCat(美团) 精选 69 美团 LongCat 开源 VitaBench 2.0:长期动态智能体基准新标杆 美团 LongCat 团队推出 VitaBench 2.0,首个真实生活场景下针对长期动态用户建模的智能体评测基准。包含56名拟真用户、819个复杂任务、超2000个动态偏好及66个可
开源生态
模型发布
编码
具身智能
行业动态
Microsoft
OpenAI
智能体
评测/基准
Anthropic
MCP/工具
教程/实践
GitHub
图像生成
开源/仓库
现象/趋势
产品更新
安全/对齐
推理
数据/训练
论文/研究
视频
Hugging Face
Google
AI HOT
·
2026-06-26 13:07
22:08 OpenRouter:Announcements(RSS) 精选 71 OpenRouter 推出 MCP 服务器,为编程智能体提供实时模型数据、基准排名、定价和文档查询。开发者通过一键安装(支持 Claude Code、Codex CLI、Cursor 等客户端),即可在编辑器内完成模型筛选、价格对比和测试推理,无需切换标签页。服务器整合 Artificial Analysis、Design Arena 及 OpenRouter 自身排名数据,例如推荐 GLM-5.2 作为性价比最佳的编码模型。工具集包括 models-list、model-get、model-endpoints、benchmarks 等,支持通过 chat-send 发送测试提示,比较不同模型(如 Claude Opus 4.8、GPT-5.5、DeepSeek V4 Pro)的响应、成本和延迟。API 密钥附带 7 天有效期和 10 美元消费上限,可随时撤销。 MCP/工具 产品更新 编码 关联讨论 1 条 X:OpenRouter (@OpenRouter) 推荐理由: OpenRouter 这个 MCP 服务器让编码 agent 直接从编辑器里选模型、查价格、跑测试,省掉了切浏览器查资料的15分钟,做 AI 开发的值得立刻装上。它把模型选择变成了 agent 自己能完成的工作流,而不只是人工猜测。 18:07 The Decoder:AI News(RSS) 精选 73 Meta员工警告AI内容审核部署过快 Meta在2025年已用大语言模型替换约一半人工审核请求,计划年底前将部分内容类型的AI审核比例提升至90%以上,每年节省数十亿美元。Meta否认成本动机,称自3月测试显示其模型错误率比人类低13%,且多捕捉10%违规。但员工指出模型仍会移除或限流无害内容,缺乏足够监督,快速部署已导致外包裁员。此外,Meta已从使用Google Gemini转向自家新基础模型Muse Spark,该模型基于人工审核员的历史决策训练。 Meta 安全/对齐 行业动态 推荐理由: Meta用LLM替换人类审核已过半,年底目标90%以上,员工警告误删和裁员同步发生。AI审核的规模跃迁背后,质量控制争议可能成为社会信任的节点。 17:09 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 65 OpenAI内部报告:智能体Codex如何改变工作 OpenAI 在2025年8月至2026年6月间观察到,智能体产品 Codex 取代 ChatGPT 成为主要工作工具,各部门输出 token 中 Codex 占比从不足10%升至99.8%。80.6%个体用户曾发起预计等效人类工作时间超30分钟的请求,70.2%超1小时,25.6%超8小时;99百分位用户每日生成超60小时 age
MCP/工具
产品更新
编码
Meta
安全/对齐
行业动态
智能体
OpenAI
现象/趋势
论文/研究
Anthropic
数据/训练
arXiv
推理
视频
xAI
教程/实践
搜索
政策/监管
模型发布
DeepMind
Google
Hugging Face
评测/基准
语音
开源/仓库
AI HOT
·
2026-06-26 12:00
17:09 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 65 OpenAI 在2025年8月至2026年6月间观察到,智能体产品 Codex 取代 ChatGPT 成为主要工作工具,各部门输出 token 中 Codex 占比从不足10%升至99.8%。80.6%个体用户曾发起预计等效人类工作时间超30分钟的请求,70.2%超1小时,25.6%超8小时;99百分位用户每日生成超60小时 agent turns。非开发者用户增长迅猛:个体用户增长137倍,组织用户增长189倍。Legal、Finance、Recruiting 部门在2026年4月前后跨过 Codex 使用过半拐点,平均每位律师或招聘人员超85%输出 token 来自 Codex。 智能体 OpenAI 现象/趋势 论文/研究 关联讨论 1 条 X:Rohan Paul (@rohanpaul_ai) 推荐理由: OpenAI 第一次用内部数据量化智能体如何改变工作,非开发者增速 137 倍比工程师还猛,Codex 已经吃掉内部 99.8% 的输出 token——这不是产品更新,但比大多数发布会都更值得做策略的人看一眼。
智能体
OpenAI
现象/趋势
论文/研究
AI HOT
·
2026-06-26 12:00
18:07 The Decoder:AI News(RSS) 精选 73 Meta在2025年已用大语言模型替换约一半人工审核请求,计划年底前将部分内容类型的AI审核比例提升至90%以上,每年节省数十亿美元。Meta否认成本动机,称自3月测试显示其模型错误率比人类低13%,且多捕捉10%违规。但员工指出模型仍会移除或限流无害内容,缺乏足够监督,快速部署已导致外包裁员。此外,Meta已从使用Google Gemini转向自家新基础模型Muse Spark,该模型基于人工审核员的历史决策训练。 Meta 安全/对齐 行业动态 推荐理由: Meta用LLM替换人类审核已过半,年底目标90%以上,员工警告误删和裁员同步发生。AI审核的规模跃迁背后,质量控制争议可能成为社会信任的节点。
Meta
安全/对齐
行业动态
AI HOT
·
2026-06-26 11:37
2 5 信源 · 1天前
AI HOT
·
2026-06-26 09:22
09:19 Berryxia.AI @ berryxia 精选 76 特朗普政府要求OpenAI分阶段发布其下一代前沿模型GPT-5.6,理由是网络安全和国家安全担忧。OpenAI CEO Sam Altman告知员工,新模型不会立即全面公开发布,而是先以有限预览形式开放给一小部分合作伙伴和企业客户,且美国政府将对每个客户的访问权限进行逐个审批。这一要求来自国家网络总监办公室和科技政策办公室,与近期Anthropic的情况类似。Yann LeCun曾警告,以安全为由限制AI系统访问将阻碍智能民主化。 Berryxia.AI : 美国🇺🇸政府又整活儿了! 特朗普政府要求 OpenAI 推迟新模型发布,理由是安全担忧。 根据多家媒体(包括《The Information》、路透社等)报道: 特朗普政府已要求 OpenAI 分阶段(stagger)发布其下一代前沿模... OpenAI 开源生态 政策/监管 推荐理由: 美国政府开始逐个审批 GPT-5.6 的客户,这不是模型更新,是行业规则的重写。LeCun 的警告成真了,开源模型可能因此成为唯一不被锁在少数人手里的智能通道。 07:53 Rohan Paul @ rohanpaul_ai 精选 82 @exponentialview 发布《State of the AI Economy》报告:AI经济年化收入超1750亿美元 报告基于去重后的消费端AI支出统计,过去12个月实际AI营收达1100亿美元,年化运行率超1750亿美元,增长速度约为移动/互联网普及浪潮的3倍。营收形成速度急剧加快:2023年新增10亿美元收入需180天,现缩短至不足2天。企业AI已脱离试点阶段,但全面推广仍处早期。31%的标普500公司在财报电话会提及AI,仅20%量化影响。Token降价每10%刺激12-18%用量增长,需求价格弹性强。超大规模云厂商AI收入目前大致覆盖基础设施折旧,GPU经济效益依赖6年计算寿命假设。电力供应和数据中心成本仍是未来扩展主要瓶颈。 Azeem Azhar : The GenAI economy has generated $110 billion in sales over the past 12 months. It is growing fast. On an annualized basi... 现象/趋势 推荐理由: 首次厘清全球AI真实营收规模,排重后数据说明AI经济增长惊人,这些数字将成为行业基准,弹性需求数据也打破了AI越便宜越亏的恐惧。 06:12 Claude Code:GitHub Releases(RSS) 精选 61 Claude Code v2.1.193 发布 Claude Code v2.1.193 新增 autoMode.classifyAllShell 设置,将全部
OpenAI
开源生态
政策/监管
现象/趋势
智能体
产品更新
编码
安全/对齐
行业动态
图像生成
推理
数据/训练
论文/研究
视频
GitHub
具身智能
模型发布
Hugging Face
Google
评测/基准
AI HOT
·
2026-06-26 08:14
11:29 Hacker News 热门(buzzing.cc 中文翻译) 精选 75 Anthropic指控阿里巴巴未经授权提取了其Claude AI模型的能力。该指控基于Anthropic的调查,认为阿里巴巴通过逆向工程或其他手段复制了Claude的核心技术。目前阿里巴巴尚未公开回应。 Anthropic 数据/训练 行业动态 关联讨论 1 条 Ars Technica:AI(RSS) 推荐理由: Anthropic正式指控阿里巴巴非法提取Claude能力,这不是普通知识产权纠纷,而是头部AI公司对模型能力窃取的首次公开控诉,可能重塑API和开源生态的游戏规则。
Anthropic
数据/训练
行业动态
AI HOT
·
2026-06-26 07:06
11:12 HuggingFace Daily Papers(社区热门论文) 精选 70 Causal-rCM将扩散蒸馏框架rCM扩展至自回归视频扩散,提出教师强制(TF)与自强制(SF)互补训练范式,并发布统一开源算法与基础设施。通过自定义掩码FlashAttention-2 JVP内核,首次实现基于教师强制的连续时间一致性模型(sCM/MeanFlow)用于自回归视频扩散,收敛速度比离散时间版本快10倍。蒸馏后的2步因果Wan2.1-1.3B模型在仅1或2步采样下取得VBench-T2V分数84.63,仅使用合成数据即达到帧级和块级流式视频生成SOTA。该方法还应用于Cosmos 3全模态世界基础模型,实现动作条件生成的交互式世界模型。 arXiv 推理 视频 论文/研究 推荐理由: 把自回归视频扩散蒸馏到1-2步采样,VBench冲到84.63,这个配方让实时视频生成和交互世界模型从论文走进了工程落地,做视频产品的该看。
arXiv
推理
视频
论文/研究
AI HOT
·
2026-06-26 06:00
06:06 TechCrunch:AI(RSS) 精选 70 风投机构SignalFire追踪8000万家公司数百万员工数据发现,工程是2025年最具韧性的岗位。大型科技公司总招聘较2019年下降25%,工程岗仅降11%;工程岗占Alphabet、Meta等12家“Tech Majors”新招员工的55%(2019年为46%)。早期初创公司2025年工程师招聘比2019年增长7%。Anthropic CEO警告AI可能消灭一半入门级白领,但该公司经济主管称尚未看到显著影响。NVIDIA CEO黄仁勋表示AI让工程师更忙碌,是杰文斯悖论的典型例证。 Anthropic 现象/趋势 编码 推荐理由: SignalFire 的报告用招聘数据讲了一个反直觉的故事:工程师不仅没被 AI 取代,反而成为科技公司招聘的主力,这比“AI 夺走一切”的恐慌论有说服力得多。Jevons 悖论在工程领域正在发生。
Anthropic
现象/趋势
编码
AI HOT
·
2026-06-26 06:00
09:08 xAI:News(网页) 精选 55 盈透证券(Interactive Brokers)近日与 Grok 集成,用户可在几分钟内免费关联现有账户,无需注册新账户。通过自然语言与 Grok 对话,可完成组合收益分析(如股息与利息预测)、行业/地区/经济事件的风险敞口情景建模、市场趋势研究,并直接生成对冲订单等实时交易指令,实现从数据洞察到执行决策的一体化。 xAI 产品更新 推荐理由: xAI 把 Grok 接进了盈透证券的交易终端,是个实用的生态扩展,对 IB 用户来说从分析到下单可以一条龙处理,但本质上还是个功能集成,算不上行业大事件。
xAI
产品更新
AI HOT
·
2026-06-26 04:28
04:55 Cursor Blog 精选 65 Notion 通过 Cursor SDK 在数周内将编码智能体嵌入产品。用户可在文档中@Cursor、在讨论串中提及或向数据库指派任务,Cursor 即可端到端完成规划、构建、测试、验证并自动创建 PR。集成基于一套 Provider 无关的智能体框架,Notion 的讨论串对应一个 Cursor 智能体,每条消息对应一次智能体运行;结果通过 SSE 流式传输,支持断连恢复。Cursor SDK 提供与生产环境相同的模型、运行时和远程 MCP 支持,让 Notion 无需自建智能体基础设施即可获得完整栈编码能力。用户还可自定义模板、MCP 服务器、技能和子智能体,并设置自动触发规则。 智能体 产品更新 编码 推荐理由: 我对“嵌入代理”的概念有点怀疑,但Notion用两周集成Cursor SDK,说明其抽象做得不错。文章展示了怎么把一个全栈编码代理塞进产品里,做工具的可以看看SDK设计。
智能体
产品更新
编码
AI HOT
·
2026-06-26 04:28
00:15 Google AI Developers @ googleaidevs 精选 73 Google AI 宣布 Gemini 3.5 Flash 的 Computer Use 工具正式可用,支持构建能观察并操作浏览器、移动端和桌面环境的 AI 智能体,可处理长期任务。新特性包括:内置移动与桌面操作系统支持;所有函数调用配备 intent arguments;可定制的客户端函数实现人工接管(HITL);提示词注入检测及可配置的 action-level 安全策略。可用于自动化 QA 测试、业务流程等场景。 智能体 Google 产品更新 多模态 关联讨论 1 条 Hacker News 热门(buzzing.cc 中文翻译) 推荐理由: Computer Use 从浏览器扩展到移动和桌面,Google 正式把 agent 战场拉到全部界面。安全策略的加入说明不是 demo,而是认真考虑落地。
智能体
Google
产品更新
多模态
AI HOT
·
2026-06-26 04:28
03:23 Rohan Paul @ rohanpaul_ai 精选 80 OpenAI 发布内部论文,显示 Codex 已成为公司主力 AI,产出 99.8% 内部输出 tokens,而一年前这一比例低于 10%。除工程部门外,法务、财务、招聘、支持及业务团队使用量快速增长。自 Aug-25 以来,非开发者个人使用增长 137 倍,组织使用增长 189 倍。重度用户日均运行约 71 小时代理任务,28.6% 的用户管理 5 个以上并发 agent,25.6% 的个体提交过超过 8 小时人工等价的任务。OpenAI 称,Agent 正使工作更复杂、更长期、更跨职能。 OpenAI : Work at OpenAI is being transformed by agents, in every department. Across our entire company, people are using Codex to... 智能体 OpenAI 论文/研究 推荐理由: OpenAI 内部 agents 采用数据首次公开,非开发者使用暴增 137 倍,工作单元从“提问”变成了“分配任务”,这是 AI 融入日常运作的最强信号。 03:12 Midjourney @ midjourney 精选 67 Midjourney 带来两项更新。一是加入 `--preview` 参数可提前体验 V8.2 的美学与个性化效果;二是此前在 V8.1 推出的大批量草稿模式(生成 24 张低分辨率图,价格仅为标准 4 张的一半,点击 "Vary" 可升级为全分辨率)现在支持搭配 `--sref random` 使用,探索风格空间的速度比之前快 24 倍。 Midjourney : We've released a new big-batch draft mode for V8.1. This new mode lets you generate 24 lower resolution images at the ha... 产品更新 图像生成 推荐理由: 新草稿模式让批量探索风格变得便宜又快速,配上 sref random 更是把试错效率拉满,设计师能直接用到工作流里。V8.2 预览只是小彩蛋,但暗示美学调校还在进化。 03:01 Hacker News 热门(buzzing.cc 中文翻译) 精选 78 IBM 首度推出亚纳米级芯片技术 IBM 于 2026 年 6 月 25 日发布全球首款亚纳米级芯片技术,采用 0.7 nm(7 埃米)节点与全新三维纳米堆叠(nanostack)架构。指甲盖大小的芯片集成近 1000 亿个晶体管,密度约为 IBM 2021 年 2 nm 芯片的两倍。相比 2 nm 芯片,性能最高提升 50%,能效最高提升 70%。纳米堆叠架构还实现 SR
智能体
OpenAI
论文/研究
产品更新
图像生成
推理
数据/训练
视频
GitHub
开源生态
具身智能
行业动态
模型发布
编码
Hugging Face
Google
多模态
安全/对齐
评测/基准
AI HOT
·
2026-06-26 04:28
今日热点 TOP 1 1 5 信源 · 1天前
AI HOT
·
2026-06-26 03:21
04:07 OpenRouter:Announcements(RSS) 精选 68 OpenRouter 的零数据留存(ZDR)保证用户提示词和模型响应不被存储,元数据一般安全。自 1 月以来新增 97 款支持 ZDR 的模型,月度 token 量增长 4.3 倍,约占全部路由流量一半。ZDR 在三个层面执行:账户级(整个供应商开启)、护栏级(按 API Key 或组织成员限定)、单次请求级(传参数仅路由至 ZDR 端点)。企业用户可灵活选择控制粒度,避免锁定单一供应商。 教程/实践 数据/训练 推荐理由: ZDR 远不止“不存数据”这么简单,提示、响应、缓存的区分很多人没搞清楚。OpenRouter 的三层执行算是把自由度给足了,做合规服务的人可以仔细看看。
教程/实践
数据/训练
AI HOT
·
2026-06-26 02:15
01:05 Google Research:Blog(网页) 精选 69 Google Research研究发现,推理(chain-of-thought)能帮助大语言模型(LLM)回忆简单事实,即使这些事实无需复杂推导。在Gemini-2.5 Flash和Pro以及Qwen3-32B上,启用推理后模型能够回答原本无法直接回答的简单问题,pass@k显示正确事实存在于输出分布中。该现象由两个机制驱动:一是生成的推理token充当计算缓冲,允许模型进行隐藏计算以提取参数化知识;二是推理过程中产生的相关事实起到启动效应(factual priming),帮助模型激活正确答案。 Google 推理 论文/研究 推荐理由: 发现一个反直觉现象,让模型推理能提升简单事实回忆,不是靠分步解题而是计算缓冲和事实预热,对理解模型知识召回机制很有启发,但中间步骤幻觉也带来风险。
Google
推理
论文/研究
AI HOT
·
2026-06-26 02:15
01:06 The Decoder:AI News(RSS) 精选 74 Figma在Config 2026将设计画布扩展至代码、动画、3D深度和着色器效果,并集成去年收购的Weave工作流系统。新功能包括Code Layers(代码与设计并存)、Motion动画、深度层、Shader及Generative Plugins。协作方面,团队可搜索复用AI提示词、保存工作流为技能、共享插件。Figma的AI功能依赖Anthropic、OpenAI和Google等外部模型,推理成本挤压利润率。同时,Anthropic等公司的竞争产品可直接生成界面,构成威胁。 智能体 Anthropic 产品更新 编码 推荐理由: 我认为Figma这波更新很务实,它没有硬扛AI生成界面的对手,而是把代码、动效、3D拉进画布,用人的判断驾驭AI。虽然利润被模型供应商挤压,但共享提示和工作流的设计让团队协作更高效,做设计和产品的值得细看。
智能体
Anthropic
产品更新
编码
AI HOT
·
2026-06-26 02:15
02:20 OpenAI @ OpenAI 精选 67 OpenAI 推理 模型发布 关联讨论 1 条 X:ChatGPT (@ChatGPTapp) 推荐理由: GPT-5.5 Instant 这次更新看似温和,但“更懂意图”和“复杂约束处理”的改进,对产品人和普通用户来说,可能比跑分更有用。
OpenAI
推理
模型发布