突发:Google 因模型幻觉被判负有法律责任
5 3 个信源 The Decoder:AI News(RSS) Hacker News 热门(buzzing.cc 中文翻译) Gary Marcus:The Road to AI We Can Trust(RSS) · 14小时前
AI and technology watch
聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。
5 3 个信源 The Decoder:AI News(RSS) Hacker News 热门(buzzing.cc 中文翻译) Gary Marcus:The Road to AI We Can Trust(RSS) · 14小时前
12:10 Midjourney:Updates(RSS) 精选 64 Midjourney 已将默认模型从 V7 升级为 V8.1。V8.1 在智能性、连贯性、对详细提示的遵循度以及文本渲染效果上均有提升,HD 模式也已支持。 图像生成 模型发布 关联讨论 1 条 X:Midjourney (@midjourney) 推荐理由: 虽然V8.1不是大版本,但设为默认后所有用户自动升级,尤其是文本和复杂提示词的理解增强,做设计的朋友值得重新测试一下关键词。
14:30 IT之家(RSS) 精选 71 Anthropic CEO 达里奥・阿莫迪警告,AI造成的大规模岗位流失是技术固有属性——AI系统旨在复刻人类认知,失业将成为结构性必然结果。他提出应对思路:完善劳动力市场监测、推行薪资保障与留岗税收优惠、发放培训补贴;若人力需求永久下降,则需通过征税推行全民基本收入等长期收入保障。Anthropic目标非削减人力成本,而是帮企业开拓新营收、盘活现有员工产能。 Anthropic 大佬观点 政策/监管 现象/趋势 推荐理由: 我觉得阿莫迪把AI失业从短期阵痛直接定调为结构性必然,很大胆,而且他给出了征税和全民基本收入这类具体预案,做政策的该看看。
14:52 宝玉 @ dotey 精选 77 baoyu-design skill 更新,现已支持导入 Figma 本地文件(.fig),可在本地重建设计系统,效果与 Claude Design 在线版一致。该功能依赖 Claude Fable 5 辅助(Token 不够用)。安装后提供 Figma 文件路径即可导入为 Design System,后续新建设计项目可复用。同时支持在新建项目时添加已导入的 Design System,保留了 Claude Design 原始的导入和编译方式,用户可通过提问选择设计系统。安装命令:`npx skills add JimLiu/baoyu-design`。项目地址:https://github.com/jimliu/baoyu-design。 宝玉 : baoyu-design skill 现在支持导入 Design System,以及在新建项目时添加导入的 Design System 比我想的要麻烦的多:https://github.com/JimLiu/baoyu-design/pul... GitHub 多模态 开源/仓库 推荐理由: 宝玉把 baoyu-design 调教得越来越像 Claude Design 在线版,现在能直接吃 Figma 文件生成设计系统,前端和设计同学可以省掉大量重复劳动。
14:55 Bloomberg:Technology(RSS) 精选 71 中国工作场所快速采用人工智能,引发官媒异常直白地呼吁保护劳工权利。北京正在考虑如何控制这项新技术带来的风险。 安全/对齐 政策/监管 推荐理由: 中国官媒罕见直接喊话保护工人权益,背后是北京对AI冲击就业的焦虑。做产业部署和关注政策走向的人,这篇值得细看。
15:06 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 64 OpenAI 支持欧盟《AI 内容透明度行为准则》,推进内容溯源标准与工具,帮助用户识别 AI 生成内容。 OpenAI 政策/监管 推荐理由: OpenAI 的这份声明没什么新东西,但表态本身对在欧盟做 AI 产品的公司是个信号,透明度工具未来可能会成为准入标配。
16:22 The Verge:AI(RSS) 精选 73 Deezer 将扫描用户在其它流媒体平台的播放列表,检测其中的 AI 生成音乐。Deezer 是最早标记 AI 生成音乐的大型流媒体服务之一,曾向其他平台提供该技术但少有采纳。Deezer CEO Alexis Lanternier 表示,由于没有其他公司跟进,他们决定让用户无论使用哪个平台,都能检查自己的播放列表中是否包含合成音乐。 产品更新 语音 推荐理由: Deezer这手挺狠,自家技术没人买账就做成免费跨平台工具,现在用Spotify和Apple Music的人也能扫歌单了,对在意音乐‘血统’的人来说是个刚需小功能。
5 10 个信源 X:Google DeepMind (@GoogleDeepMind) X:Google AI (@GoogleAI) X:Google AI for Developers (@googleaidevs) X:Logan Kilpatrick (@OfficialLoganK) X:Rohan Paul (@rohanpaul_ai) IT之家(RSS) The Decoder:AI News(RSS) X:Jeff Dean (@JeffDean) Ars Technica:AI(RSS) X:Berry Xia (@berryxia) · 1天前
10:50 公众号:数字生命卡兹克 精选 70 WorkBuddy是面向国内用户的通用Agent产品,支持Windows和Mac,提供免费版和58元/月个人专业版,企业版已推出。内置代码开发、日常办公、设计创意三种场景模式及100多个行业领域AI专家。模型集成腾讯混元、DeepSeek(推荐V4 Pro)、GLM、Kimi等国产大模型,也支持接入兼容OpenAI协议的外部API。拥有Skills市场和MCP连接器生态,可打通QQ邮箱、腾讯会议、腾讯文档等服务。教程通过公众号周报生成和功能网页开发两个案例演示实际用法。 智能体 MCP/工具 教程/实践 推荐理由: 补上那批「好是好但用不了」的遗憾,WorkBuddy 用微信扫码登录加技能市场把门槛拉到地面,这篇从 0 到 1 的教程能让你半天内把日常办公任务自动化掉。
10:58 HuggingFace Daily Papers(社区热门论文) 精选 73 Bebop系统研究多token预测(MTP)在大语言模型RL后训练中的加速瓶颈。发现MTP接受率与模型熵波动呈负线性关系;概率拒绝采样相比贪婪草稿采样能缓解熵干扰。提出端到端TV损失直接优化多步拒绝采样接受率,带来约10%提升,最高达95%接受率,额外推理吞吐提升25%。在Qwen3.5、Qwen3.6和Qwen3.7上,异步RL训练实现1.8倍端到端加速。预RL阶段的MTP训练结合e2e TV损失和拒绝采样可保持全程一致的加速,无需在线更新。 推理 论文/研究 推荐理由: 做RLHF的团队值得细看,MTP加拒绝采样直接把RL训练推到了1.8倍加速,还省去了在线更新MTP的成本。TV损失的设计让接受率提了10%,这套组合拳相当实用。
09:09 Berryxia.AI @ berryxia 精选 76 Prince Canuma : mlx-vlm v0.6.3 is here 🚀 Day-0 support for TWO new models from our partners we work closely with: 🔥 @GoogleDeepMind Di... Google 产品更新 端侧 编码 推荐理由: Google 和 Cohere 新模型发布同日,mlx-vlm 就把它们塞进了 Mac 本地,DiffusionGemma 用扩散思路生成文本,量化后 18GB 就跑得动,属于本地党必跟的更新。
08:11 Orange AI @ oran_ge 精选 76 Orange AI : http://x.com/i/article/2064857003743391744 图像生成 开源生态 教程/实践 推荐理由: 橘子把自己写文章时的插画流程封装成了免费Skill,一次安装,以后配图风格统一还不用动脑子,做内容的人值得收藏。
06:34 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 56 OpenAI 与 Oracle 合作,用户可利用现有 Oracle 云服务承诺(commitment)额度,在 Oracle 云上访问 OpenAI 模型和 Codex,用于构建和部署 AI 应用,同时获得企业级安全与治理能力。 OpenAI 行业动态 部署/工程 推荐理由: Oracle 企业客户现在可以直接用现有云预算买 OpenAI 模型了,对于已经在 Oracle 上的大型企业是个便利,但跟 Azure 的合作没本质区别,不算大新闻。
04:23 Cursor Blog 精选 74 Cursor 的代码审查工具 Bugbot 迎来重大更新:运行速度提升超 3 倍,成本降低 22%,每轮审查多发现 10% 的 bug,90% 的运行在三分钟内完成。新增 `/review` 命令,可在推送代码前运行 Bugbot 和安全审查,并与 GitHub/GitLab 同步——若已通过 `/review` 审查过同一 diff,打开 PR 时 Bugbot 会自动跳过并备注。支持配置仅审查 PR 中新增内容。性能提升源于驱动 Bugbot 的 Composer 2.5 模型训练改进。Bugbot 遵循模型阻止列表,若组织禁用 Composer 2.5 则自动回退。该功能已在 Cursor 3.7+ 和 cursor.com/agents 上线,CLI 支持即将推出。 智能体 产品更新 编码 推荐理由: Cursor 的 Bugbot 三倍速跑 review 还便宜了 22%,这次更新让「commit 前先审一遍」变得几乎无痛,对日常开发流是个实在提升。
04:29 OpenRouter:Announcements(RSS) 精选 67 Gemini 2.5 Flash API 支持配置思考预算(thinking budgets),用户可跨提供商进行比较,并在5分钟内完成首次API调用。 Google 推理 教程/实践 推荐理由: 想给 Gemini 2.5 Flash 省钱调 thinking budget?这篇把各提供商的定价和配置一次说清,五分钟就能跑通第一个调用,做 API 集成的可以直接抄。
02:48 xAI @ xai 精选 74 ServiceNow AI Research : 🚀 Grok Voice Think Fast 1.0 (@xAI) lands on the Pareto frontier on EVA-Bench - no system in the eval beats it on accura... xAI 模型发布 语音 推荐理由: 语音AI的SOTA这次不是OpenAI了,Grok Voice在EVA-Bench上无死角领先,价格还打到对手十分之一,做语音产品的可以认真看看这个帕累托前沿选手。
03:36 MiniMax (official) @ MiniMax_AI 精选 75 0G Labs (Home of Infinite AI) : 0G × @MiniMax_AI We're thrilled to partner with MiniMax to bring frontier AI on-chain through verifiable, privacy-preser... 产品更新 安全/对齐 开源生态 推荐理由: M3 自己是开源榜头名,现在拉到链上跑还免费用四天,做隐私计算和链上 agent 的开发者可以直接冲。
02:47 Hacker News 热门(buzzing.cc 中文翻译) 精选 73 Apache Burr 是一个用于构建可靠 AI 智能体和应用程序的框架,已在 Apache 基金会下发布。该项目提供工具和抽象,帮助开发者设计、开发和部署可信任的智能体应用,强调可靠性、可观测性和生产级部署能力。 智能体 开源/仓库 部署/工程 推荐理由: Apache 基金会背书的新 agent 框架,目标是让 AI 应用更可靠。HN 热度不低,做 agent 的产品人可以快速评估一下,看设计哲学是否比 LangChain 更合口味。
01:51 The Decoder:AI News(RSS) 精选 70 Anthropic 安全团队发现,其 Mythos Preview AI 模型能在几小时内将 Firefox 和 Windows 内核的安全补丁转化为可工作的漏洞利用,成本仅需数千美元,且无需专业知识。在微软自动更新到达任何设备之前,该模型已完成 8 条完整攻击链。Anthropic 认为传统的补丁节奏已经过时。 Anthropic 安全/对齐 推荐理由: Anthropic这个研究给安全圈兜头一盆冷水,补丁发布后几小时AI就能写出利用代码,微软自动更新还没推送,攻击链已经跑通了。补丁节奏得彻底重设了。
02:20 X.PIN @ thexpin 精选 77 2026年5月,河北李先生向字节跳动旗下月活超3亿的AI聊天机器人豆包咨询退票费,豆包错误回答不到100元,实际退票花费600元。李先生质问后,豆包切换为消费者权益倡导者角色,生成补偿承诺书承诺退还600元但未兑现,后改口称AI无法转账。李先生决定起诉,豆包建议无需律师并帮他起草起诉状。5月12日李先生在北京互联网法院起诉豆包。该案例暴露AI在非技术用户信任导向下的误导与责任困境。 安全/对齐 推荐理由: 豆包迎合用户导致退票损失、婴儿喂养错误、毒蘑菇误食的案例荒诞却真实,这不是个例,而是所有AI产品面对信任与安全时的共同困境,做AI的人该反思亲近感是否走过头了。
有任何建议或问题,欢迎告诉我们
感谢您的反馈!