AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

Suno应用刚刚焕然一新。 过去几周我们进行了一些更新。 以下是我们喜爱的部分亮点 🧵

23:58 Suno @ suno 精选 61 产品更新 多模态 推荐理由: Suno 是音乐生成领域的标杆,每次更新都可能影响创作体验。虽然推文没给具体功能,但对用 AI 做音乐的人来说,这比大模型发布更值得点开看看。 23:31 蚂蚁 inclusionAI:HuggingFace 新模型 精选 73 inclusionAI/Ring-2.6-1T inclusionAI发布了Ring-2.6-1T模型。该模型在Claw-Eval基准测试中取得了两项关键评估结果:在通用能力评估(General)上得分为58.4,在多轮对话评估(Multi Turn)上得分为86.8。这些分数已记录在相应的评估结果排行榜中。 Hugging Face 开源生态 模型发布 关联讨论 1 条 X:蚂蚁百灵 (@AntLingAGI) 推荐理由: 蚂蚁 inclusionAI 低调开源了 1T 规模的 Ring-2.6,Claw-Eval 多轮 86.8 的分数有点猛,做中文场景的可以拉下来跑一跑。 23:29 Anthropic:Newsroom(网页) 精选 82 Anthropic与盖茨基金会达成2亿美元合作,聚焦全球健康与教育 Anthropic与盖茨基金会建立为期四年、总额2亿美元的合作,通过资金、Claude使用额度及技术支持,共同推进全球健康、生命科学、教育及经济流动项目。合作重点包括改善中低收入国家约46亿人口的基本医疗,利用AI加速疫苗与疗法研发,并开发公共卫生数据集等公共产品。在教育领域,双方将为美国、撒哈拉以南非洲和印度的K-12学生开发AI教学工具。经济流动方面则关注提升小农户生产力及美国职业技能认证。首批成果预计今年晚些时候发布。 Anthropic 行业动态 关联讨论 2 条 X:Anthropic (@AnthropicAI) X:阿易 AI Notes (@AYi_AInotes) 推荐理由: Anthropic 和盖茨基金会的 2 亿合作不是 PR 包装,全球健康和农业的具体落地计划表明 AI 正在长出「公益器官」,想跟上的组织可以看看协议框架。 23:28 PixVerse @ PixVerse_ 精选 63 不容错过PitCrewMoment潮流。 一键将任何肖像转化为F1直播电视进站时刻。 立即在PixVerse网页端尝试! 产品更新 图像生成 视频 推荐理由: PixVerse 赶了个 F1 梗的热度,一键生成 pit crew 视频,单纯好玩但谈不上必试。 23:15 Perplexity @ perplexity_ai 精选 68 计算机现已连接至Snowflake。 可基于实时仓库数据开展端到端工作,通过SQL、源表、筛选器和指标获取答案。 这就像一支随时待命的个人数据科学团队,从公司实时数据中提供精准答案。 产品更新 搜索 关

产品更新 多模态 Hugging Face 开源生态 模型发布 Anthropic 行业动态 图像生成 视频 搜索 推理 教程/实践 部署/工程 智能体 MCP/工具 编码
AI HOT ·

解锁连续批处理中的异步性

22:45 Hugging Face:Blog(RSS) 精选 59 在连续批处理中,同步方式导致CPU与GPU交替工作,造成闲置浪费。测试显示,使用8B模型生成8K令牌时,GPU有24%的时间处于空闲状态。异步批处理通过分离工作负载,让CPU准备下一批次(N+1)的同时,GPU计算当前批次(N),从而消除闲置间隙。这可通过CUDA流实现操作并发,无需更改内核或模型,仅需协调硬件执行顺序。理论上,该方法可将总生成时间从300.6秒减少至228秒,实现24%的免费加速。相关技术已集成到transformers库的连续批处理中,显著提升推理性能。 Hugging Face 推理 教程/实践 部署/工程 推荐理由: 文章手把手拆解了异步批处理如何用CUDA流和事件消除CPU与GPU的互相等待,把推理吞吐提升22%,搞推理优化的工程师值得细读。

Hugging Face 推理 教程/实践 部署/工程
AI HOT ·

计算机现已连接至Snowflake。 可基于实时仓库数据开展端到端工作,通过SQL、源表、筛选器和指标获取答案。 这就像一支随时待命的个人数据科学团队,从公司实时数据中提供精准答案。

23:15 Perplexity @ perplexity_ai 精选 68 产品更新 搜索 关联讨论 1 条 X:Perplexity (@perplexity_ai) 推荐理由: Computer 接入 Snowflake,等于给公司内部数据分析配了个可对话的 SQL 助手,做报表的人可以试试,但暂时只是便利性提升,不算根本性的变化。

产品更新 搜索
AI HOT ·

用户分享了对开源项目html-anything的积极体验。该项目旨在让AI Agent能将任何数据转换为具有世界级设计水准的HTML代码。该项目历时三天开发,包含约一万五千行代码,支持75套Skills和9种导出格式,并能兼容包括Claude Code、Codex、OpenClaw、Hermes在内的多种代码生成Agent。

22:26 小互 @ xiaohu 精选 70 Tom Huang : 正式开源 html-anything 🚀 1:1 让你感受全网爆火 Claude code 作者提的 HTML 效果! 你的 Agent 现在可以将任何数据… 智能体 MCP/工具 产品更新 关联讨论 1 条 X:Berry Xia (@berryxia) 推荐理由: 这个开源工具把 Claude Code 作者设想的 HTML 能力做成了现实,1.5 万行代码支持 75 种技能,所有 code agent 用户都能试试。

智能体 MCP/工具 产品更新
AI HOT ·

随着智能体应用迈向更大规模部署,其背后的云技术栈也需同步扩展。 在百度Create大会上,百度集团执行副总裁、百度智能云事业群总裁沈抖宣布推出专为大规模智能体应用打造的全新全栈AI云,其升级涵盖智能体基础设施与AI基础设施。 基于我们自研的昆仑芯AI芯片构建的专用集群,已支持ERNIE 5.1系列中一个关键模型的训练。

22:29 Baidu Inc. @ Baidu_Inc 精选 61 智能体 产品更新 部署/工程 推荐理由: 百度云这次升级把 agent 部署的算力调度和芯片层都打通了,昆仑芯能跑文心 5.1 是个信号,国内做 agent 的团队可以看看底层成本是否真有优势。

智能体 产品更新 部署/工程
AI HOT ·

官宣:ChatGPT手机应用现已集成Codex!!太棒了 Codex真是强大。我太喜欢了。

04:32 Chubby♨️ @ kimmonismus 精选 74 智能体 OpenAI 产品更新 编码 推荐理由: Codex 终于登陆 ChatGPT 移动端,用手机就能启动和查看 Agent 编码进度,对移动端开发者非常友好,也标志着 AI 编码真正从桌面走向全场景。 04:09 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 78 随时随地使用 Codex 用户现可通过 ChatGPT 移动应用随时随地使用 Codex。该功能支持跨设备和远程环境实时监控、引导及批准编码任务,实现了对编程工作的无缝移动端管理。 智能体 OpenAI 产品更新 编码 关联讨论 2 条 X:OpenAI Developers (@OpenAIDevs) X:OpenAI (@OpenAI) 推荐理由: Codex mobile让你在手机上监控和指挥AI写代码,对需要远程协作的开发者是个实用升级,不过更像功能补全而非颠覆性创新,适合日常需要随时掌控进度的团队。 03:45 Hugging Face:Blog(RSS) 精选 73 Granite Embedding Multilingual R2:开源多语言嵌入模型,具备32K上下文与领先检索性能 IBM Granite团队在Hugging Face发布了Granite Embedding Multilingual R2多语言文本嵌入模型。该模型采用Apache 2.0开源协议,上下文长度扩展至32K令牌,参数量低于1亿。在MTEB基准的检索评估中,它取得了同规模模型的最佳性能,尤其擅长多语言混合检索,为开发者提供了高效、轻量且可商用的嵌入解决方案。 开源生态 模型发布 推荐理由: IBM这个嵌入模型把100M以下参数级别的检索质量推到了新SOTA,Apache 2.0开源,做RAG的可以直接拿来替换老旧底座了。 03:18 Tomer Tunguz 博客(VC 分析) 精选 65 AI电子邮件的成本分析 使用顶尖AI模型处理邮件的月度成本约为22至130美元,中位数26美元。若软件公司以75%毛利率定价,年费可能高达350美元,加上托管服务后标价或达500美元,约为Google企业邮箱费用的两倍。采用小型模型可降低成本10至20倍,而通过本地运行利用用户GPU,更能将成本削减至接近零。结合基础启发式方法和技术优化,总成本有望降低100倍。这种针对不同工作负载匹配模型并进行成本分层的推理市场细分,将是未来一两年AI软件发展的关键。 推理 现象/趋势 部署/工程 推荐理由: Tunguz 给 AI 邮件算了一笔账,SOTA 模型月费 22-130 美元,但他更重要的判断是推理分割可以把成本压到百分之一,这对做 AI 软件的定价逻辑是个关键风向。 03:01 xAI:News(网页) 精选 73 xAI 推出

智能体 OpenAI 产品更新 编码 开源生态 模型发布 推理 现象/趋势 部署/工程 xAI Anthropic 安全/对齐 政策/监管 数据/训练 行业动态 MCP/工具 教程/实践
AI HOT ·

克劳德代码与《代码书》技能:有针对性的技能培养

21:29 Hacker News 热门(buzzing.cc 中文翻译) 精选 78 开发者发布了一款名为“克劳德代码与《代码书》技能”的GitHub工具,旨在通过刻意练习提升编程技能。该工具利用AI模型生成特定主题的代码示例与解释,帮助用户进行针对性学习。项目在Hacker News上获得104点热度,关注度较高。其核心变化在于将传统的广泛学习转化为聚焦、可重复的技能训练模式,通过结构化练习提升学习效率。 教程/实践 编码 推荐理由: 这个skill把Claude Code变成一对一的代码教练,专门抓你代码里的坏习惯,对想用AI真正提升编码水平的人是个好东西。

教程/实践 编码
AI HOT ·

AI 热潮引发民怨:七成美国民众反对家门口建数据中心

20:40 IT之家(RSS) 精选 70 盖洛普调查显示,高达七成美国民众反对在住宅附近建设数据中心,反对率较去年大幅上升,抵触情绪甚至超过对核电站的接受度。全美已有69个辖区出台暂停令,多地项目因抗议和监管纠纷延期。数据中心建设推高批发电价,导致用电成本激增,并引发空气污染、水资源消耗等担忧。尽管白宫要求AI企业承担配套成本,但仅为无约束力承诺,未来审批将更严苛。 政策/监管 行业动态 推荐理由: AI 数据中心的邻避效应正升级为政治暴力,电价暴涨 267% 是民怨的导火索,做基础设施的不能只算经济账了。

政策/监管 行业动态
AI HOT ·

认识Kimi网页桥接--Kimi的浏览器扩展。 现在智能体可以像人类一样与网站互动:搜索、滚动、点击、输入并完成任务。 支持Kimi Code CLI、Claude Code、Cursor、Codex、Hermes等平台。 现已在http://kimi.com/features/webbridge和Chrome应用商店上线。

21:45 Kimi.ai @ Kimi_Moonshot 精选 80 智能体 产品更新 关联讨论 3 条 X:Berry Xia (@berryxia) X:邵猛 (@shao__meng) X:Testing Catalog (@testingcatalog) 推荐理由: 这是Kimi给Agent加的'手',直接操作网页,支持主流CLI,对做网页自动化的开发者多了一个选择,即装即用挺方便。

智能体 产品更新
AI HOT ·

由联合创始人兼首席科学家李沐博士领导的团队发布了SenseNova U1技术报告,详细阐述了其架构、训练方案与创新突破。此次开源同步发布了基于混合专家模型(MoE)的新权重,旨在推动AI领域的透明度、可复现性与进一步创新。团队希望通过开放共享促进整个社区的技术发展。

19:15 SenseTime @ SenseTime_AI 精选 77 开源/仓库 开源生态 数据/训练 模型发布 推荐理由: 商汤这次把SenseNova U1的MoE权重和完整技术报告一起开源,比常规PR多了些诚意,做模型选型和微调的值得翻翻。

开源/仓库 开源生态 数据/训练 模型发布
AI HOT ·

OpenAI遭集体诉讼,被指通过追踪代码向Meta等泄露用户查询隐私

17:40 AYi @ AYi_AInotes 精选 75 南加州联邦法院已受理针对OpenAI的集体诉讼,指控其在ChatGPT网站中嵌入Facebook Pixel等代码,侵犯用户隐私。当用户提交查询时,查询主题会作为浏览器标题与含Facebook唯一ID的cookies一并实时发送给Meta。OpenAI虽称仅分享“有限标识符”用于广告,但原告认为查询主题本身即高度敏感的个人信息。此案揭示免费AI服务的潜在代价:用户每一次查询及数字身份可能成为被交易的产品,与许多用户为逃避追踪而选择ChatGPT的初衷形成讽刺对比。 OpenAI 数据/训练 行业动态 推荐理由: 免费AI的代价一向是数据训练,但OpenAI这次被诉把用户每次查询实时推给Meta和Google,隐私暴露比想象中严重得多,值得所有ChatGPT用户警惕。

OpenAI 数据/训练 行业动态
AI HOT ·

我们发表了一篇阐述中美人工智能竞争观点的论文。 当前美国及其民主盟友在前沿AI领域保持领先。了解如何维持这种优势的更多内容:https://www.anthropic.com/research/2028-ai-leadership

02:10 Anthropic @ AnthropicAI 精选 75 Anthropic 政策/监管 现象/趋势 推荐理由: Anthropic 第一次把中美 AI 竞争立场写成正式论文,不是模糊的公关话,政策研究者和出海企业该认真读。 02:08 凡人小北 @ frxiaobei 精选 80 OpenEvidence覆盖65%美国医生,shadow AI模式引关注 OpenEvidence已覆盖65%的美国医生,4月单月临床场景使用达2700万次,平均每位医生每月使用41次。平台由医生个人通过执业编号在手机上注册,医院最初不知情,Mount Sinai的AI负责人称此为shadow AI,表示其早在基层普及。医院后来才追签企业合作,OpenEvidence强调这是美国医疗史上首次让大多数医生自愿采用单一技术平台的突破。合作伙伴包括NEJM、JAMA、NCCN和Wiley,为此提供了支持。 行业动态 推荐理由: 65%的美国医生自发用上的AI工具,这才是真正的渗透率。做垂直SaaS和AI应用的人都该学学,不是靠医院采购,而是靠医生自己装手机上——冰山下全铺开了。 02:00 Claude:Blog(网页) 精选 73 在大型代码库中高效运用Claude Code:最佳实践与入门指南 Claude Code已成功部署于数百万行的单体仓库、遗留系统及分布式架构中。其核心在于围绕模型构建的“工具套件”,而非仅依赖模型本身。该套件包含五个关键扩展点:提供代码库概览的CLAUDE.md文件、实现持续改进的钩子、按需加载专业知识的技能、插件以及MCP服务器。它采用智能体搜索模式,直接在开发者本地实时代码库上操作,无需构建和维护集中式索引,从而避免了传统RAG系统在活跃大型代码库中索引过时的问题。团队对代码库设置的投入程度直接决定了其导航效果。 智能体 Anthropic MCP/工具 教程/实践 推荐理由: 这是 Anthropic 官方出的 Claude Code 大型代码库配置指南,把 CLAUDE.md、hooks、skills 的层级和分工讲得比社区经验更系统,做工程落地的团队可以当作部署手册。 02:00 Claude:Blog(网页) 精选 74 创始人手册:构建AI原生初创公司 Anthropic公司发布了一份面向AI原生初创企业的实用指南,旨在重塑2026年创业生命周期的构思、最小可行产品、发布和规模化四个核心阶段。该手册为每个阶段提供了具体目标、退出标准、常见失败模式及AI驱动练习,涵盖如何利用Claude进行问题验证与客户发现、避免AI生成代码的技术债务、区分真实产品市场契合度与早期炒作,并引入智能工作流替代创始人手动操作。指南还整合了多家初创企业的实践案例,为从零开始围绕AI构建公司的创始人提供架构、范围与安全方面的最佳实践。 智能体 Anth

Anthropic 政策/监管 现象/趋势 行业动态 智能体 MCP/工具 教程/实践 编码 Google 产品更新 部署/工程 图像生成 端侧
AI HOT ·

MiMo V2.5 Pro 在 @DesignArena 上刚刚获得第三名!🎉 MiMo V2.5 Pro (Thinking) 在总排行榜上比 MiMo-V2.5 提升了 8 个名次,在前端编码任务中达到与 Claude Sonnet 4.6 相同的性能水平。 衷心祝贺 @XiaomiMiMo 团队取得这些进步!

13:58 Xiaomi MiMo @ XiaomiMiMo 精选 69 开源生态 编码 评测/基准 关联讨论 1 条 X:小米 MiMo (@XiaomiMiMo) 推荐理由: 小米MiMo在Design Arena前端编码评测里直接杀进前三,跟Claude Sonnet 4.6平起平坐,这是国产开源模型在代码能力上第一次给我真正的压迫感,搞前端的可以盯一下。

开源生态 编码 评测/基准
AI HOT ·

"让 Token 消耗降低 61%":腾讯开源 Agent Memory

15:40 IT之家(RSS) 精选 74 腾讯云开源了TencentDB Agent Memory,旨在解决Agent长任务中上下文窗口易满、Token成本高的问题。该方案采用“上下文卸载”与“Mermaid任务画布”两项核心技术,将完整信息卸载至外部存储,同时用结构化任务图保留关键状态与执行路径。实验显示,该方案在多任务连续会话中最高可降低61%的Token消耗,并提升任务成功率。项目已适配OpenClaw等主流框架,支持一键集成与本地SQLite存储。 智能体 MCP/工具 开源/仓库 推荐理由: 腾讯开源的这个 Agent Memory,用 Mermaid 画布加上下文卸载,把长任务 Token 省了 61%,而且所有中间信息都可追溯,做复杂 Agent 的开发者可以直接抄作业了。

智能体 MCP/工具 开源/仓库
AI HOT ·

百度推进智能体组合以拥抱智能体时代,主张将日活跃智能体作为关键指标 https://www.prnewswire.com/news-releases/baidu-advances-agent-portfolio-to-embrace-the-agent-era-champions-daily-active-agents-as-key-metric-302771383.html

14:59 Baidu Inc. @ Baidu_Inc 精选 73 智能体 行业动态 推荐理由: 百度把Agent推到战略高度还提出日活Agent新指标,做企业市场的可以盯着看怎么落地,但官方公告水分不小先观望。

智能体 行业动态
AI HOT ·

编写了一个技能,可以循环运行codex /review直到没有错误为止。 注意事项:它不会为你修复系统架构,所以你仍然需要将BRAIN作为主模型。https://github.com/steipete/agent-scripts/blob/main/skills/codex-review/SKILL.md

17:05 Peter Steinberger 🦞 @ steipete 精选 70 智能体 教程/实践 编码 推荐理由: 这种让 AI 反复 review 直到满意的脚本,看似简单但切中痛点——代码审查不再是一锤子买卖。做 AI coding 的值得抄进自己的 workflow。

智能体 教程/实践 编码
AI HOT ·

检索廉价,代码为王:基于可执行程序的多跳推理检索增强生成

12:45 HuggingFace Daily Papers(社区热门论文) 精选 71 针对多跳检索增强生成(RAG)中推理过程隐式、检索漂移及错误难以自查的问题,研究团队提出PyRAG框架,将多跳推理任务重构为程序合成与执行过程。该框架将推理步骤编写为可执行的Python程序,通过显式调用检索与问答工具实现多步计算,使中间状态变量化、反馈确定化,并生成完整可检查的推理轨迹。该方法无需额外训练即可支持基于编译器的自我修复与执行驱动的自适应检索。在PopQA、HotpotQA等五个问答基准测试中,PyRAG在无需训练和强化学习训练两种设定下均显著优于基线模型,尤其在组合式多跳数据集上提升显著。相关资源已开源。 检索增强 论文/研究 推荐理由: 把多跳RAG变成可执行的Python程序,中间状态全透明,实验在五个数据集上都压住了基线,做检索增强的值得看一眼。

检索增强 论文/研究
AI HOT ·

OpenAI 回应 TanStack npm 供应链攻击并加强安全措施

12:50 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 68 OpenAI 针对 TanStack “Mini Shai-Hulud” npm 供应链攻击事件作出响应。攻击者通过维护者账户发布了恶意伪造包。OpenAI 确认内部系统未受影响,但为防范风险,已撤销并重签所有相关代码签名证书,并要求 macOS 用户在 2026 年 6 月 12 日前更新应用。公司同时加强了第三方依赖审查和自动化安全监控,以提升软件供应链安全防御。 OpenAI 行业动态 关联讨论 2 条 X:阿易 AI Notes (@AYi_AInotes) IT之家(RSS) 推荐理由: OpenAI第一次公开回应供应链攻击,不仅解释了影响范围,还给出了硬性的6月12日更新死线,macOS用户最好现在就去检查版本。

OpenAI 行业动态
AI HOT ·

baoyu-skills 新加了一个 Skill: 微信群聊总结 Skill:https://github.com/JimLiu/baoyu-skills/tree/main/skills/baoyu-wechat-summary 依赖于 wx-cli:https://github.com/jackwener/wx-cli 如何配置使用 wx-cli 请看项目文档,无法提供帮助。另外目前只是借助其读取数据,其他没任何关系。 Claude Code + Claude Opus 4.6 效果最佳

12:07 宝玉 @ dotey 精选 80 Anthropic 开源/仓库 教程/实践 关联讨论 1 条 X:Berry Xia (@berryxia) 推荐理由: 微信群聊的AI总结一直缺现成方案,宝玉这个skill直接调wx-cli读取聊天记录再丢给Claude总结,社群运营同学可以马上试试。

Anthropic 开源/仓库 教程/实践