AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

摩尔线程开源 MusaCoder 代码大模型,9B/27B 参数基于国产 GPU 全链路训练

16:28 IT之家(RSS) 精选 72 摩尔线程发布并开源 MusaCoder 代码大模型,含 9B 和 27B 两个参数规模,是业内首个基于国产 GPU 算力底座完成全链路训练与验证的开源模型。后训练流程在基于 MTT S5000 的夸娥智算集群上完成,支持从 PyTorch 标准算子自动生成高性能 CUDA/MUSA 原生 Kernel 代码。在 KernelBench 评测中,MusaCoder-27B-RL 以 Overall Pass@8 93.2%、Avg.@8 88.60% 超越 Claude Opus、DeepSeek-V4 Pro、GLM-5.1、Kimi K2.6 等主流 SOTA 代码模型。 开源生态 模型发布 编码 推荐理由: 摩尔线程这个模型直接瞄准GPU底层算子,KernelBench分数压过了不少主流大模型,虽然场景窄,但在国产硬件自建软件生态的路上,迈出了挺关键一步。

开源生态 模型发布 编码
AI HOT ·

Apple发布新一代Apple Intelligence和Siri AI

5 8 个信源 TechCrunch:AI(RSS) Bloomberg:Technology(RSS) X:Testing Catalog (@testingcatalog) The Verge:订阅版科技(RSS) IT之家(RSS) Apple:Newsroom(RSS) 公众号:数字生命卡兹克 The Verge:AI(RSS) · 1天前

AI HOT ·

Flow-DPPO: 面向流匹配模型的散度近端策略优化

12:56 HuggingFace Daily Papers(社区热门论文) 精选 73 针对流匹配模型中在线强化学习比率裁剪策略约束不当的问题,Flow-DPPO 提出用散度近端约束替代。关键洞察是流模型每步策略为高斯分布,可精确计算新旧策略间的 KL 散度。Flow-DPPO 采用非对称散度掩码,仅在梯度更新偏离信任区域且超阈值时阻止更新。实验表明,Flow-DPPO 获得更高奖励,KL 近端效率更优,缓解了灾难性遗忘,促进多目标均衡,并能在比率裁剪失效时支持稳定的多轮训练。代码已开源。 图像生成 推理 视频 论文/研究 推荐理由: 用 KL 散度代替比值裁剪来解决流匹配 RL 训练的不稳定,理论简洁,代码已开源,做图像/视频生成优化的同学可以跑一下。

图像生成 推理 视频 论文/研究
AI HOT ·

混合LLM中的注意力失忆:CoT微调破坏长距离召回及修复方法

12:56 HuggingFace Daily Papers(社区热门论文) 精选 75 CoT监督微调系统性地降低混合线性注意力模型(如HypeNet、Jet-Nemotron)的长上下文召回能力。在NIAH任务上,HypeNet-9B的S2@256K从67.2%降至9.4%,原因是CoT-SFT使注意力梯度偏向短程模式,破坏长程路由的W_Q和W_K投影。QK-Restore方法无需训练,从微调前检查点恢复W_Q和W_K,保留其余参数;Procrustes变体平衡路由保留与推理适应。在HypeNet-5B上,QK-Restore将S3@256K从65.4%提升至76.4%,推理性能不变。 推理 论文/研究 推荐理由: 做长上下文推理的同学注意了,CoT微调居然会弄坏模型的长距离记忆,这篇论文不仅把原因扒清楚了,还给出了零成本修复方案,值得放进参考列表。

推理 论文/研究
AI HOT ·

2026年高考,跟着千问,选好志愿!

14:10 公众号:千问APP(阿里) 精选 66 千问发布国内首个全周期高考志愿填报Agent,由数百位资深高报师参与训练。该智能体提供AI志愿报告,为考生量身定制深度全面的填报方案;AI志愿日历帮助制定专属填报计划;高考专业知识库整合夸克高考8年积累,并引入志愿专家顾问,数据权威可信赖,全程陪伴考生完成志愿填报。 产品更新 其他 关联讨论 1 条 公众号:千问APP(阿里) 推荐理由: 高考志愿填报不算新场景,但千问整合了夸克8年数据和数百位高报师,对考生家长算是比较靠谱的实用助手,可以试试。

产品更新 其他
AI HOT ·

谷歌财务担保支撑 Anthropic 350 亿美元芯片租赁交易

14:19 Bloomberg:Technology(RSS) 精选 73 Anthropic 在谷歌(其早期投资者之一)的帮助下,正在五个数据中心租赁高性能计算机芯片。谷歌同意为每个地点的租赁付款提供兜底担保,从而帮助 Anthropic 获得相当于 350 亿美元的融资。 Anthropic Google 行业动态 部署/工程 推荐理由: 这 35 亿芯片租赁让 Anthropic 的算力扩张有了真金白银的支撑,Google 的担保让这笔交易像极了当年微软给 OpenAI 的算力承诺,对算力基建是个重大信号。

Anthropic Google 行业动态 部署/工程
AI HOT ·

亚马逊的大规模扁平化数据中心网络

14:41 Hacker News 热门(buzzing.cc 中文翻译) 精选 73 亚马逊分享了在大规模数据中心中实现扁平化网络架构的工程实践与设计考量,重点论述了如何通过简化拓扑和路由策略来支撑超大规模集群的高带宽、低延迟通信。文章未披露具体模型或评测数据。 教程/实践 数据/训练 部署/工程 推荐理由: James Hamilton 亲自拆解亚马逊数据中心网络的演进,这是支撑 AWS 大规模 AI 训练的底层架构,做基建的可以对照自己的网络设计。

教程/实践 数据/训练 部署/工程
AI HOT ·

欧盟发布临时措施,要求 Meta 向第三方 AI 助手免费开放 WhatsApp

10:28 IT之家(RSS) 精选 76 欧盟委员会6月9日宣布临时措施,责令Meta在反垄断调查结束前免费向第三方AI助手开放WhatsApp访问权限。Meta于2025年10月15日禁止第三方AI助手调用WhatsApp for Business API,意图让自家Meta AI独占市场;今年3月4日虽改为付费使用,但欧盟委员会认为这实质上延续了禁令,可能严重损害通用AI助手市场竞争,尤其危及小企业和新进入者。 Meta 政策/监管 推荐理由: 欧盟反垄断又一次发力,强令Meta免费开放WhatsApp给第三方AI助手,这对刚起步的通用AI助手公司是重大利好,可能重塑竞争格局。

Meta 政策/监管
AI HOT ·

火山方舟版权商业化平台上线,周星驰比高集团三大电影IP首批入驻

12:40 公众号:火山引擎 精选 68 火山引擎今日上线火山方舟版权商业化平台,推出行业首个覆盖“授权—保护—审核—分发—变现”全链路的版权合作机制。平台搭载视频生成模型Seedance 2.0及版权治理体系,已获周星驰旗下比高集团《喜剧之王》《食神》《长江七号》三部影片在AI视频创作场景下的版权使用权,并基于Seedance 2.0打造经典桥段AI创作模板。模板已在火山方舟体验中心、火山引擎Kickart上线,同步开放给LibTV、筷子科技丽帧引擎等工具合作伙伴。平台面向UGC和商业广告场景提供分润制、项目制等变现路径,未来还将提供版权管理后台,实现授权可见、使用可查、收入透明。 产品更新 视频 推荐理由: 这是AI视频领域第一次有平台把版权授权、审核、变现全链路跑通,而且首批入驻的是周星驰的《喜剧之王》《食神》这种真金IP,做AI视频的人终于不用在侵权边缘试探了。

产品更新 视频
AI HOT ·

Bloomberg:Magnetar Capital,这家 180 亿美元的对冲基金公司,将在其最新产品中避免使用人类分析师,转而依靠数百个 AI 智能体进行股票研究。 这家 180 亿美元的对冲基金公司希望 AI 搜索投资想法、研究公司、推荐头寸并预测趋势,而人类仍负责批准交易。

09:47 Rohan Paul @ rohanpaul_ai 精选 75 智能体 行业动态 推荐理由: 一个180亿美元的对冲基金决定不雇人类分析师,直接让几百个AI Agent做股票研究。这比任何报告更能说明AI白领替代的临界点已经来了,做金融的朋友该认真想想自己的位置了。

智能体 行业动态
AI HOT ·

在 AgentsView 中为 Claude Fable 5 设置自定义价格

06:19 Simon Willison 博客 精选 71 Wes McKinney 开发的 AgentsView 是一个用于追踪本地编码智能体 token 使用情况的工具。由于近日发布的 Claude Fable 5 尚未被收录进 AgentsView 的定价数据库,作者利用 Fable 逆向工程,找到了为该模型设置自定义价格的方法,并展示了 Fable 5 当天在不同本地项目中的使用量树状图。 智能体 教程/实践 部署/工程 推荐理由: 如果你也用 coding agent 且在乎成本,Simon 这个自定义价格技巧能让你第一时间把新模型纳入追踪,简单但实用。

智能体 教程/实践 部署/工程
AI HOT ·

Text-To-Lottie:Agent Skill + 本地预览 Harness,让 Agent 生成 Lottie 动画并实时验收

08:47 meng shao @ shao__meng 精选 77 开源项目 Text-To-Lottie 提供一套 Agent Skill 和本地预览工具,让 Codex/Claude Code/Cursor 等 Agent 生成标准 Bodymovin JSON(public/lottie.json),通过 Skottie 渲染引擎在浏览器中实时验收。安装命令:`npx skills add diffusionstudio/lottie`。技术特点:输出标准 Lottie JSON,使用 Skottie 渲染(非 lottie-web);基于 Vite 热重载实现自动刷新闭环;支持通过 Skottie Slots + controls.json 调整颜色、尺寸;Agent 可用 URL 参数 `?frame=60&paused=1` 精确定位帧截图。Prompt 指南包括:给具体素材、使用动效术语、pan/zoom/hold 模拟镜头、显式声明 Slots、锁定时间规格。适合单场景短时长 Motion Graphics、SVG→Lottie、数据可视化、透明背景矢量动效;不适合多镜头剪辑、复杂角色绑定、粒子、3D 或需 lottie-web 全特性的场景。 konstantinpaulus : Introducing text-to-lottie: an open source skill and harness for generating production ready Lottie animations with code... 智能体 MCP/工具 开源/仓库 推荐理由: 让 Agent 写出能直接渲染的 Lottie JSON,这套 Skill + Harness 把生成到验收的链路打得很完整,前端和做动效的都可以直接试。

智能体 MCP/工具 开源/仓库
AI HOT ·

将 GitHub CI 迁移到 Hugging Face Jobs

05:55 Hugging Face:Blog(RSS) 精选 74 本文介绍了如何将 GitHub Actions 的 CI 作业迁移到 Hugging Face Jobs 上运行,以解决 GitHub Actions 速度慢、缺乏 GPU 支持等问题。通过使用 huggingface/jobs-actions 桥接,将 GitHub Actions 的 job 转为临时自托管运行器:GitHub App 监听 `workflow_job.queued` webhook,dispatcher Space 验证后启动对应硬件(CPU 或 t4-small、h200 等 GPU)的 HF Job,由 ephemeral runner 执行 CI 并上报结果。作者基于 Trackio 项目实际落地,CPU 作业时间减少约 30%,并新增了 GPU 测试套件。文章分步说明了复制 dispatcher Space、创建并安装 GitHub App、配置 webhook 和 HF_TOKEN 的具体步骤。 Hugging Face 教程/实践 部署/工程 推荐理由: HF 直接把 CI 桥接器开源了出来,教你把 GitHub Actions 迁到 HF Jobs 上跑 GPU 测试,ML 项目终于可以低成本配上显卡 CI,步骤清晰到能直接抄作业。

Hugging Face 教程/实践 部署/工程
AI HOT ·

精确性不等于忠实度:完整Oracle下的覆盖感知接地生成评估

05:55 HuggingFace Daily Papers(社区热门论文) 精选 76 无参考忠实度度量仅衡量精确率(陈述是否被支持),鼓励模型少说甚至不说以获得高分。本研究利用F1遥测(确定性完整ground truth)和NOAA天气预报两个完整Oracle领域,证明此盲点:在多语言(EN/ES/PT)共7253个决策实例(覆盖150场比赛)的基准上,最精确的前沿模型仅覆盖不到一半相关事实,按F1排名垫底。引入覆盖度(召回率)后系统排序改变;显式要求详尽也无法弥补差距。作者提出将忠实度与覆盖度合并为单一分数,并给出无参考验证器引导生成方法,同时提升精确率和召回率。相关基准、标注、度量、基线及交互演示已开源。 论文/研究 评测/基准 推荐理由: 这个研究戳破了自动评估里 Faithfulness 的泡沫,指标只看模型「说对多少」不看「说全没有」,沉默的模型反而拿高分,以后评测不能只看精确度了,做评估的得补上覆盖度这一环。

论文/研究 评测/基准
AI HOT ·

IBM CEO:AI不一定导致员工减少

06:18 Bloomberg:Technology(RSS) 精选 71 IBM CEO Arvind Krishna表示AI不会必然导致员工数量减少。他透露IBM已在量子计算(一种更快形式的AI)上投资100亿美元,并指出联邦政府承诺投入10亿美元在纽约Albany建设芯片制造设施,体现了公私部门间的紧密合作。 行业动态 推荐理由: IBM 的 100 亿美元量子计算投资是笔大钱,但更值得注意的是 CEO 直接反驳 AI 必裁员论调,这种来自在位巨头的公开判断比分析报告更有分量。

行业动态
AI HOT ·

Super Micro 计划通过股权融资 70 亿美元用于 AI 服务器组件采购

05:48 Bloomberg:Technology(RSS) 精选 75 Super Micro Computer Inc. 计划通过一揽子股权融资筹集 70 亿美元,用于购买客户订单所需的 AI 服务器组件。这笔资金将支持公司扩大产能,以满足不断增长的人工智能基础设施需求。 行业动态 部署/工程 推荐理由: 70亿美元融资是AI算力军备竞赛的明证,不是模型突破,但做硬件的和看投资的都该关注,它说明市场预期AI需求还要翻很多倍。

行业动态 部署/工程
AI HOT ·

OpenRouter 推出 Advisor 工具:让低成本模型可随时调用强模型增强生成

04:23 OpenRouter:Announcements(RSS) 精选 75 OpenRouter 发布 advisor 服务器工具,允许一个快速、便宜的模型在生成过程中咨询一个更强大的模型。具体而言,可用 GPT-4o Mini 处理日常例行工作,在关键时刻调用 Claude Fable 解决真正重要的问题,从而实现成本和质量的动态平衡。 智能体 MCP/工具 产品更新 关联讨论 1 条 X:OpenRouter (@OpenRouter) 推荐理由: OpenRouter 把模型级联从看论文的构想变成了跑在 server 上的产品,对每天纠结用哪个模型的开发者来说,是个省心省钱的实在更新。

智能体 MCP/工具 产品更新
AI HOT ·

Cohere发布North Mini Code:面向开发者的开源编码模型

04:55 Hugging Face:Blog(RSS) 精选 73 Cohere发布North Mini Code,一款30B参数MoE模型(3B活跃参数),Apache 2.0开源。在Artificial Analysis Coding Index上得分33.4,超越Qwen3.5、Gemma 4等同类模型。后训练采用两阶段SFT和RLVR,在SWE-Bench Verified上pass@10达80.2%,Terminal-Bench v2上达55.1%。支持64K/128K上下文长度,专为智能体编码任务优化。 智能体 开源生态 模型发布 编码 关联讨论 1 条 X:opencode (@opencode) 推荐理由: Cohere的新编码模型North Mini Code以30B参数MoE架构,在SWE-bench pass@1达到61%,Apache 2.0开源,是小模型在agent coding领域真正可用的信号。

智能体 开源生态 模型发布 编码
AI HOT ·

Claude Managed Agents 新增定时运行和环境变量存储功能

05:06 Claude:Blog(网页) 精选 75 Claude Managed Agents 今日在 Claude Platform 公开测试两项新功能:代理可按 cron 计划自动执行周期性任务(如夜间数据同步、周度合规扫描、每日摘要),无需用户自建调度器,支持暂停、恢复、归档或按需触发;vaults 新增环境变量支持,允许代理通过 CLI 进行认证请求,真实密钥仅附加在网络边界,代理无法读取。已集成的 CLI 包括 Browserbase、KERNEL、Notion、Ramp 和 Sentry。Rakuten、Actively AI、Ando、Milana 等团队正在使用这些功能实现自动化数据报表、跨账户搜索、招聘提醒等场景。 智能体 Anthropic MCP/工具 产品更新 推荐理由: Claude Managed Agents 现在能定时跑任务和用 vault 安全连接 CLI 了,这基本解决了企业 agent 落地的两个最大痛点——自动化和凭证管理。做 agent 的团队应该仔细读。

智能体 Anthropic MCP/工具 产品更新