推出Fusion API,市场上最智能的复合模型。 Fusion以一半的价格实现Fable级别的智能。 工作原理如下👇
02:24 OpenRouter @ OpenRouter 精选 70 产品更新 部署/工程 推荐理由: OpenRouter 的 Fusion API 说能以一半价格达到 Fable 级智能,对开发者选型是个新选项,但没给具体基准,我会先观望实测。
AI and technology watch
聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。
02:24 OpenRouter @ OpenRouter 精选 70 产品更新 部署/工程 推荐理由: OpenRouter 的 Fusion API 说能以一半价格达到 Fable 级智能,对开发者选型是个新选项,但没给具体基准,我会先观望实测。
02:31 Suno @ suno 精选 70 产品更新 多模态 推荐理由: Suno 把 stem 分离从滤波换成了重新生成,这对做音乐的人来说是个实质进步,artifacts 老问题被从根上解决,不再只是凑合能用。
02:54 Hacker News 热门(buzzing.cc 中文翻译) 精选 76 亚马逊 CEO 与美国官员的会谈直接导致美国政府对 Anthropic 公司的 AI 模型采取整治行动。此次事件涉及对 Anthropic 旗下大语言模型的监管升级,具体措施及模型版本细节尚未披露。 Anthropic 安全/对齐 政策/监管 推荐理由: 亚马逊CEO游说政府整治Anthropic模型,不管细节如何,大公司把政策杠杆当竞争武器这招太值得警惕。做AI的都得盯住这类先例。
08:30 TechCrunch:AI(RSS) 精选 75 据 TechCrunch 报道,Meta 已开始撤销对 Manus 的 20 亿美元收购交易,此前北京要求该交易必须反转。目前收购解除程序已启动。 Meta 政策/监管 行业动态 推荐理由: 北京直接叫停 Meta 对 Manus 的 2B 收购,这是地缘政治干预 AI 并购的里程碑事件,跨国 AI 投资逻辑正在被政令改写。
11:01 小互 @ xiaohu 精选 75 Anthropic CEO Dario Amodei透露内部模型Mythos有上千漏洞,能黑银行、窃取国家机密;预言AI一到五年内砍掉一半入门级白领工作;称Claude已被美军用于对伊朗战争,涉及女校150人死亡拷问;解释离开OpenAI因信任崩塌;回怼黄仁勋末日营销指控;给出文明崩溃概率10%-25%。 Anthropic 大佬观点 安全/对齐 推荐理由: Dario 在上市前爆出 Mythos 能黑银行、NSA 抢着要,还首次解释离开 OpenAI 是信任崩了,每个话题都踩在行业敏感神经上,虽然渲染威胁的时机有点巧,但信息量足够让每个从业者认真看一遍。 08:30 TechCrunch:AI(RSS) 精选 75 Meta 开始撤销 20 亿美元收购 Manus 的交易 据 TechCrunch 报道,Meta 已开始撤销对 Manus 的 20 亿美元收购交易,此前北京要求该交易必须反转。目前收购解除程序已启动。 Meta 政策/监管 行业动态 推荐理由: 北京直接叫停 Meta 对 Manus 的 2B 收购,这是地缘政治干预 AI 并购的里程碑事件,跨国 AI 投资逻辑正在被政令改写。 02:54 Hacker News 热门(buzzing.cc 中文翻译) 精选 76 亚马逊首席执行官与美国官员会谈引发对 Anthropic 模型的整治 亚马逊 CEO 与美国官员的会谈直接导致美国政府对 Anthropic 公司的 AI 模型采取整治行动。此次事件涉及对 Anthropic 旗下大语言模型的监管升级,具体措施及模型版本细节尚未披露。 Anthropic 安全/对齐 政策/监管 推荐理由: 亚马逊CEO游说政府整治Anthropic模型,不管细节如何,大公司把政策杠杆当竞争武器这招太值得警惕。做AI的都得盯住这类先例。 02:31 Suno @ suno 精选 70 重大更新:Suno 的音轨分离刚刚大幅升级。🚀 我们现在从零重新生成音轨,而非仅仅隔离频率。结果如何?纯净无伪影的音轨,可直接拖入你的 DAW。 产品更新 多模态 推荐理由: Suno 把 stem 分离从滤波换成了重新生成,这对做音乐的人来说是个实质进步,artifacts 老问题被从根上解决,不再只是凑合能用。 02:24 OpenRouter @ OpenRouter 精选 70 推出Fusion API,市场上最智能的复合模型。 Fusion以一半的价格实现Fable级别的智能。 工作原理如下👇 产品更新 部署/工程 推荐理由: OpenRouter 的 Fusion API 说能以一半价格达到 Fable 级智能,对开发者选型是个新选项,但没给具体基准,我会先观望实测。 00:52 Hacker News 热门(buzzin
01:01 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 67 OpenAI 发布三门 Academy 课程,帮助用户掌握实用 AI 技能、创建可重复工作流,并在日常工作中应用 AI 智能体。 智能体 OpenAI 教程/实践 推荐理由: 这三门课不是那种泛泛的“AI 提高效率”鸡汤,而是直接教你怎么把 agent 做成可重复的工作流,产品经理和运营能立刻套用。
00:14 Anthropic:Newsroom(网页) 精选 73 Anthropic对近5.2万美国人调查显示:48%将治愈癌症等疾病列为首要期望,36%希望AI帮助残障人士。64%担忧AI导致失业,56%担忧认知依赖,52%担忧信息误导。超70%支持政府监管,最关注隐私(56%)、儿童安全(52%)和责任归属(49%)。仅15%信任AI公司决策。多数议题上观点不因党派或地域严重分裂。调查于2025年11-12月由YouGov线上执行并加权至人口普查基准。 Anthropic 政策/监管 现象/趋势 推荐理由: Anthropic发布了一份覆盖5.2万美国人的AI民意调查,首次系统揭示了公众的恐惧排名——失业第一、认知依赖第二。虽然他们借数据推广自家政策框架的意图明显,但这两组数字对产品人理解用户心态极有价值。
22:12 MiniMax (official) @ MiniMax_AI 精选 81 MiniMax (official) : Introducing MiniMax M3: The First Open-Weights Model to Combine Three Frontier Capabilities - Coding & Agentic Frontier:... Hugging Face 多模态 推理 模型发布 关联讨论 1 条 X:MiniMax (@MiniMax_AI) 推荐理由: 开放权重模型首次把编码 Agent 和多模态拉满,SWE-bench Pro 59% 逼近专有前沿,附带稀疏注意力 1M 上下文。做代码工具和 Agent 的团队应该都盯上它了。
23:36 IT之家(RSS) 精选 74 6月12日,字节跳动旗下AI应用豆包大范围上线“任务模式”,支持定时执行、零代码网页生成、一键PPT生成、数据可视化分析等全链路Agent执行。原“思考模式”升级为“专家模式”,调用豆包大模型2.0 Pro版本,强化深度推理能力。App顶部模式切换改为“快速、专家、任务”。基础功能免费,高阶服务付费,专业版三档:标准版68元/月或688元/年,加强版200元/月或2048元/年,专业版500元/月或5088元/年。 智能体 MCP/工具 产品更新 推荐理由: 豆包从对话助手转向能自主规划执行的任务模式,这是国产 AI 应用向 Agent 演进的一个明确信号,产品人该看看它如何用「快速、专家、任务」三种模式重塑用户预期。 22:12 MiniMax (official) @ MiniMax_AI 精选 81 MiniMax 发布开源权重模型 M3,约 428B 总参数、23B 激活参数,已上传 HuggingFace。该模型融合三种前沿能力:编码与智能体方面达 59.0% SWE-Bench Pro、66.0% Terminal Bench 2.1、34.8% SWE-fficiency、28.8% KernelBench Hard、74.2% MCP Atlas;采用 MiniMax 稀疏注意力将上下文窗口扩展至 1M token;原生多模态。同步上线 MiniMax Code 工具及 API 平台。权重与技术报告预计约 10 天后发布。 MiniMax (official) : Introducing MiniMax M3: The First Open-Weights Model to Combine Three Frontier Capabilities - Coding & Agentic Frontier:... Hugging Face 多模态 推理 模型发布 关联讨论 1 条 X:MiniMax (@MiniMax_AI) 推荐理由: 开放权重模型首次把编码 Agent 和多模态拉满,SWE-bench Pro 59% 逼近专有前沿,附带稀疏注意力 1M 上下文。做代码工具和 Agent 的团队应该都盯上它了。 18:24 Kimi.ai @ Kimi_Moonshot 精选 70 Kimi 发布并开源最新代码模型 Kimi-K2.7-Code Kimi 发布并开源最新代码模型 Kimi-K2.7-Code。相比 K2.6,其在 Kimi Code Bench v2 上提升 +21.8%,Program Bench 提升 +11.0%,MLS Bench Lite 提升 +31.5%。推理效率改进,推理 token 使用量降低 30%,长时编码任务中指令遵循和端到端成功率均提升。6x 高速模式即将推
00:00 Hugging Face:Blog(RSS) 精选 74 olmo-eval 是基于 OLMES 标准构建的评估工作台,专为 LLM 持续开发中的反复评测场景设计。相比 OLMES,它减少了新增评测的实现工作量,支持 agentic 和多轮评测作为一等用例,并允许根据基准需求选择轻量直接运行或容器化隔离运行。采用模块化架构,模型、工具、容器环境、辅助模型均可独立替换。评测结果同时报告分数、标准误差和最小可检测效应。与 Harbor 侧重于发布不同,olmo-eval 聚焦开发阶段快速迭代,可逐问题对比检查点输出以区分真实改进与噪声。 Hugging Face 产品更新 开源生态 评测/基准 推荐理由: 做模型训练的人会感谢这个工具,它把评估从一次性打分变成能持续对比的流程,按题对比两个 checkpoint 的功能很实用,但如果你不训模型,这篇可以跳过。
18:24 Kimi.ai @ Kimi_Moonshot 精选 70 Kimi 发布并开源最新代码模型 Kimi-K2.7-Code。相比 K2.6,其在 Kimi Code Bench v2 上提升 +21.8%,Program Bench 提升 +11.0%,MLS Bench Lite 提升 +31.5%。推理效率改进,推理 token 使用量降低 30%,长时编码任务中指令遵循和端到端成功率均提升。6x 高速模式即将推出,即日起可通过 Kimi API 和 Kimi Code 使用。 开源生态 推理 模型发布 编码 推荐理由: 月之暗面这次把编码模型做到 K2.7 还直接开源,Bench 提升不小,关键是把「想太多」的毛病治了,推理 token 省了三成,做 coding agent 的可以立刻换上试试。
今日热点 TOP 2 1 21 信源 · 1小时前 2 智谱 GLM-5.2 全量开放,支持 1M 上下文且下周开源 3 信源 · 4小时前
17:00 HuggingFace Daily Papers(社区热门论文) 精选 73 HYDRA-X 是首个在单个 Vision Transformer (ViT) 中统一图像与视频 tokenization 的统一多模态模型。通过帧级因果时间注意力实现视觉重建,并采用层级时间压缩替代单步压缩。轻量级解压器在联合图像-视频教师监督下上采样时间压缩特征。编辑管线中,源-目标交互在分词器内部潜在层面而非 LLM 语义层面进行,提升编辑一致性与收敛速度。7B 密集模型在图像与视频理解及生成任务上表现强劲。 arXiv 多模态 视频 论文/研究 推荐理由: HYDRA-X 第一次把图像和视频标记塞进同一个 ViT,光看设计了帧级时序注意力和分层压缩这两个小 tricks 就值回票价,做多模态模型的该读读。
14:00 HuggingFace Daily Papers(社区热门论文) 精选 77 MiniMax 提出块状稀疏注意力 MSA,基于 GQA 构建。轻量级 Index Branch 为每个 GQA 组独立选择 Top‑k KV 块,Main Branch 仅对选中块执行精确块稀疏注意力。在 109B 参数多模态模型上,MSA 与 GQA 性能持平,1M 上下文下每 token 注意力计算减少 28.4 倍。配合协同设计的 GPU 内核,H800 上实现 14.2 倍 prefill 和 7.6 倍 decoding 端到端加速。推理内核与基于 MSA 的多模态模型已公开发布。 GitHub Hugging Face 开源/仓库 推理 推荐理由: MiniMax这个稀疏注意力把长上下文推理计算砍掉28倍,而且直接开源了高效CUDA kernel和模型,做agent和代码仓库级推理的团队可以赶紧试试。
11:00 HuggingFace Daily Papers(社区热门论文) 精选 70 EurekAgent 是一个环境工程化的大语言模型智能体系统,专为度量驱动的自主科学发现设计。它从权限工程(可控执行与隔离评估)、产物工程(文件系统与 Git 协作)、预算工程(成本感知探索)和人在回路工程(简便监督干预)四个维度构建执行环境。EurekAgent 在数学、内核工程和机器学习任务上取得新 SOTA,包括以不到 11 美元总 API 成本发现新的 26 圆填充结果。代码与结果已开源。 智能体 arXiv 开源生态 论文/研究 推荐理由: EurekAgent 把科学发现的目光从设计智能体流程转向环境工程,用不到 11 美元就找到了新的圆打包纪录,这可能是低成本自主科研的转折点。
11:54 小互 @ xiaohu 精选 75 小互 : 一句话搞定公众号排版、封面生成、发布 我做了个技能组合,可以一句话搞定公众号排版、封面生成,和一键发送到公众号草稿箱,你只需点下发布即可。 已经开源了 有20种主题颜色可选 最重要的是它会自动分析你的内容,进行自动排版,不是Markdown... Anthropic 图像生成 开源/仓库 教程/实践 推荐理由: 小互把公众号排版全流程做成一个开源技能,一句话就能从内容生成到草稿箱,做公众号的可以直接用,这种自动化程度很少见。
16:14 Z.ai @ Zai_org 精选 73 智谱(Z.ai)发布新旗舰模型 GLM-5.2,现已对 GLM Coding Plan 用户(Lite/Pro/Max/Team 计划)开放。该模型具备强大编程能力、可用的 1M 上下文支持,并延续长程任务优势。API 和聊天机器人服务将于下周上线,模型也将于下周以 MIT 许可证正式开源。 开源生态 模型发布 编码 关联讨论 1 条 X:邵猛 (@shao__meng) 推荐理由: GLM-5.2把旗舰模型直接推给开发者,下周还要MIT开源,这是国产大模型开放生态的一个积极信号,做coding的可以重点看它的1M上下文和编码能力。 15:36 IT之家(RSS) 精选 72 扎克伯格承认 Meta AI 转型"脱轨":裁员 10%、转岗 7000 人后组织调整过快 路透社披露的 Meta 内部备忘录显示,CEO 扎克伯格承认公司在 AI 转型中组织调整节奏过快,带来员工安置、管理跨度等问题,预计未来“几乎肯定会犯更多错误”。Meta 今年 5 月已裁减全球 10% 员工,并将 7000 人转入 AI 相关新项目。为缓解协作问题,公司将增加团队建设预算,7 月举办黑客松。新成立的应用 AI 工程部门个人贡献者与管理者比例最高达 50:1。扎克伯格重申今年不再全公司裁员。 Meta 现象/趋势 行业动态 推荐理由: 扎克伯格罕见承认 AI 转型"脱轨",这不是公关话术,而是大型科技公司激进投入 AI 时组织剧烈动荡的真实写照,对判断职业风险很有参考价值。 14:36 IT之家(RSS) 精选 73 SemiAnalysis 洞察 Token 经济:200 美元 AI 订阅榨出 70 倍用量 SemiAnalysis 购买了 Anthropic 和 OpenAI 的全部订阅方案,模拟高强度编码任务直至触及每周上限。月费 200 美元的 Claude Max 20x 方案,按 API 价格换算最高可消耗约值 8000 美元的 token;ChatGPT Pro 20x 方案对应最高约值 14000 美元的 token。用户通过订阅可获取 40 至 70 倍的 API 价值,该机构指出这种价格体系在重度用户持续榨满上限后可能难以长期维持。 Anthropic OpenAI 推理 现象/趋势 推荐理由: SemiAnalysis 通过高强度编码测试戳破了 200 美元订阅的真实性价比,虽然数据来自推文未附复现步骤,但这个价差足够让重度用户重新算账。 13:17 蚂蚁 inclusionAI:HuggingFace 新模型 精选 62 inclusionAI 发布 VISTA-4B GUI 定位视觉语言模型 VISTA-4B 是基于 Qwen3.5-4B 骨干的 GUI 定位模型,输入截图与自然语言指令,输出归一化
11:00 HuggingFace Daily Papers(社区热门论文) 精选 75 WEAVER是一种多视图世界模型架构,通过流匹配损失训练预测未来潜变量和奖励值,满足保真度、一致性和效率三个要求。在机器人操作任务上,WEAVER在政策评估中与真实成功率的相关系数ρ=0.870,在π₀.₅基础模型基础上实现政策改进成功率提升38%,测试时规划成功率提升14%,且速度比先前世界模型快5–10倍。在分布外场景下表现也优于先前世界模型。代码、模型和视频已开源。 arXiv 具身智能 数据/训练 论文/研究 推荐理由: 世界模型在机器人操控上第一次同时跑通了「高保真、长时一致、高推理效率」这三个硬指标,真机实验把成功率拉高38%,代码模型全开源,搞具身智能的值得认真读。
3 4 信源 · 1天前
11:00 向阳乔木 @ vista8 精选 75 推文提出AI Agent开发中人类与AI对PRD的需求不同,为此发布了一个专门服务于AI的PRD文档生成Prompt(命名为qiaomu-ai-prd)。开发者先使用该Prompt生成文档,再交给AI开发,可显著提升功能完整度和丰富性。安装指令为:`npx skills add joeseesun/qiaomu-ai-prd`,开源地址及Prompt见评论区。 智能体 MCP/工具 教程/实践 关联讨论 1 条 X:Vista (@vista8) 推荐理由: 如果你用 AI 做开发,这个 PRD 生成 Prompt 比你自己瞎写强一个量级,功能完整度翻倍,还不容易漏掉边界情况。装个 skill 就能用,算是个顺手小升级。
有任何建议或问题,欢迎告诉我们
感谢您的反馈!