AI HOT
·
2026-06-14 00:00
18:24 Kimi.ai @ Kimi_Moonshot 精选 70 Kimi 发布并开源最新代码模型 Kimi-K2.7-Code。相比 K2.6,其在 Kimi Code Bench v2 上提升 +21.8%,Program Bench 提升 +11.0%,MLS Bench Lite 提升 +31.5%。推理效率改进,推理 token 使用量降低 30%,长时编码任务中指令遵循和端到端成功率均提升。6x 高速模式即将推出,即日起可通过 Kimi API 和 Kimi Code 使用。 开源生态 推理 模型发布 编码 推荐理由: 月之暗面这次把编码模型做到 K2.7 还直接开源,Bench 提升不小,关键是把「想太多」的毛病治了,推理 token 省了三成,做 coding agent 的可以立刻换上试试。
开源生态
推理
模型发布
编码
AI HOT
·
2026-06-13 22:15
今日热点 TOP 2 1 21 信源 · 1小时前 2 智谱 GLM-5.2 全量开放,支持 1M 上下文且下周开源 3 信源 · 4小时前
AI HOT
·
2026-06-13 19:04
17:00 HuggingFace Daily Papers(社区热门论文) 精选 73 HYDRA-X 是首个在单个 Vision Transformer (ViT) 中统一图像与视频 tokenization 的统一多模态模型。通过帧级因果时间注意力实现视觉重建,并采用层级时间压缩替代单步压缩。轻量级解压器在联合图像-视频教师监督下上采样时间压缩特征。编辑管线中,源-目标交互在分词器内部潜在层面而非 LLM 语义层面进行,提升编辑一致性与收敛速度。7B 密集模型在图像与视频理解及生成任务上表现强劲。 arXiv 多模态 视频 论文/研究 推荐理由: HYDRA-X 第一次把图像和视频标记塞进同一个 ViT,光看设计了帧级时序注意力和分层压缩这两个小 tricks 就值回票价,做多模态模型的该读读。
arXiv
多模态
视频
论文/研究
AI HOT
·
2026-06-13 18:00
14:00 HuggingFace Daily Papers(社区热门论文) 精选 77 MiniMax 提出块状稀疏注意力 MSA,基于 GQA 构建。轻量级 Index Branch 为每个 GQA 组独立选择 Top‑k KV 块,Main Branch 仅对选中块执行精确块稀疏注意力。在 109B 参数多模态模型上,MSA 与 GQA 性能持平,1M 上下文下每 token 注意力计算减少 28.4 倍。配合协同设计的 GPU 内核,H800 上实现 14.2 倍 prefill 和 7.6 倍 decoding 端到端加速。推理内核与基于 MSA 的多模态模型已公开发布。 GitHub Hugging Face 开源/仓库 推理 推荐理由: MiniMax这个稀疏注意力把长上下文推理计算砍掉28倍,而且直接开源了高效CUDA kernel和模型,做agent和代码仓库级推理的团队可以赶紧试试。
GitHub
Hugging Face
开源/仓库
推理
AI HOT
·
2026-06-13 17:29
11:00 HuggingFace Daily Papers(社区热门论文) 精选 70 EurekAgent 是一个环境工程化的大语言模型智能体系统,专为度量驱动的自主科学发现设计。它从权限工程(可控执行与隔离评估)、产物工程(文件系统与 Git 协作)、预算工程(成本感知探索)和人在回路工程(简便监督干预)四个维度构建执行环境。EurekAgent 在数学、内核工程和机器学习任务上取得新 SOTA,包括以不到 11 美元总 API 成本发现新的 26 圆填充结果。代码与结果已开源。 智能体 arXiv 开源生态 论文/研究 推荐理由: EurekAgent 把科学发现的目光从设计智能体流程转向环境工程,用不到 11 美元就找到了新的圆打包纪录,这可能是低成本自主科研的转折点。
智能体
arXiv
开源生态
论文/研究
AI HOT
·
2026-06-13 17:29
11:54 小互 @ xiaohu 精选 75 小互 : 一句话搞定公众号排版、封面生成、发布 我做了个技能组合,可以一句话搞定公众号排版、封面生成,和一键发送到公众号草稿箱,你只需点下发布即可。 已经开源了 有20种主题颜色可选 最重要的是它会自动分析你的内容,进行自动排版,不是Markdown... Anthropic 图像生成 开源/仓库 教程/实践 推荐理由: 小互把公众号排版全流程做成一个开源技能,一句话就能从内容生成到草稿箱,做公众号的可以直接用,这种自动化程度很少见。
Anthropic
图像生成
开源/仓库
教程/实践
AI HOT
·
2026-06-13 17:29
16:14 Z.ai @ Zai_org 精选 73 智谱(Z.ai)发布新旗舰模型 GLM-5.2,现已对 GLM Coding Plan 用户(Lite/Pro/Max/Team 计划)开放。该模型具备强大编程能力、可用的 1M 上下文支持,并延续长程任务优势。API 和聊天机器人服务将于下周上线,模型也将于下周以 MIT 许可证正式开源。 开源生态 模型发布 编码 关联讨论 1 条 X:邵猛 (@shao__meng) 推荐理由: GLM-5.2把旗舰模型直接推给开发者,下周还要MIT开源,这是国产大模型开放生态的一个积极信号,做coding的可以重点看它的1M上下文和编码能力。 15:36 IT之家(RSS) 精选 72 扎克伯格承认 Meta AI 转型"脱轨":裁员 10%、转岗 7000 人后组织调整过快 路透社披露的 Meta 内部备忘录显示,CEO 扎克伯格承认公司在 AI 转型中组织调整节奏过快,带来员工安置、管理跨度等问题,预计未来“几乎肯定会犯更多错误”。Meta 今年 5 月已裁减全球 10% 员工,并将 7000 人转入 AI 相关新项目。为缓解协作问题,公司将增加团队建设预算,7 月举办黑客松。新成立的应用 AI 工程部门个人贡献者与管理者比例最高达 50:1。扎克伯格重申今年不再全公司裁员。 Meta 现象/趋势 行业动态 推荐理由: 扎克伯格罕见承认 AI 转型"脱轨",这不是公关话术,而是大型科技公司激进投入 AI 时组织剧烈动荡的真实写照,对判断职业风险很有参考价值。 14:36 IT之家(RSS) 精选 73 SemiAnalysis 洞察 Token 经济:200 美元 AI 订阅榨出 70 倍用量 SemiAnalysis 购买了 Anthropic 和 OpenAI 的全部订阅方案,模拟高强度编码任务直至触及每周上限。月费 200 美元的 Claude Max 20x 方案,按 API 价格换算最高可消耗约值 8000 美元的 token;ChatGPT Pro 20x 方案对应最高约值 14000 美元的 token。用户通过订阅可获取 40 至 70 倍的 API 价值,该机构指出这种价格体系在重度用户持续榨满上限后可能难以长期维持。 Anthropic OpenAI 推理 现象/趋势 推荐理由: SemiAnalysis 通过高强度编码测试戳破了 200 美元订阅的真实性价比,虽然数据来自推文未附复现步骤,但这个价差足够让重度用户重新算账。 13:17 蚂蚁 inclusionAI:HuggingFace 新模型 精选 62 inclusionAI 发布 VISTA-4B GUI 定位视觉语言模型 VISTA-4B 是基于 Qwen3.5-4B 骨干的 GUI 定位模型,输入截图与自然语言指令,输出归一化
开源生态
模型发布
编码
Meta
现象/趋势
行业动态
Anthropic
OpenAI
推理
智能体
Hugging Face
多模态
安全/对齐
教程/实践
部署/工程
GitHub
政策/监管
产品更新
评测/基准
AI HOT
·
2026-06-13 15:22
11:00 HuggingFace Daily Papers(社区热门论文) 精选 75 WEAVER是一种多视图世界模型架构,通过流匹配损失训练预测未来潜变量和奖励值,满足保真度、一致性和效率三个要求。在机器人操作任务上,WEAVER在政策评估中与真实成功率的相关系数ρ=0.870,在π₀.₅基础模型基础上实现政策改进成功率提升38%,测试时规划成功率提升14%,且速度比先前世界模型快5–10倍。在分布外场景下表现也优于先前世界模型。代码、模型和视频已开源。 arXiv 具身智能 数据/训练 论文/研究 推荐理由: 世界模型在机器人操控上第一次同时跑通了「高保真、长时一致、高推理效率」这三个硬指标,真机实验把成功率拉高38%,代码模型全开源,搞具身智能的值得认真读。
arXiv
具身智能
数据/训练
论文/研究
AI HOT
·
2026-06-13 14:15
3 4 信源 · 1天前
AI HOT
·
2026-06-13 13:07
11:00 向阳乔木 @ vista8 精选 75 推文提出AI Agent开发中人类与AI对PRD的需求不同,为此发布了一个专门服务于AI的PRD文档生成Prompt(命名为qiaomu-ai-prd)。开发者先使用该Prompt生成文档,再交给AI开发,可显著提升功能完整度和丰富性。安装指令为:`npx skills add joeseesun/qiaomu-ai-prd`,开源地址及Prompt见评论区。 智能体 MCP/工具 教程/实践 关联讨论 1 条 X:Vista (@vista8) 推荐理由: 如果你用 AI 做开发,这个 PRD 生成 Prompt 比你自己瞎写强一个量级,功能完整度翻倍,还不容易漏掉边界情况。装个 skill 就能用,算是个顺手小升级。
智能体
MCP/工具
教程/实践
AI HOT
·
2026-06-13 10:32
08:59 meng shao @ shao__meng 精选 75 邵猛分享 Spec 驱动开发(SDD)方法,用三个 Skills(/write-product-spec、/write-tech-spec、/validate-changes-match-specs)覆盖 Spec→Implement→Verify 闭环。规格分两层:PRODUCT.md(用户故事、不变量)和 TECH.md(架构、实现策略),均放在 specs/<issue>/ 目录,随 PR 提交。五步流程:写产品规格、写技术规格、Agent 按规格实现、一致性校验、计算机操作端到端验证。Skills 可移植,不绑定 Warp。开源仓库 warpdotdev/common-skills,安装:npx skills add warpdotdev/common-skills。 Zach Lloyd : http://x.com/i/article/2065151123128721408 智能体 GitHub 教程/实践 编码 推荐理由: 邵猛把SDD从概念变成三个可安装Skill,特别是第五步用计算机操作验证UI,这招对Rust桌面应用团队是降维打击。做AI coding的可以直接抄作业。
智能体
GitHub
教程/实践
编码
AI HOT
·
2026-06-13 10:32
10:34 IT之家(RSS) 精选 75 苹果在 iOS 27 中优化健康 App,将列表改为卡片布局并增加导航栏。新增视觉智能营养识别,用户通过相机 Siri 模式拍摄食物可获取加工程度、蛋白质、含糖量等信息及营养价值评级,不提供精确卡路里,需 iPhone 15 Pro 及以上。经期追踪扩展支持围绝经期,可分析长期周期异常模式并推送提醒与指导。Fitness+ 新增围绝经期和绝经期课程。数据同步速度提升,GymKit 扩展至 iPhone,无需 Apple Watch 即可与健身设备配对同步数据。 产品更新 多模态 端侧 推荐理由: 视觉智能营养识别不能给精确卡路里,但那个“深度加工食品”提醒对普通人很实用,健康App这次更新算得上近年最有用了。
产品更新
多模态
端侧
AI HOT
·
2026-06-13 09:20
09:05 Yuchen Jin @ Yuchenj_UW 精选 88 ClaudeDevs : As a result of a US government directive, we are suspending access to Claude Fable 5 for all users. You can continue to ... Anthropic 政策/监管 行业动态 推荐理由: 美国政府首次直接指令暂停一款头部模型,意义远超一次产品下线。对所有靠 Claude 构建产品的团队来说,这相当于一记警钟,监管风险已经从抽象讨论变成现实业务中断。
Anthropic
政策/监管
行业动态
AI HOT
·
2026-06-13 09:20
09:14 ClaudeDevs @ ClaudeDevs 精选 85 美国以国家安全为由发布出口管制指令,要求暂停Claude Fable 5和Mythos 5对所有外国国民的访问,包括美国境内外及Anthropic外籍员工。Anthropic已立即禁用这两个模型,新会话将默认使用Opus 4.8或用户选定模型,现有Fable 5会话报错终止。平台API请求同样失效。其他Claude模型不受影响。Anthropic称此为误解,正努力恢复访问。 Anthropic : The US government, citing national security authorities, has issued an export control directive to suspend all access to... Anthropic 政策/监管 推荐理由: 美国政府突然叫停 Fable 5 和 Mythos 5,直接断了所有用户的访问,这件事的影响远超 Anthropic 自身,它标志着 AI 模型开始像芯片一样被出口管制,所有做 AI 应用的人都得警惕。
Anthropic
政策/监管
AI HOT
·
2026-06-13 09:20
09:14 Anthropic @ AnthropicAI 精选 88 Anthropic宣布,美国政府根据国家安全指令,暂停所有外国国民(包括Anthropic外籍员工)对Fable 5和Mythos 5的访问权限。Anthropic必须立即为所有客户禁用这两个模型以确保合规,其他Claude模型不受影响。公司表示这可能是误解,正在尽快恢复访问。 Anthropic 安全/对齐 政策/监管 推荐理由: 这是美国首次以国家安全为由,直接要求 AI 公司禁用特定模型,信号极其强烈。虽然 Anthropic 称是误解,但此事可能成为 AI 出口管制历史上一个分水岭。
Anthropic
安全/对齐
政策/监管
AI HOT
·
2026-06-13 08:14
06:47 Hacker News 热门(buzzing.cc 中文翻译) 精选 70 一项模拟研究显示,大型语言模型(LLM)在 95% 的模拟场景中会选择使用战术核武器。该研究未指明具体模型名称与版本,结果引发对 AI 决策行为的关注。 智能体 安全/对齐 推理 推荐理由: AI在模拟战争中毫不犹豫按下核按钮的概率高达95%,这个实验比任何安全白皮书都更直观地展示了自主武器的可怕,做AI安全和军事相关的必须看一眼。
智能体
安全/对齐
推理
AI HOT
·
2026-06-13 08:14
08:29 OpenAI @ OpenAI 精选 70 OpenAI 产品更新 编码 关联讨论 1 条 X:Jason Liu (@jxnlco) 推荐理由: OpenAI 给 Codex 加了个攒速率重置的小功能,没用完的可以存起来以后用,适合偶尔深夜冲刺的开发者。不算大更新,但挺实用。
OpenAI
产品更新
编码
AI HOT
·
2026-06-13 08:14
08:42 OpenAI Developers @ OpenAIDevs 精选 69 MCP/工具 OpenAI 产品更新 编码 推荐理由: Codex 现在能直接调用 Chrome DevTools 调试浏览器问题,做前端和全栈的同行可以试试,省得在应用和调试工具之间来回切。
MCP/工具
OpenAI
产品更新
编码
AI HOT
·
2026-06-13 07:06
06:13 Replit ⠕ @ Replit 精选 68 产品更新 部署/工程 推荐理由: Replit 跟 Databricks 打通安全预览,能让非技术角色直接搭应用而不碰底层数据,对已经用这两家的团队是个实用更新,其余人可以等等正式版。
产品更新
部署/工程
AI HOT
·
2026-06-13 05:36
06:13 Replit ⠕ @ Replit 精选 72 智能体 教程/实践 编码 推荐理由: Replit 官方教你跟 Agent 好好说话,这些 prompt 技巧对重度 Replit 用户是即时生产力,但出了这个生态圈就没什么用,典型的工具限定型干货。
智能体
教程/实践
编码