AI HOT
·
2026-06-18 04:29
23:43 Hugging Face:Blog(RSS) 精选 69 MolmoMotion基于Molmo 2骨干网络,输入视频帧、物体上的3D点标记及文字动作指令(如“移动并旋转桌上放水果的木碗”),预测未来数秒内这些点的3D轨迹。提供两个变体:自回归的MolmoMotion-AR逐步预测坐标,流匹配的MolmoMotion-FM通过连续空间变换处理多可能性运动。同时发布MolmoMotion-1M数据集(含116万视频的3D点轨迹及动作描述)和PointMotionBench基准测试(2700个人工验证视频片段)。模型权重、数据集和基准测试均已开源。 Hugging Face 具身智能 多模态 模型发布 推荐理由: MolmoMotion把3D运动预测从模板化推到任意物体,百万级数据集和基准让研究门槛大降,做机器人和视频生成的值得认真看,但目前仍是研究阶段,离落地还有距离。
Hugging Face
具身智能
多模态
模型发布
AI HOT
·
2026-06-18 04:29
03:46 Claude @ claudeai 精选 66 Anthropic 产品更新 编码 推荐理由: Claude Design 这次更新把设计系统、canvas 编辑和代码同步打通了,设计师和开发者之间那堵墙终于有了一个门,团队可以直接在画布上迭代,不用来回截图了。
Anthropic
产品更新
编码
AI HOT
·
2026-06-18 03:22
13:05 IT之家(RSS) 精选 73 OpenAI 在 2026 年第一季度现金消耗达 37 亿美元,超过同期 57 亿美元收入的一半。数据来自一份向股东披露的文件,直观体现 AI 大模型研发与规模化落地的巨额成本。OpenAI 正筹备上市,已在美国保密递交 IPO 申请,最早或于 9 月完成,估值最高可达 1 万亿美元。头部 AI 企业持续重金投入算力、模型研发与人才招募以维持竞争优势。 OpenAI 行业动态 关联讨论 1 条 Hacker News 热门(buzzing.cc 中文翻译) 推荐理由: OpenAI上市前夕的财务快照:一季度烧掉37亿,占收入一半多,万亿估值背后是疯狂军备竞赛。对关注AI商业可持续性的人,这是关键数据点。
OpenAI
行业动态
AI HOT
·
2026-06-18 03:22
16:09 智谱:研究(网页内嵌数据) 精选 59 GLM-5.2 已发布并开源,采用 MIT 协议,支持 1M 上下文窗口。Coding 方面能承载项目级上下文,长程任务执行更稳定,遵循生产级工程规范,并支持客户端与移动端真机调试闭环。通过极致 Infra 优化,发布首日即可在国产算力平台运行。模型已开源至 GitHub、Hugging Face、ModelScope、BigModel 开放平台、Z.ai、智谱清言、AutoClaw 及 ZCode。 开源生态 模型发布 编码 关联讨论 10 条 X:Testing Catalog (@testingcatalog) 公众号:智谱(GLM) Hugging Face:Blog(RSS) X:硅基流动 SiliconFlow (@SiliconFlowAI) The Decoder:AI News(RSS) X:歸藏 (@op7418) X:智谱 Z.ai (@Zai_org) IT之家(RSS) X:Oran Ge (@oran_ge) X:Kim (@kimmonismus) 推荐理由: 智谱这次升级很务实,1M 上下文和 MIT 协议对做长程任务的开发者很实用,但官方没给出量化 benchmark,实际提升还得自己上手测。
开源生态
模型发布
编码
AI HOT
·
2026-06-18 03:22
17:50 公众号:火山引擎 精选 63 火山引擎一站式营销创作平台Kickart 3.0(原“创作Agent”)正式上线,升级为对话式视频生成模式,用户可通过多轮对话调整商品图、故事板等,用自然语言生成营销视频。新增“爆款裂变”能力,上传视频链接后自动拆解爆款逻辑并重构至新商品视频,支持抖音电商内容合规与质量预审核。平台开放SaaS、API及Skill等多种交付方式,并已接入Seedance 2.0 mini,助力降低广告营销成本。 产品更新 视频 推荐理由: 火山引擎为营销人带来的视频生成工具体验不错,对话式调整和爆款裂变能降低创作门槛,但对于关注AI技术进展的读者,这更像一次垂直行业产品迭代,亮点有限。
产品更新
视频
AI HOT
·
2026-06-18 03:22
18:39 Hugging Face:Blog(RSS) 精选 66 AWS(Apache 2.0)开源的 Strands Robots SDK 将 LeRobot 栈封装为 AgentTools,构建统一智能体。默认用 MuJoCo 模拟(无需硬件),mode="real" 切换至真实机器人。可记录演示数据为 LeRobotDataset 并推送 Hugging Face Hub,运行 GR00T 或 LerobotLocal 策略推理,经 Zenoh mesh 广播命令到多台机器人。模拟与硬件代码完全一致,只需改一个关键字参数。示例可在笔记本(Python 3.12+,Linux/macOS)无硬件、无 GPU 运行。 Hugging Face 产品更新 具身智能 开源生态 推荐理由: AWS 的 Strands Robots 把 LeRobot 仿真和硬件部署装进同一个 Agent 里,代码几乎不变就能从模拟切到物理机器人,对具身智能开发者是省掉胶水代码的实用工具。
Hugging Face
产品更新
具身智能
开源生态
AI HOT
·
2026-06-18 03:22
21:07 IT之家(RSS) 精选 74 6月17日,阿里云发布开放式世界模型HappyOyster 1.0(快乐生蚝)。该产品基于原生多模态架构,支持多模态输入与音视频联合生成,可在生成过程中持续接收用户指令并实时响应画面。它深度学习物理世界状态转移规律,保持人物和环境长程一致性。官网开放“实时导演”与“世界探索”两种玩法:前者可随时叫停改写故事、与虚拟男友实时互动等;后者支持自由漫游、滑板冲刺、翼装滑翔、骑马奔驰、攻击打怪等交互。该产品已于今年4月16日开放内测,即日起至7月17日官网不定期掉落体验积分。 产品更新 多模态 视频 推荐理由: 阿里把世界模型做成了可玩的交互产品,一句话生成能探索能互动的数字世界,实时导演模式直接替代了一部分短剧和互动内容创作,虽然还像噱头但至少是能玩的尝试。
产品更新
多模态
视频
AI HOT
·
2026-06-18 02:15
12:50 Tomer Tunguz 博客(VC 分析) 精选 62 Hacker News 讨论揭示:Qwen 3.6 35B-A3B 模型提及率 33% 领先,27B 变体以 20% 紧随其后,DeepSeek Pro 与 Gemma4 31B 位列前四。Agent 工具中 Pi (49%) 与 OpenCode (45%) 占主导。用户对比称,Claude Opus 可带来 15 倍加速,而本地离线 Qwen 提供 5 倍加速,且完全免费、保护隐私。SWE-bench Verified 基准测试显示,Qwen 3.6 27B 得分 77.2%,35B-A3B 得分 73.4%,接近 Claude Sonnet 4.6 的 79.6%。MoE 架构使大模型在消费级硬件上高效运行。 现象/趋势 端侧 编码 推荐理由: 本地模型在编码上正逼近云端前沿,Qwen 35B-A3B 已成社区标配,免费且完全离线让这场替代变得真实,选型逻辑可能从此改变。
现象/趋势
端侧
编码
AI HOT
·
2026-06-18 01:07
11:56 Hacker News 热门(buzzing.cc 中文翻译) 精选 76 在 Mathematica 诞生近 38 年后,Wolfram 语言与 Mathematica 发布 Version 15。每个笔记本内置 AI 助手,支持从 AI 环境中直接调用 Wolfram 技术。新增符号音乐系统、大规模时间序列与事件序列处理、分类数据计算、模型拟合超函数 ModelFit。笔记本支持千兆字节级大小与实时查找,首次引入侧边栏、视觉主题及弃用功能样式。强化了表格连接、多点可视化、图形刻度绘制与轨道运行计算等功能。DSolve 拐角处获得 AI 方法辅助,支持偏微分方程曲线坐标求解。扩充了矩阵分解、多元 zeta 函数与调和数、流线型部分分式分解。强化了 WebSocket 实时连接、Python 交互改进,支持 CUDA 内核作为外部函数,Wolfram Compute Services 新增 GPU 支持。 产品更新 多模态 数据/训练 推荐理由: Wolfram Language 15 把 AI 助手直接内嵌进笔记本,加上符号音乐和 ModelFit 超级函数,对用代码思考的人来说,这是今年最扎实的版本升级。
产品更新
多模态
数据/训练
AI HOT
·
2026-06-18 01:07
12:05 xAI:News(网页) 精选 73 xAI 将 Grok Imagine Video 1.5 从预览转为全面可用,在 Imagine API 上提供 `grok-imagine-video-1.5`,并在 grok.com/imagine 及 iOS/Android 应用上推出 Video 1.5 Fast 版。相比前代,模型在音频与语音(更清晰、嘴型同步更好)、运动与物理(更连贯、重量感更真实)、生成速度(6 秒 720p 视频约 25 秒,此前超 40 秒)上全面提升。同时逐步推出 Projects、Multiple agents(并行运行多个生成任务)、Search 等新功能,以优化创作流程。 xAI 多模态 模型发布 视频 关联讨论 1 条 X:阿易 AI Notes (@AYi_AInotes) 推荐理由: Grok Imagine 1.5 把视频生成速度砍半,音效同步和项目功能让创作者工作流更顺畅,xAI 在视频方向上站住了脚。
xAI
多模态
模型发布
视频
AI HOT
·
2026-06-18 00:00
07:26 Hacker News 热门(buzzing.cc 中文翻译) 精选 71 2026年Q1美国成人非虚构书籍销量同比下降9%,自助类下跌26.3%,仅手工艺/爱好/古董/游戏和宗教两个子类别增长。一位出版了多本《纽约时报》畅销书的作者透露,其五本书的印刷版年销量从2022年基准连续下滑:2023年-5%,2024年-13%,2025年-46%,2026年年化跌幅达-57% vs 2025年;若持续,2026年销量将比2022年减少约80%。所有格式在2025年下半年环比上半年下降约45%。作者认为,Claude、ChatGPT等大语言模型能提供更快、更便宜、更个性化的建议,正在系统性取代自助类书籍的“指令传递”价值。头部自助类品牌同期销量也下滑约40–60%,唯一显著变化是AI加速普及。作者判断整个指令传递型内容(包括YouTube教程、播客、在线课程、newsletter)都将面临替代。 现象/趋势 行业动态 推荐理由: Tim Ferriss 以自身书籍销量暴跌 57% 的真实数据,展示了 AI 对非虚构内容产业的致命冲击,并给出了‘与其追求百万粉不如深耕千真粉’的转型思路。
现象/趋势
行业动态
AI HOT
·
2026-06-18 00:00
08:27 宝玉 @ dotey 精选 75 baoyu-design(本地运行 Claude Design 的 Skill)新增动画视频导出功能。其声明式动画引擎基于 f(t) 设计:任意时间点 t 可绝对确定画面状态。导出采用无头 Chromium 逐帧截图 + ffmpeg 编码,每帧等待两帧 requestAnimationFrame 确保渲染完成。截图以 2 倍 DPR(3840×2160)再缩回 1080p,保证细节清晰。95 秒 30fps 动画需 2850 次截图循环,帧帧精确。项目已开源(MIT),获 1.2K star。此前 baoyu-design 已支持 PPT 本地生成和导出可编辑 PPTX。 宝玉 : baoyu-design skill(让你本地运行 Claude Design 的 Skill)更新,本地生成 PPT 的效果,可以借助 Cursor、Codex 内置的浏览器预览 PPT,也可以直接用它们的标记工具修改 PPT 细节。按 ... GitHub 多模态 开源/仓库 视频 推荐理由: 宝玉把 Claude Design 动画导出能力做成了本地 skill,原理讲得很透,声明式引擎加 f(t) 直接抽帧的思路让开发者能零成本复现,想要高质量 AI 动画输出的创作者可以立即用起来。
GitHub
多模态
开源/仓库
视频
AI HOT
·
2026-06-18 00:00
11:03 IT之家(RSS) 精选 72 中国正加紧筹建世界人工智能合作组织,欢迎各方加入。2025年7月26日,中国政府倡议成立该组织,作为践行多边主义、推动共商共建共享全球治理的举措,旨在弥合数字和智能鸿沟、促进人工智能向善普惠发展。初步考虑总部设在上海。同日,2025世界人工智能大会发表《人工智能全球治理行动计划》,呼吁各方遵循向善为民、尊重主权、发展导向、安全可控、公平普惠、开放合作的原则,协力推进全球人工智能发展与治理。 政策/监管 推荐理由: 中国推动的世界人工智能合作组织进入筹建,总部定在上海,标志着多边AI治理从口号走向实体,虽然细节尚早,但这是未来几年监管框架的底层变数。
政策/监管
AI HOT
·
2026-06-17 23:36
06:56 TechCrunch:AI(RSS) 精选 73 Anthropic 5月企业AI订阅市场份额达41%,首次超越OpenAI(39.5%)。公司刚完成650亿美元融资、估值9650亿美元,并因首次盈利季度秘密提交IPO。特朗普政府以出口管制为由要求Anthropic禁止非美国人访问最新模型Mythos 5及Fable 5,导致两款模型下架。Ramp首席经济学家指出,类似争议(如3月被国防部列为供应链风险)反而推动Anthropic企业采用量创纪录。Ramp数据显示,企业支出主要流向Claude Opus模型(最新为Opus 4.8)。 Anthropic OpenAI 安全/对齐 行业动态 推荐理由: Anthropic 市场份额首超 OpenAI,却被白宫要求撤下最新模型。Ramp 数据表明,这种「被点名过于危险」的禁令可能反过来强化其商业吸引力,值得每一个关注 AI 走向的人点开看。
Anthropic
OpenAI
安全/对齐
行业动态
AI HOT
·
2026-06-17 23:36
07:07 OpenRouter:Announcements(RSS) 精选 67 OpenRouter 推出 openrouter:subagent 服务器工具,允许前沿模型在生成过程中将独立的琐碎任务(如文档总结、结构化数据提取、文本重格式化)委托给更小、更便宜、更快的 worker 模型执行,从而节省前沿模型的 token 消耗。 智能体 MCP/工具 产品更新 推荐理由: 这是 OpenRouter 对 agent 交互模式的一个小但实用的创新,让主模型自动将摘要、格式化等确定性子任务分派给更便宜的小模型,做多模型编排的开发者可以直接拿来用。
智能体
MCP/工具
产品更新
AI HOT
·
2026-06-17 22:28
06:13 Midjourney:Updates(RSS) 精选 66 Midjourney V8.1 的 Draft mode 草稿模式每次生成24张低分辨率低质量图片。用户可对任意图片点击 "Vary",将其渲染为全质量、全分辨率版本。草稿任务消耗的快速小时数减半。 产品更新 图像生成 推荐理由: 这是我最近看到最实用的 Midjourney 更新,草稿模式半价生成 24 张低质量图,快速筛选后再渲染,直接降低试错成本。
产品更新
图像生成
AI HOT
·
2026-06-17 21:19
06:04 Gary Marcus:The Road to AI We Can Trust(RSS) 精选 62 评论认为 OpenAI 正面临多重危机:缺乏护城河导致市场领先地位下滑;最大投资者微软持续疏远,近期甚至公开考虑将主要产品外包给中国;亏损速度远超预期,年亏损额以 8 倍增长。华盛顿方面可能打压 Anthropic,但也可能反而帮助其崛起,而 Elon Musk 成为另一个潜在的竞标者。 Microsoft OpenAI 大佬观点 关联讨论 3 条 Hacker News 热门(buzzing.cc 中文翻译) The Decoder:AI News(RSS) Ars Technica:AI(RSS) 推荐理由: Gary Marcus 这次拿出了市场份额和微软疏远的证据,比以往的情绪化唱衰更有说服力。如果你还相信 OpenAI 的地位不可动摇,这篇值得一看。
Microsoft
OpenAI
大佬观点
AI HOT
·
2026-06-17 20:16
03:52 OpenAI:Alignment 研究博客(RSS) 精选 73 OpenAI利用WildChat公开数据集(2023年4月至2024年5月收集的100万条对话)模拟模型部署,预测GPT-5.1、GPT-5.2、GPT-5.4在真实生产环境中的不良行为率。与私有生产数据对比发现,WildChat模拟的平均预测误差约3倍;但对技术性和智能体型失调的预测精度下降。研究验证了公开数据集作为外部审计工具的可行性。 OpenAI 安全/对齐 论文/研究 推荐理由: 用公开旧聊天数据预测模型真实失败率,误差居然在 3 倍以内,做外部审计的可以认真看看。不过 agentic 场景明显不行,需要新数据集。
OpenAI
安全/对齐
论文/研究
AI HOT
·
2026-06-17 18:00
03:35 Anthropic:Research(发表成果 · 网页) 精选 76 Anthropic 基于约40万次 Claude Code 交互会话(2025年10月至2026年4月)分析发现:人类主导规划决策(做什么),Claude 主导执行决策(怎么做)。领域专业知识越强,模型每次指令完成的工作量越多。各类职业完成任务的成功率与软件工程师平均相近;领域专家成功率更高,但与中级用户差距不大。七个月间调试会话占比下降近一半,使用转向端到端智能体任务(部署运行代码、分析数据、编写非代码文档),典型任务价值平均上升约25%。 智能体 Anthropic 编码 论文/研究 推荐理由: 这份报告用40万次真实会话数据揭示了一个反直觉发现,决定Agent编码成败的,不是会不会写代码,而是对自己领域问题的理解深度。对非技术背景用AI编程的人和产品经理都是重要信号。
智能体
Anthropic
编码
论文/研究
AI HOT
·
2026-06-17 17:31
03:25 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 74 OpenAI 近日发布 Deployment Simulation 方法,通过在隐私保护下重放历史对话、用新候选模型重新生成回复,模拟模型上线后的实际表现。在多个 GPT‑5‑series Thinking 部署中,该方法比传统评估更准确地估计了不良行为频率,发现新型对齐问题,并降低模型识别测试的风险。它还能扩展至涉及工具使用的智能体场景。传统评估存在覆盖不足、选择偏差和模型可识别测试等局限,而 Deployment Simulation 使用真实对话分布缓解了这些问题,但无法测量频率低于每 20 万条消息 1 次的行为。 OpenAI 安全/对齐 论文/研究 关联讨论 1 条 MarkTechPost(RSS) 推荐理由: 虽然只是安全评估方法,但OpenAI用130万真实对话验证,把预部署风险预测误差压到1.5倍,这套方法很可能成为未来模型发布前的标准动作。
OpenAI
安全/对齐
论文/研究