AI HOT
·
2026-05-27 15:14
22:58 SenseTime @ SenseTime_AI 精选 70 OpenSenseNova开源了SenseNova-U1的完整训练代码库,支持其8B密集模型与A3B MoE架构。该代码库使用一个统一的框架,可同时训练多种多模态任务,包括文本到图像生成、图像编辑、交错生成及文本与视觉理解。工程上为大规模训练设计,支持混合并行、流式可恢复数据管线、环境变量驱动配置以及从1×8 GPUs到多节点集群的扩展能力。代码已在GitHub开源,采用Apache-2.0协议。 图像生成 多模态 开源/仓库 开源生态 关联讨论 1 条 X:商汤 SenseTime (@SenseTime_AI) 推荐理由: 商汤这次直接把多模态训练的全栈代码开源了,Apache-2.0 协议,从文生图到视觉理解一个栈搞定,做多模态研究的可以直接拿去改,诚意挺足。
图像生成
多模态
开源/仓库
开源生态
AI HOT
·
2026-05-27 14:08
14:03 Alibaba Cloud @ alibaba_cloud 精选 78 OpenCode : Qwen3.7 Max now available in Go - text only - 1M context - smartest model in the Qwen family to date 推理 模型发布 推荐理由: Qwen3.7 Max把上下文拉到1M,推理能力也号称迄今最强,对需要处理超长文档的开发者来说是个真家伙,虽然不是多模态,但在文本任务上值得一试。 14:03 Alibaba Cloud @ alibaba_cloud 精选 64 阿里云在Omdia的智能体AI市场雷达中被评为领导者。Omdia强调了阿里云在每一层的全栈能力,认可其是首个将整个平台围绕智能体范式进行构建的云服务商。 智能体 行业动态 推荐理由: 阿里云被 Omdia 评为 Agentic AI 领导者,不是自说自话的 PR,而且点出它是第一家把全平台转向 Agent 范式的云厂商,对做企业 AI 落地的团队是个需要留意的信号。 11:19 HuggingFace Daily Papers(社区热门论文) 精选 70 MiniMax-M2系列:微小激活释放最大真实世界智能 MiniMax推出M2系列大语言模型。其旗舰模型M2采用混合专家(MoE)架构,总参数229.9B,每个token仅激活9.8B参数。该系列专为智能体部署设计,基于三大组件构建:智能体驱动的数据管道、可扩展的智能体原生强化学习系统Forge,以及展示早期自我进化能力的M2.7检查点。这种设计使其在智能体编码、深度搜索、办公任务及推理基准测试中达到了前沿性能水平。 智能体 推理 模型发布 推荐理由: MiniMax 把激活参数压到 9.8B 却敢喊前沿,整套 design 都是为 agent 场景重做的,搞 agent 的开发者该认真看一眼这个信号。 11:13 IT之家(RSS) 精选 78 我国将加快研究推进人工智能健康发展综合性立法、低空经济立法等 政策/监管 行业动态 推荐理由: 国内AI综合性立法首次摆上国务院日程,不再是散装监管,所有做AI的公司都得盯着这个信号。 10:02 Alibaba Cloud @ alibaba_cloud 精选 63 阿里云宣布以白金会员身份加入PyTorch基金会。作为AI基础设施全球领导者,阿里云是开源模型家族Qwen的缔造方,已在多样化硬件上大规模运行PyTorch,将为社区带来生产级工程经验。 PyTorch : We're excited to welcome @alibaba_cloud as a Platinum Member of the PyTorch Foundation 🎉 Alibaba Cloud is a global lea
推理
模型发布
智能体
行业动态
政策/监管
开源生态
Anthropic
产品更新
编码
部署/工程
MCP/工具
安全/对齐
Google
教程/实践
视频
大佬观点
现象/趋势
数据/训练
OpenAI
AI HOT
·
2026-05-27 13:04
22:34 Runway:News(网页) 精选 74 Runway通过Project Luxo研究发现,AI生成视频已跨越“恐怖谷”。他们向创意生态从业者展示了《The Rogue》等AI短片及广告样片,评估显示观众开始关注故事本身,而非技术瑕疵。所有作品均由单人团队制作,耗时从3周到4小时不等。Runway认为,这标志着AI媒体成熟——当技术足够好以至于“隐形”,观众沉浸于故事时,便实现了这一跨越。 多模态 现象/趋势 视频 关联讨论 1 条 X:Runway (@runwayml) 推荐理由: Runway放出三部AI短片和一份93%好评的观众调研,正式宣告AI视频跨过恐怖谷。片子质量加上单人几小时出片的效率,让“技术隐身于故事”变得很具体。
多模态
现象/趋势
视频
AI HOT
·
2026-05-27 10:29
22:10 Microsoft Research @ MSFTResearch 精选 62 Microsoft 安全/对齐 行业动态 推荐理由: 微软发起跨学科价值观挑战,把哲学、法律和社科拉到 AI 对齐战场,这对关心安全的人是个值得跟进的信号,但普通开发者目前还用不上。
Microsoft
安全/对齐
行业动态
AI HOT
·
2026-05-27 10:29
22:18 OpenRouter @ OpenRouter 精选 69 行业动态 部署/工程 推荐理由: AI路由的头部玩家拿到1.13亿美金,每周调用量从5T涨到25T,这不是PR数字,是AI从实验走向生产的真信号。
行业动态
部署/工程
AI HOT
·
2026-05-27 09:22
19:57 Google DeepMind @ GoogleDeepMind 精选 71 Google OpenAI 安全/对齐 行业动态 推荐理由: SynthID 水印覆盖百亿内容后又拉上 OpenAI 和 ElevenLabs,从谷歌独门暗器变成行业标配,AI 生成内容溯源终于不是各说各话,做合规的可以盯着后续集成节奏。
Google
OpenAI
安全/对齐
行业动态
AI HOT
·
2026-05-27 09:22
22:06 The Verge:AI(RSS) 精选 84 Google 与 Alphabet CEO Sundar Pichai 在 Google I/O 后受访,回顾了公司为应对 ChatGPT 而进行的战略重组与高管调整。访谈聚焦于新的 Gemini 模型及其在产品中的整合,包括全新的智能搜索框与 Gemini Spark 智能体平台,旨在让搜索从提供结果转向启动任务。Pichai 讨论了这些变化对开放网络的持续冲击,回应了主持人此前提出的“Google Zero”概念(即来自 Google 的网站流量可能归零),并提及 Google 正利用 YouTube 视频训练模型以改变视频搜索与索引方式。最后,他对 Google DeepMind CEO Demis Hassabis 关于“处于智能奇点起步阶段”的言论表示认同,并分享了对 AGI 时间线的看法。 Google 大佬观点 搜索 推荐理由: Sundar Pichai 年度对话,从搜索改版聊到 AGI 时间线,坦诚得不像公关话术。做搜索、做内容的人都该看,他亲口说那个「best Chromebook」的结果可能太主观了。
Google
大佬观点
搜索
AI HOT
·
2026-05-27 08:13
15:30 Alibaba Cloud @ alibaba_cloud 精选 64 智能体 行业动态 推荐理由: 国内最大云厂商正式喊出从云原生转Agent原生,但现阶段还是框架,真正能让开发者用起来要看后续的模型和工具链实际开放到什么程度。
智能体
行业动态
AI HOT
·
2026-05-27 08:13
18:13 IT之家(RSS) 精选 73 现象/趋势 行业动态 推荐理由: Uber 四个月烧光全年 AI 预算,然后公开质疑 token 增长与产品价值不挂钩,这是大公司对 AI 投入性价比的首次公开反思,做企业 AI 应用的值得一字不落地看完。
现象/趋势
行业动态
AI HOT
·
2026-05-27 07:06
14:59 Alibaba Cloud @ alibaba_cloud 精选 68 推理 模型发布 编码 关联讨论 1 条 X:opencode (@opencode) 推荐理由: Qwen3.7-Max 跑进编码模型全球第二,亮点不在排名而在能扛 35 小时任务和千次工具调用,做复杂 agent 的人应该认真试试。
推理
模型发布
编码
AI HOT
·
2026-05-27 04:40
14:11 IT之家(RSS) 精选 76 面壁智能开源其新一代端侧大语言模型MiniCPM5-1B。该模型仅1B参数,在AA-Index榜单上超越所有2B参数以下模型,相比3个月前的Qwen3.5-2B效果更优且参数量减半。经INT4量化后权重仅0.5GB,支持在手机和浏览器上运行。其Base Model版本由面壁智能自主研发的AI训练框架ForgeTrain预训练完成,现已全面开源模型权重、训练数据集与部署方案。 开源生态 模型发布 端侧 推荐理由: 1B参数干翻所有2B以下模型,量化后0.5GB就能塞进手机和浏览器,这个效率把端侧模型的门槛又压低了,做移动端AI的值得跟进。
开源生态
模型发布
端侧
AI HOT
·
2026-05-27 04:40
14:18 HuggingFace Daily Papers(社区热门论文) 精选 74 本文提出奖励倾斜分布匹配蒸馏(RTDMD),这是一个将分布匹配蒸馏与奖励引导强化学习统一应用于少步流生成器的两阶段框架。该方法通过最小化到奖励倾斜教师分布的KL散度,自然分解为分布匹配项与奖励最大化项。第一阶段引入环境一致分布匹配蒸馏(AC-DMD),在子区间进行分布匹配,并通过一致性正则化辅助分数模型追踪生成器分布。第二阶段联合优化两项,并推导混合策略梯度及步子集GRPO(SubGRPO)以降低方差。在SD3、SD3.5和FLUX.2上的实验表明,RTDMD仅用4步推理即可在偏好、美学和组合指标上达到新的 state-of-the-art。 arXiv 图像生成 论文/研究 推荐理由: 这篇直接把分布匹配蒸馏和奖励建模拧在一起,在 SD3/3.5/FLUX.2 上用 4 步推理就压了之前所有文生图对齐方法,做图像生成训练和偏好对齐的该看。
arXiv
图像生成
论文/研究
AI HOT
·
2026-05-27 03:33
12:09 Kling AI @ Kling_ai 精选 61 产品更新 视频 推荐理由: 可灵AI这次不是demo,是实打实用在爆款剧集里的主力工具,原生4K和行业首次AI场景,视频生成赛道终于跑通商业闭环了。
产品更新
视频
AI HOT
·
2026-05-27 03:33
13:11 IT之家(RSS) 精选 77 智能体 DeepMind 开源生态 推理 推荐理由: AlphaProof Nexus 不是刷榜,是真解了 Erdős 难题,56 年悬而未决的那两道——这说明 AI 开始从具身数学题爬向纯数学研究了,做理论的人该认真看一眼。
智能体
DeepMind
开源生态
推理
AI HOT
·
2026-05-27 03:33
14:11 IT之家(RSS) 精选 77 “龙虾之父”Peter 开源了 skill-cleaner 工具,用于诊断和优化 AI 智能体的技能提示词。该工具包含5项核心功能,包括技能提示词预算审计、重复技能检测、未使用技能筛查、技能根目录审计和描述精简优化。其脚本采用标准 token 预算核算逻辑,旨在帮助减少冗长描述对 token 预算和上下文窗口的占用。已有用户实践显示,将技能描述从90多词精简至40词以内,能提升智能体选择技能的准确率。 智能体 GitHub MCP/工具 开源/仓库 推荐理由: Peter 直接开源了一个给 Skill '减肥' 的工具,把描述精简、重复检测、预算审计全自动化了,装完跑一遍就能直观看到哪些 Skill 在烧你的 token。做 Agent 的可以立刻装上试试。
智能体
GitHub
MCP/工具
开源/仓库
AI HOT
·
2026-05-27 02:20
08:11 IT之家(RSS) 精选 70 Anthropic 安全/对齐 行业动态 推荐理由: AI找漏洞的能力让央行坐不住了,欧洲银行没权限用Mythos只能干着急,这事比模型发布本身更值得看,金融体系的安全时间线被压缩了。
Anthropic
安全/对齐
行业动态
AI HOT
·
2026-05-27 02:20
10:59 Tencent Hy @ TencentHunyuan 精选 69 腾讯混元发布翻译模型 Hy-MT2,在 Hugging Face 开源模型趋势排行榜上表现突出:1.8B 版本排名第一,30B-A3B(MoE)版本排名第四,下载量已超 7K。官方同步推出了基于该模型的“腾讯混译”微信小程序,支持语音输入与离线翻译,并可自定义翻译风格与指令。模型代码与权重已开源。 Hugging Face 开源生态 模型发布 关联讨论 1 条 X:腾讯混元 (@TencentHunyuan) 推荐理由: 腾讯混元开源翻译模型在HuggingFace趋势榜冲上第一,这不算大新闻,但搭配微信小程序直接落地,让翻译体验可定制,对做国际化产品和内容出海的团队算是个实用的新选择。
Hugging Face
开源生态
模型发布
AI HOT
·
2026-05-27 01:09
07:58 Hacker News 热门(buzzing.cc 中文翻译) 精选 82 Microsoft 安全/对齐 推荐理由: PromptArmor这次披露不是简单的bug,而是Copilot Cowork在文件协作中悄无声息地外泄敏感文件,企业用户现在就得检查一下有没有被这坑到。
Microsoft
安全/对齐
AI HOT
·
2026-05-27 00:00
07:11 IT之家(RSS) 精选 74 多名开发者在 OpenAI Codex 后端日志中发现未官宣的 GPT-5.6 模型,内部代号 iris-alpha。该模型将支持 150 万 token 的上下文窗口,较当前 GPT-5.5 的 105 万 token 提升约 43%,有望于今年 6 月发布。测试显示,在输入达到 90 万 token 时仍能流畅响应。同系列还发现了 ember-alpha 与 beacon-alpha 版本。此外,GPT-5.6 在前端界面生成能力上也有所提升。基于爆料信息,Anthropic Claude、Google Gemini 及 xAI Grok 也可能瞄准同期发布新模型。 OpenAI 模型发布 编码 推荐理由: 开发者从后端日志扒出 GPT-5.6,150 万上下文是真香,直接生成商用级前端界面更让人眼馋,这代模型值得等。
OpenAI
模型发布
编码
AI HOT
·
2026-05-26 23:47
03:58 Chubby♨️ @ kimmonismus 精选 79 据报道,苹果为改造下一代Siri,正使用一个定制版、参数规模达1.2T的Google大模型作为其核心,这显著大于预估约300B参数的Gemini 3.5 Flash。该模型将驱动Siri的部分功能,其中简单查询预期会在本地设备运行。苹果面临的关键挑战是确保该大模型能够足够快速地响应日常问题。此外,下个月AI领域预计将有多项重要发布,包括WWDC上的Apple Intelligence与Gemini整合、GPT-5.6、可能的Sonnet 4.8/Opus 4.8,以及已确认的Gemini 3.5 Pro。 Google 端侧 行业动态 推荐理由: Apple 把 1.2T 参数的定制 Gemini 塞进 Siri,简单查询还打算跑本地,这比单纯集成 Gemini 激进得多,WWDC 见真章。
Google
端侧
行业动态