AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

SenseNova-U1全训练代码开源,支持多模态多任务训练

22:58 SenseTime @ SenseTime_AI 精选 70 OpenSenseNova开源了SenseNova-U1的完整训练代码库,支持其8B密集模型与A3B MoE架构。该代码库使用一个统一的框架,可同时训练多种多模态任务,包括文本到图像生成、图像编辑、交错生成及文本与视觉理解。工程上为大规模训练设计,支持混合并行、流式可恢复数据管线、环境变量驱动配置以及从1×8 GPUs到多节点集群的扩展能力。代码已在GitHub开源,采用Apache-2.0协议。 图像生成 多模态 开源/仓库 开源生态 关联讨论 1 条 X:商汤 SenseTime (@SenseTime_AI) 推荐理由: 商汤这次直接把多模态训练的全栈代码开源了,Apache-2.0 协议,从文生图到视觉理解一个栈搞定,做多模态研究的可以直接拿去改,诚意挺足。

图像生成 多模态 开源/仓库 开源生态
AI HOT ·

100万上下文窗口。更智能的推理。更多可能性。很高兴看到 Qwen3.7 Max 现已通过 @opencode 支持 Go 语言调用 🚀

14:03 Alibaba Cloud @ alibaba_cloud 精选 78 OpenCode : Qwen3.7 Max now available in Go - text only - 1M context - smartest model in the Qwen family to date 推理 模型发布 推荐理由: Qwen3.7 Max把上下文拉到1M,推理能力也号称迄今最强,对需要处理超长文档的开发者来说是个真家伙,虽然不是多模态,但在文本任务上值得一试。 14:03 Alibaba Cloud @ alibaba_cloud 精选 64 阿里云在Omdia的智能体AI市场雷达中被评为领导者。Omdia强调了阿里云在每一层的全栈能力,认可其是首个将整个平台围绕智能体范式进行构建的云服务商。 智能体 行业动态 推荐理由: 阿里云被 Omdia 评为 Agentic AI 领导者,不是自说自话的 PR,而且点出它是第一家把全平台转向 Agent 范式的云厂商,对做企业 AI 落地的团队是个需要留意的信号。 11:19 HuggingFace Daily Papers(社区热门论文) 精选 70 MiniMax-M2系列:微小激活释放最大真实世界智能 MiniMax推出M2系列大语言模型。其旗舰模型M2采用混合专家(MoE)架构,总参数229.9B,每个token仅激活9.8B参数。该系列专为智能体部署设计,基于三大组件构建:智能体驱动的数据管道、可扩展的智能体原生强化学习系统Forge,以及展示早期自我进化能力的M2.7检查点。这种设计使其在智能体编码、深度搜索、办公任务及推理基准测试中达到了前沿性能水平。 智能体 推理 模型发布 推荐理由: MiniMax 把激活参数压到 9.8B 却敢喊前沿,整套 design 都是为 agent 场景重做的,搞 agent 的开发者该认真看一眼这个信号。 11:13 IT之家(RSS) 精选 78 我国将加快研究推进人工智能健康发展综合性立法、低空经济立法等 政策/监管 行业动态 推荐理由: 国内AI综合性立法首次摆上国务院日程,不再是散装监管,所有做AI的公司都得盯着这个信号。 10:02 Alibaba Cloud @ alibaba_cloud 精选 63 阿里云宣布以白金会员身份加入PyTorch基金会。作为AI基础设施全球领导者,阿里云是开源模型家族Qwen的缔造方,已在多样化硬件上大规模运行PyTorch,将为社区带来生产级工程经验。 PyTorch : We're excited to welcome @alibaba_cloud as a Platinum Member of the PyTorch Foundation 🎉 Alibaba Cloud is a global lea

推理 模型发布 智能体 行业动态 政策/监管 开源生态 Anthropic 产品更新 编码 部署/工程 MCP/工具 安全/对齐 Google 教程/实践 视频 大佬观点 现象/趋势 数据/训练 OpenAI
AI HOT ·

Project Luxo:跨越AI媒体的恐怖谷

22:34 Runway:News(网页) 精选 74 Runway通过Project Luxo研究发现,AI生成视频已跨越“恐怖谷”。他们向创意生态从业者展示了《The Rogue》等AI短片及广告样片,评估显示观众开始关注故事本身,而非技术瑕疵。所有作品均由单人团队制作,耗时从3周到4小时不等。Runway认为,这标志着AI媒体成熟——当技术足够好以至于“隐形”,观众沉浸于故事时,便实现了这一跨越。 多模态 现象/趋势 视频 关联讨论 1 条 X:Runway (@runwayml) 推荐理由: Runway放出三部AI短片和一份93%好评的观众调研,正式宣告AI视频跨过恐怖谷。片子质量加上单人几小时出片的效率,让“技术隐身于故事”变得很具体。

多模态 现象/趋势 视频
AI HOT ·

AI能否理解人类价值观的现实复杂性?微软亚洲研究院的全新全球AI价值观挑战赛,诚邀哲学、伦理、法学和社会科学领域的研究人员共同探索。立即注册:https://msft.it/6012vk8OO

22:10 Microsoft Research @ MSFTResearch 精选 62 Microsoft 安全/对齐 行业动态 推荐理由: 微软发起跨学科价值观挑战,把哲学、法律和社科拉到 AI 对齐战场,这对关心安全的人是个值得跟进的信号,但普通开发者目前还用不上。

Microsoft 安全/对齐 行业动态
AI HOT ·

SynthID已为超过1000亿条内容添加水印,但透明度需要行业协作。 因此,我们正与OpenAI、ElevenLabs和Kakao合作,将SynthID水印技术集成到他们的模型中--这延续了我们与NVIDIA共同推动的全行业趋势。

19:57 Google DeepMind @ GoogleDeepMind 精选 71 Google OpenAI 安全/对齐 行业动态 推荐理由: SynthID 水印覆盖百亿内容后又拉上 OpenAI 和 ElevenLabs,从谷歌独门暗器变成行业标配,AI 生成内容溯源终于不是各说各话,做合规的可以盯着后续集成节奏。

Google OpenAI 安全/对齐 行业动态
AI HOT ·

Sundar Pichai 谈 AI、搜索的未来及网络的变化

22:06 The Verge:AI(RSS) 精选 84 Google 与 Alphabet CEO Sundar Pichai 在 Google I/O 后受访,回顾了公司为应对 ChatGPT 而进行的战略重组与高管调整。访谈聚焦于新的 Gemini 模型及其在产品中的整合,包括全新的智能搜索框与 Gemini Spark 智能体平台,旨在让搜索从提供结果转向启动任务。Pichai 讨论了这些变化对开放网络的持续冲击,回应了主持人此前提出的“Google Zero”概念(即来自 Google 的网站流量可能归零),并提及 Google 正利用 YouTube 视频训练模型以改变视频搜索与索引方式。最后,他对 Google DeepMind CEO Demis Hassabis 关于“处于智能奇点起步阶段”的言论表示认同,并分享了对 AGI 时间线的看法。 Google 大佬观点 搜索 推荐理由: Sundar Pichai 年度对话,从搜索改版聊到 AGI 时间线,坦诚得不像公关话术。做搜索、做内容的人都该看,他亲口说那个「best Chromebook」的结果可能太主观了。

Google 大佬观点 搜索
AI HOT ·

在 #QwenConference2026 上,阿里云CTO、国际业务总裁李飞飞博士阐述了我们从云原生到智能体原生的转变。为了普及AI,我们构建了四大基石:模型、智能体云、工具与服务,以及规模。 👉 敬请关注:https://click.qwencloud.com/m/20000000187/

15:30 Alibaba Cloud @ alibaba_cloud 精选 64 智能体 行业动态 推荐理由: 国内最大云厂商正式喊出从云原生转Agent原生,但现阶段还是框架,真正能让开发者用起来要看后续的模型和工具链实际开放到什么程度。

智能体 行业动态
AI HOT ·

四个月花光全年 AI 预算,Uber 总裁质疑 AI 投入合理性

18:13 IT之家(RSS) 精选 73 现象/趋势 行业动态 推荐理由: Uber 四个月烧光全年 AI 预算,然后公开质疑 token 增长与产品价值不挂钩,这是大公司对 AI 投入性价比的首次公开反思,做企业 AI 应用的值得一字不落地看完。

现象/趋势 行业动态
AI HOT ·

Qwen3.7-Max 正式成为全球第二大 AI 编程模型。在 Code Arena 上得分 1541,仅次于 Claude。专为生产环境打造:可运行 35 小时任务、1000+ 次工具调用,并在数小时内交付两周的项目。

14:59 Alibaba Cloud @ alibaba_cloud 精选 68 推理 模型发布 编码 关联讨论 1 条 X:opencode (@opencode) 推荐理由: Qwen3.7-Max 跑进编码模型全球第二,亮点不在排名而在能扛 35 小时任务和千次工具调用,做复杂 agent 的人应该认真试试。

推理 模型发布 编码
AI HOT ·

面壁智能开源 MiniCPM5-1B:在 AA-Index 上超越所有 2B 参数以下模型,能跑在手机、浏览器上

14:11 IT之家(RSS) 精选 76 面壁智能开源其新一代端侧大语言模型MiniCPM5-1B。该模型仅1B参数,在AA-Index榜单上超越所有2B参数以下模型,相比3个月前的Qwen3.5-2B效果更优且参数量减半。经INT4量化后权重仅0.5GB,支持在手机和浏览器上运行。其Base Model版本由面壁智能自主研发的AI训练框架ForgeTrain预训练完成,现已全面开源模型权重、训练数据集与部署方案。 开源生态 模型发布 端侧 推荐理由: 1B参数干翻所有2B以下模型,量化后0.5GB就能塞进手机和浏览器,这个效率把端侧模型的门槛又压低了,做移动端AI的值得跟进。

开源生态 模型发布 端侧
AI HOT ·

通过奖励倾斜分布匹配强化少步生成器

14:18 HuggingFace Daily Papers(社区热门论文) 精选 74 本文提出奖励倾斜分布匹配蒸馏(RTDMD),这是一个将分布匹配蒸馏与奖励引导强化学习统一应用于少步流生成器的两阶段框架。该方法通过最小化到奖励倾斜教师分布的KL散度,自然分解为分布匹配项与奖励最大化项。第一阶段引入环境一致分布匹配蒸馏(AC-DMD),在子区间进行分布匹配,并通过一致性正则化辅助分数模型追踪生成器分布。第二阶段联合优化两项,并推导混合策略梯度及步子集GRPO(SubGRPO)以降低方差。在SD3、SD3.5和FLUX.2上的实验表明,RTDMD仅用4步推理即可在偏好、美学和组合指标上达到新的 state-of-the-art。 arXiv 图像生成 论文/研究 推荐理由: 这篇直接把分布匹配蒸馏和奖励建模拧在一起,在 SD3/3.5/FLUX.2 上用 4 步推理就压了之前所有文生图对齐方法,做图像生成训练和偏好对齐的该看。

arXiv 图像生成 论文/研究
AI HOT ·

Jon Erwin - Wonder Project创始人兼首席创意官,Innovative Dreams首席执行官,亚马逊Prime热门剧集《大卫之家》创作者: "Kling AI是《大卫之家》第一季和第二季背后的核心力量。最让我兴奋的是它实现了多项行业首创:在完成的剧集中首次使用AI生成场景,首个原生4K模型。其运动控制功能也使我们能够在AI生成中保留演员真实的情感和感受。"

12:09 Kling AI @ Kling_ai 精选 61 产品更新 视频 推荐理由: 可灵AI这次不是demo,是实打实用在爆款剧集里的主力工具,原生4K和行业首次AI场景,视频生成赛道终于跑通商业闭环了。

产品更新 视频
AI HOT ·

谷歌 AI 框架 AlphaProof Nexus 攻克 2 道悬置 56 年数学难题

13:11 IT之家(RSS) 精选 77 智能体 DeepMind 开源生态 推理 推荐理由: AlphaProof Nexus 不是刷榜,是真解了 Erdős 难题,56 年悬而未决的那两道——这说明 AI 开始从具身数学题爬向纯数学研究了,做理论的人该认真看一眼。

智能体 DeepMind 开源生态 推理
AI HOT ·

"龙虾之父"Peter 开源 skill-cleaner,为 AI 智能体技能"做体检"

14:11 IT之家(RSS) 精选 77 “龙虾之父”Peter 开源了 skill-cleaner 工具,用于诊断和优化 AI 智能体的技能提示词。该工具包含5项核心功能,包括技能提示词预算审计、重复技能检测、未使用技能筛查、技能根目录审计和描述精简优化。其脚本采用标准 token 预算核算逻辑,旨在帮助减少冗长描述对 token 预算和上下文窗口的占用。已有用户实践显示,将技能描述从90多词精简至40词以内,能提升智能体选择技能的准确率。 智能体 GitHub MCP/工具 开源/仓库 推荐理由: Peter 直接开源了一个给 Skill '减肥' 的工具,把描述精简、重复检测、预算审计全自动化了,装完跑一遍就能直观看到哪些 Skill 在烧你的 token。做 Agent 的可以立刻装上试试。

智能体 GitHub MCP/工具 开源/仓库
AI HOT ·

腾讯混元新翻译模型双榜亮眼,小程序发布

10:59 Tencent Hy @ TencentHunyuan 精选 69 腾讯混元发布翻译模型 Hy-MT2,在 Hugging Face 开源模型趋势排行榜上表现突出:1.8B 版本排名第一,30B-A3B(MoE)版本排名第四,下载量已超 7K。官方同步推出了基于该模型的“腾讯混译”微信小程序,支持语音输入与离线翻译,并可自定义翻译风格与指令。模型代码与权重已开源。 Hugging Face 开源生态 模型发布 关联讨论 1 条 X:腾讯混元 (@TencentHunyuan) 推荐理由: 腾讯混元开源翻译模型在HuggingFace趋势榜冲上第一,这不算大新闻,但搭配微信小程序直接落地,让翻译体验可定制,对做国际化产品和内容出海的团队算是个实用的新选择。

Hugging Face 开源生态 模型发布
AI HOT ·

微软 Copilot Cowork 存在文件泄露问题

07:58 Hacker News 热门(buzzing.cc 中文翻译) 精选 82 Microsoft 安全/对齐 推荐理由: PromptArmor这次披露不是简单的bug,而是Copilot Cowork在文件协作中悄无声息地外泄敏感文件,企业用户现在就得检查一下有没有被这坑到。

Microsoft 安全/对齐
AI HOT ·

OpenAI GPT-5.6 模型曝下月发布:AI 上下文 150 万 tokens

07:11 IT之家(RSS) 精选 74 多名开发者在 OpenAI Codex 后端日志中发现未官宣的 GPT-5.6 模型,内部代号 iris-alpha。该模型将支持 150 万 token 的上下文窗口,较当前 GPT-5.5 的 105 万 token 提升约 43%,有望于今年 6 月发布。测试显示,在输入达到 90 万 token 时仍能流畅响应。同系列还发现了 ember-alpha 与 beacon-alpha 版本。此外,GPT-5.6 在前端界面生成能力上也有所提升。基于爆料信息,Anthropic Claude、Google Gemini 及 xAI Grok 也可能瞄准同期发布新模型。 OpenAI 模型发布 编码 推荐理由: 开发者从后端日志扒出 GPT-5.6,150 万上下文是真香,直接生成商用级前端界面更让人眼馋,这代模型值得等。

OpenAI 模型发布 编码
AI HOT ·

苹果据称正使用定制版1.2T参数Google模型重塑下一代Siri

03:58 Chubby♨️ @ kimmonismus 精选 79 据报道,苹果为改造下一代Siri,正使用一个定制版、参数规模达1.2T的Google大模型作为其核心,这显著大于预估约300B参数的Gemini 3.5 Flash。该模型将驱动Siri的部分功能,其中简单查询预期会在本地设备运行。苹果面临的关键挑战是确保该大模型能够足够快速地响应日常问题。此外,下个月AI领域预计将有多项重要发布,包括WWDC上的Apple Intelligence与Gemini整合、GPT-5.6、可能的Sonnet 4.8/Opus 4.8,以及已确认的Gemini 3.5 Pro。 Google 端侧 行业动态 推荐理由: Apple 把 1.2T 参数的定制 Gemini 塞进 Siri,简单查询还打算跑本地,这比单纯集成 Gemini 激进得多,WWDC 见真章。

Google 端侧 行业动态