AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

Qwen Conference 2026:主题演讲议程 AI原生云、Agent原生云架构、推理的未来,以及多模态视觉技术发布。没有冗余内容,只有面向全球规模的工程蓝图。 注册:https://click.qwencloud.com/m/20000000190/

18:33 Alibaba Cloud @ alibaba_cloud 精选 60 推理 行业动态 部署/工程 推荐理由: 阿里云把 Qwen 大会的关键词押在推理和多模态视觉上,声称全是工程蓝图没有废话,对关注 Qwen 生态的技术人来说,可能是今年最重要的日程预告。

推理 行业动态 部署/工程
AI HOT ·

将Agent转变为自主工作者!🚀 ❌ 开源痛点:可用性低、运维成本高、可观测性差。 ✅ MSE AI调度器通过以下方式解决: • 高可用分布式调度 • 统一管理与细粒度权限 • 弹性伸缩以降低成本 • 全链路可观测性 支持OpenClaw、Dify等。免费公测现已开放! 🔗 https://int.alibabacloud.com/m/1000413115/ #AI #Agent #MSE

18:33 Alibaba Cloud @ alibaba_cloud 精选 65 智能体 产品更新 部署/工程 推荐理由: 阿里云这个调度器直击开源 Agent 部署的三大痛点,免费公测对在用 Dify 或 OpenClaw 的团队是个低成本试水方案,虽然不算突破性创新但实用性够强。

智能体 产品更新 部署/工程
AI HOT ·

将你的想法转化为激发故事的视觉画面 🧨 【引用 @Adamaestr0_】:大多数AI工具可以写作或生成图像。 但这个能同时做这两件事。 向你介绍 SenseNova U1。 一个能同时思考文本和图像的AI。 这改变了一切 🧵

18:46 SenseTime @ SenseTime_AI 精选 68 Adam : La mayoría de las herramientas de IA pueden escribir o generar imágenes. Pero esta hace AMBAS cosas a la vez. Te present... 多模态 模型发布 推荐理由: 商汤发了 SenseNova U1,主打文本和图像同时生成的「全模态」,但宣传语太简略,没给任何性能数据或技术细节,暂时看不出是真突破还是常规迭代,先标记关注。

多模态 模型发布
AI HOT ·

开源油猴脚本实现小红书、抖音、微信公众号的截图粘贴自动上传,并支持YouTube字幕复制、倍速调节及内容导出至NotebookLM、ChatGPT等工具。主推文作者表示,该工具增强了将X平台内容同步至国内平台的意愿,尽管部分平台体验欠佳。

14:31 向阳乔木 @ vista8 精选 76 向阳乔木 : 完成了第一项工作,开源自己常用的油猴脚本。 1. 小红书、抖音、微信贴图,截图粘贴自动上传。 2. Youtube字幕复制,倍速调节,复制字幕给NotebookLM、ChatGPT处理。 3. 小宇宙网页版倍速调整 开源地址:https:/... GitHub 开源/仓库 开源生态 推荐理由: 向阳乔木开源了一套油猴脚本,让截图直接粘贴上传到小红书、抖音等平台,对多平台内容分发的人来说是一个小而实在的时间节省利器。

GitHub 开源/仓库 开源生态
AI HOT ·

欧盟委员会发布《欧盟人工智能法》高风险AI系统分类指导草案并开启公众咨询

15:55 DataGuidance:Artificial Intelligence(网页) 精选 77 欧盟委员会于2026年5月19日发布了关于《欧盟人工智能法》第六条项下高风险AI系统分类的指导草案。该草案旨在为AI系统的提供商、部署者及市场监管机构提供明确的分类标准,以确保在欧盟范围内执法的一致性。分类主要依据AI系统的预期用途,例如作为受监管产品的组件或用于特定高风险场景。草案也规定了部分豁免条件,例如仅执行辅助性任务时可能不被视为高风险。公众咨询期至206月23日。 安全/对齐 政策/监管 推荐理由: 欧盟AI法案开始动真格了,高风险分类指南草案直接决定哪些AI产品要套上重合规枷锁,做AI出海和2B的现在就该去读反馈问卷。

安全/对齐 政策/监管
AI HOT ·

这条推文展示了一个用于在PixVerse平台生成视频的复杂提示词。核心目标是制作一段在大型体育场内,五位朋友进行超真实智能手机自拍风格的视频。提示词的关键在于,它通过极其详细的设定来确保生成内容的连贯性和真实感:包括对五个角色外貌的严格一致性要求、具体的球场环境、模拟真实手机拍摄的镜头运动(如抖动、失焦)以及一系列自然的动作序列。

16:03 PixVerse @ PixVerse_ 精选 62 madpencil_ : It was fun trying to get this... ideating with AI and and crafting the prompt. Ref images + the Prompt. 🙌😅 { "title":"... 教程/实践 视频 推荐理由: PixVerse官方翻牌的这个足球自拍视频prompt,把角色一致性和手持摄像的真实感写到了极致,做AI视频的朋友可以直接抄作业。

教程/实践 视频
AI HOT ·

OpenAI宣布向Y Combinator当前批次的每家创业公司提供价值200万美元的API信用额度投资,以换取股权。此举旨在为初创公司提供AI算力资源,支持下一代创新。这让人联想到Sam Altman在YC合伙人时期,Yuri Milner向每家创业公司提供投资的先例。OpenAI希望通过此举释放创业者潜力,推动AI应用创新。

12:04 Greg Brockman @ gdb 精选 79 Tyler Bosmeny : A mic drop moment @ycombinator tonight @sama just offered $2M in OpenAI tokens to EVERY YC startup in the current batch ... OpenAI 行业动态 推荐理由: Sam Altman 在 YC 现场扔出王炸,用 200 万美元 API 积分投资每一个当期创业公司,这是 OpenAI 对开发者生态的激进押注,创业者的算力成本可能被彻底改写。

OpenAI 行业动态
AI HOT ·

GoLongRL:面向能力的长期上下文强化学习与多任务对齐

12:05 HuggingFace Daily Papers(社区热门论文) 精选 70 GoLongRL是一个全开源的长期上下文强化学习方案,聚焦于使用可验证奖励的强化学习。该工作提出了面向能力的数据构建方法,公开发布了包含23K样本的数据集、完整构建管线及训练代码。数据集依据长期上下文能力分类,涵盖9种任务类型,由真实文档生成的问答对构成;实验证明该数据集性能优于闭源的QwenLong-L1.5数据集。训练得到的Qwen3-30B-A3B模型在长期上下文任务上达到了与DeepSeek-R1-0528等先进模型可比的性能。此外,提出了TMN-Reweight多任务优化方法,通过任务级归一化和难度自适应加权,在提升平均性能的同时保持或增强了通用能力。 开源生态 推理 数据/训练 论文/研究 推荐理由: 开源长上下文RL的配方直接放出来了,数据集+代码全都有。更狠的是单靠数据多样性就干掉了闭源竞品,甚至摸到了DeepSeek-R1的水平,做长上下文的值得复现。

开源生态 推理 数据/训练 论文/研究
AI HOT ·

Kling AI推出全球首个原生4K视频生成模型

12:36 Kling AI @ Kling_ai 精选 72 4月23日,Kling AI正式推出全球首个原生4K视频生成模型,专为专业内容创作设计。该功能支持一键生成真4K画质视频,显著提升画面细节与制作效率。模型已获得好莱坞团队、动画工作室等多方采用。好莱坞制片人指出,这是其工作流中首个使用的原生4K基础模型;Wonder Studios强调,原生4K从底层生成避免了传统放大技术的角色变形问题,保持了画面一致性;动画导演则认为,该模型在保留艺术色调与复杂特效纹理方面优于同类产品。 多模态 模型发布 视频 推荐理由: 可灵AI的世界首个原生4K视频生成,直接跳过upscaler,从好莱坞剧组到广告公司已经在用。虽然还是早期阶段,但“原生4K”对影视制作的意义,就像当年1080p取代标清。

多模态 模型发布 视频
AI HOT ·

Qwen3.7:智能体前沿

10:49 Qwen:Blog Retrieval(API) 精选 79 Qwen Studio推出Qwen3.7模型,提供覆盖聊天机器人、图像与视频理解、图像生成、文档处理、网页搜索集成、工具调用及工件生成等功能。该模型整合了当前AI智能体的关键能力,旨在推动多模态交互与实际任务执行向更综合、自主的方向发展。 智能体 模型发布 关联讨论 3 条 X:阿里云 / Alibaba Cloud (@alibaba_cloud) Hacker News 热门(buzzing.cc 中文翻译) IT之家(RSS) 推荐理由: Qwen推出了新模型3.7,直指Agent能力前沿。虽然官方博客这次很简短,但按照Qwen一贯的节奏,工具调用和自主任务能力应该会刷新上限,做Agent的朋友可以关注后续实测。

智能体 模型发布
AI HOT ·

消息称微软内部示警:GitHub 面临生存级风险,AI 编程工具削弱托管必要性

10:55 IT之家(RSS) 精选 74 微软内部发出警告,称其代码托管平台GitHub正面临“生存级风险”。主要原因是Cursor、Claude Code等AI编程助手兴起,改变了开发者工作流,削弱了持续将代码上传至GitHub的必要性。为统一工具链并控制成本,微软已要求部分团队在2026年6月底前停止试用Claude Code,转而使用自有工具GitHub Copilot CLI。同时,OpenAI曾考虑自建替代平台,也加剧了对GitHub地位的潜在威胁。 智能体 GitHub Microsoft 编码 推荐理由: 微软内部把 GitHub 风险定义为“生存级”,这不再是外部竞争猜测,AI 编程工具真的在动摇代码托管的根基。

智能体 GitHub Microsoft 编码
AI HOT ·

Claude Code的HTML输出:非凡的有效性

05:45 Claude:Blog(网页) 精选 73 Claude Code团队正从Markdown转向HTML作为主要输出格式。Markdown虽简洁,但在信息密度、阅读性、分享和交互方面存在局限。HTML能支持表格、CSS样式、SVG图表和JavaScript交互,提供更清晰的视觉结构和高信息密度。由于HTML文件可通过浏览器直接打开和分享,便于团队协作审阅。Claude Code利用其广泛的上下文获取能力生成实用的HTML制品,适用于项目规划、文档编写和验证等多种场景,显著提升了AI生成内容的可读性与实用性。 智能体 Anthropic 教程/实践 编码 推荐理由: Claude Code 团队的人亲自告诉你为什么用 HTML 而不是 Markdown,从设计原型到可交互报告全在一个文件里搞定。附带的模板和提示词,开发者可以直接抄。

智能体 Anthropic 教程/实践 编码
AI HOT ·

Claude Code v2.1.145版本更新

06:10 Claude Code:GitHub Releases(RSS) 精选 64 本次更新为Claude Code工具带来了多项功能增强与问题修复。新功能包括:新增JSON格式的会话列表命令以便脚本化操作,并在OTEL追踪中完善了Agent父子关系。插件浏览界面现可预览详细信息。在稳定性方面,修复了权限提示被绕过的安全问题、MCP参数校验错误、终端窗口调整后的显示冻结,以及非ASCII名称导致的API调用失败等问题。同时改进了Read工具的文件超限处理,并优化了任务列表排序和状态栏信息显示等交互细节,整体提升了工具的易用性与可靠性。 智能体 Anthropic 产品更新 部署/工程 推荐理由: Claude Code 这次版本把可编程性和可观测性提升了一大截,尤其 `claude agents --json` 和 OTEL 改进,做自动化脚本和监控的可以直接更新了。

智能体 Anthropic 产品更新 部署/工程
AI HOT ·

拓宽关于前沿AI的对话

07:33 Anthropic:Newsroom(网页) 精选 65 Anthropic为构建负责任的先进AI,正与全球多元群体展开对话。首轮讨论汇集了超过15个宗教、哲学及跨文化传统的学者与伦理学者,旨在为Claude等模型的道德形成与价值观对齐提供多元视角。受“外部良知”概念启发,团队开发并测试了伦理承诺提醒工具,初步实验显示其能有效降低模型不对齐行为。公司计划未来将对话拓展至法律、心理学及公民社会等领域,以共同应对AI对社会结构的重塑。 Anthropic 安全/对齐 推理 关联讨论 1 条 X:Anthropic (@AnthropicAI) 推荐理由: Anthropic在做一件少见的事——请神学家和哲学家帮忙塑造Claude的‘性格’,初步实验发现让模型在决策前暂停反思能降低偏差,做AI对齐的值得读一下。

Anthropic 安全/对齐 推理
AI HOT ·

人们每周在ChatGPT中生成超过15亿张图像。 研究员 @kenjihata 与产品负责人 @adele__li 及主持人 @AndrewMayne 一起,探讨自 Images 2.0 发布以来出现的新用例和趋势。

05:44 OpenAI @ OpenAI 精选 70 OpenAI 图像生成 现象/趋势 推荐理由: OpenAI 首次把内部图像生成数据摊开聊,每周 15 亿张的量级说明这功能已经不是玩具了,做图像产品的可以对着用例风向调方向。

OpenAI 图像生成 现象/趋势
AI HOT ·

Forge:通过防护机制大幅提升8B模型性能的可靠性层

05:41 Hacker News:AI 热帖 精选 89 Forge 是一个为自托管大语言模型设计的可靠性层,专注于提升工具调用能力。它通过错误解析、重试提示、步骤强制等防护机制以及高效的上下文管理,成功将8B参数模型在复杂多步骤智能体任务中的表现从53%大幅提升至99%。其核心配置(Ministral-3 8B模型)在自建的26项评估中综合得分达86.5%。Forge 提供三种集成方式:作为全托管工作流运行器、多智能体架构的共享调度器,或嵌入自有编排循环的防护中间件,并附带一个可透明接入的OpenAI兼容代理服务器。 智能体 开源/仓库 关联讨论 1 条 Hacker News 热门(buzzing.cc 中文翻译) 推荐理由: 这个小工具用 guardrails 把本地 8B 模型从 53% 拉升到 99% 的稳定度,对玩自托管 Agent 的人来说像是换了条命,值得一试。

智能体 开源/仓库
AI HOT ·

谷歌推出全新AI智能搜索框,支持多模态交互

05:40 Google AI @ GoogleAI 精选 83 谷歌宣布推出基于Gemini 3.5模型的全新智能搜索框。该更新将AI Overviews与AI Mode整合为统一的AI搜索体验,支持对文本、图像、文件及视频进行跨模态推理查询。用户可进行多轮对话,搜索将结合上下文提供更个性化、定制化的回答。该新功能已在全球桌面和移动设备端同步上线。 Google 产品更新 多模态 推理 关联讨论 2 条 IT之家(RSS) Hacker News 热门(buzzing.cc 中文翻译) 推荐理由: Google搜索史上最大一次交互变革,Gemini 3.5加持的搜索框能理解文本、图片、视频,AI Overviews和对话模式彻底融合,搜索终于变成真正的对话助手。

Google 产品更新 多模态 推理
AI HOT ·

使用 Gemini 3.5 Flash 构建你的第一款游戏。 无需复杂的3D建模,即可将日常物品直接转化为互动的数字体验。从一个 Nano Banana 提示开始,在 Canvas 中将你的图像变成游戏,并优化你的愿景以获得最佳游戏体验。

04:38 Google Gemini @ GeminiApp 精选 72 Google 多模态 教程/实践 推荐理由: Google Gemini 官方教你把日常物品照片变成互动游戏,Nano Banana 到 Canvas 的链路很直接,想试 Gemini 多模态能力的人可以当入门案例跑一遍。

Google 多模态 教程/实践