AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

我国首部L3/L4自动驾驶强制性国标公示:2027年7月起实施

23:14 IT之家(RSS) 精选 76 工信部6月16日就《智能网联汽车自动驾驶系统安全要求》等2项强制性国标公开征求意见,公示至6月24日,建议2027年7月1日起实施。该标准系我国首部针对L3/L4的强制性国标,要求系统安全水平至少达到“合格且专注驾驶人”,引入Safety Case机制。L3重点规范人机交接,L4强调自身风险处置、不得依赖远程协助。新申请车型实施日起执行,已获批车型有约一年过渡期。 具身智能 政策/监管 推荐理由: 首部 L3/L4 强制国标公示,意味着自动驾驶从推荐性标准升级为强制性安全底线,车企靠模糊宣传抢市场的阶段正式结束,行业竞争逻辑从此由功能展示转向安全实证。

具身智能 政策/监管
AI HOT ·

AI 智能体够格吗?在自有工具上评测开源模型

21:47 Hugging Face:Blog(RSS) 精选 74 Hugging Face 发布面向 AI 智能体使用场景的基准测试框架,以 transformers 库为案例评估库的智能体友好度。框架使用 pi coding agent 与开源模型驱动,通过 Hugging Face Jobs 分散任务确保硬件一致。评估关注 agent 完成任务的成本、延迟、token 使用量和失败率,而非仅最终结果。此前 hf CLI 经优化后 agent token 使用量减少 1.3-1.8 倍(最高 6 倍),该框架旨在验证类似优化对 transformers 的效果。 智能体 Hugging Face 开源/仓库 教程/实践 推荐理由: Hugging Face 这波实验打破了我的直觉——为大型模型优化的 CLI+Skill 方案反而让小模型正确率暴跌,做 agent 工具链的人应该马上看这个标杆。

智能体 Hugging Face 开源/仓库 教程/实践
AI HOT ·

OpenAI与哈佛等合作研究:o3 Deep Research模型辅助诊断儿童罕见病,额外诊断率4.8%

23:05 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 72 波士顿儿童医院、哈佛大学与OpenAI合作,在《NEJM AI》发表研究。团队使用OpenAI o3 Deep Research推理模型重新分析376例此前未确诊的罕见病案例,产出基于证据的候选解释。经专家评审、额外检测和临床确认,医生在18例中建立诊断,额外诊断率达4.8%。研究显示,AI辅助工作流可帮助专家在未解病例中生成可检验假设,使定期再分析更具可扩展性。模型不直接诊断或做临床决策,仅提供证据链供专家审查。 OpenAI 推理 数据/训练 论文/研究 推荐理由: 这是AI辅助罕见病诊断的严肃实证,4.8%的新诊断率在专家反复分析过的病例里相当扎实。虽然离临床落地还很远,但证明推理模型能帮专家从旧数据里挖出新线索。

OpenAI 推理 数据/训练 论文/研究
AI HOT ·

Adobe 为 Photoshop、Premiere 等多款 Creative Cloud 应用加入 AI 智能体

21:21 The Decoder:AI News(RSS) 精选 72 Adobe 将其“创意智能体”扩展至 Photoshop、Premiere 等应用,以公开测试形式提供 AI Assistant。该智能体可自动完成多步骤常规任务,如 Premiere 分拣素材和粗剪、Photoshop 换背景、Illustrator 批量生成文件、InDesign 更新版式等。Firefly 新增面向个人创作者的品牌套件、产品图转短视频及 Quick Cut 自动剪辑功能。Adobe 工具已集成至 ChatGPT、Claude 及 Microsoft 365 Copilot,Google Gemini 和 Slack 集成即将推出。 智能体 产品更新 多模态 推荐理由: Adobe把AI助手直接塞进了Photoshop、Premiere这些上亿人用的创作工具,干的虽然是粗剪、排版一类的苦力活,但却是AI从生成器转向流程助手的关键一步,值得所有创意工作者上手试试。

智能体 产品更新 多模态
AI HOT ·

OpenAI 升级 ChatGPT 医疗能力:GPT-5.5 Instant 达到 Thinking 模型水平,免费可用

03:23 The Decoder:AI News(RSS) 精选 73 OpenAI 升级 ChatGPT 医疗能力,新模型 GPT-5.5 Instant 在 HealthBench 及 HealthBench Professional 测试中达到最贵 Thinking 模型水平,成本大幅降低。该模型对所有免费用户开放(有使用限制),其回答在准确性、清晰度和完整性上优于医生书写的回答,过去两个月错误健康陈述减少 71%。超 260 名来自 60 个国家的医生审查了 70 多万条模型响应。每周有超 2.3 亿人通过 ChatGPT 咨询健康问题。OpenAI 还提供 ChatGPT for Clinicians 和 OpenAI for Healthcare 等专业工具。 OpenAI 模型发布 推荐理由: ChatGPT 的医疗回答现在比医生写的还好,错误率两个月降了 71%,背后是 260 名医生和 70 万条数据打磨的结果。对 230 million 经常查健康问题的用户,这个升级每天都会用得上。

OpenAI 模型发布
AI HOT ·

DeepSeek 识图模式正式上线 App 和网页端

16:14 IT之家(RSS) 精选 72 DeepSeek 识图模式于6月18日在网页和 App 端正式上线,与快速模式、专家模式并列。开启后用户可直接上传图片让 DeepSeek 识别图像,能力超越简单文字提取。目前 App 端仍显示“图片理解功能内测中”,网页端无此提示。该模式背后的多模态模型技术细节于今年4月公开,核心框架为“Thinking with Visual Primitives(以视觉原语思考)”。 DeepSeek 产品更新 多模态 推荐理由: DeepSeek的识图模式终于从内测进了正式版,虽然是补课而非破圈,但对中文用户来说,让AI直接看图比打字描述常用太多,日常工作和内容处理都更顺手了。

DeepSeek 产品更新 多模态
AI HOT ·

Kimi Work 新增目标模式与插件中心,6月推出额度消耗5折福利

17:10 公众号:月之暗面(Kimi) 精选 70 月之暗面旗下 Kimi Work(Beta 版)新增「目标模式」,支持设定终点后由 Agent 自主循环推进任务,最长连续运行24小时,过程中人类可随时中断调整。同时上线「插件中心」,可选装百度网盘、Canva可画、钉钉、飞书、WPS、Notion、Cloudflare 等外部应用。6月限时福利期间,Kimi 电脑客户端 Work 模式所有任务会员额度消耗减半,即从0.02%降至0.01%。 智能体 MCP/工具 产品更新 推荐理由: 目标模式把 Kimi Work 从对话助手变成了能连续运行 24 小时的自主 Agent,配合插件中心打通办公软件,对需要长时间执行复杂任务的用户是实际可用性的大升级。

智能体 MCP/工具 产品更新
AI HOT ·

八部门:用好个人消费贷款财政贴息政策,支持消费者购买 AI 相关产品

17:14 IT之家(RSS) 精选 82 商务部等八部门6月18日发布关于加快“人工智能+消费”发展的实施意见。其中提到加大财政资金支持,落实数码和智能产品购新政策,鼓励地方在消费品以旧换新框架内自主制定补贴,重点支持新一代智能终端消费。增加AI手机、智能电脑、智能电视、智能家居、AI眼镜、智能网联汽车、人形机器人等产品供给,培育智能穿戴消费市场。同时加快AI在居家服务、养老服务、文化旅游、住宿餐饮、教育教学等领域的应用,建设AI商品首发平台,举办“人工智能进万家”活动。 具身智能 多模态 政策/监管 推荐理由: 八部门联合推AI消费补贴,从手机、机器人到养老教育全覆盖,这是国家层面推动AI产品普及的强烈信号,终端厂商和消费者都将迎来实质利好。

具身智能 多模态 政策/监管
AI HOT ·

火山引擎上线豆包实时语音模型3.0 API 服务,开启邀测

18:40 公众号:火山引擎 精选 72 火山引擎上线豆包实时语音模型3.0(Seeduplex)API 服务并开启邀测。该模型为原生全双工端到端语音大模型,具备精准遵循、抗干扰、动态判停三大优势。可在多人对话中安静待命,指定话题出现时主动加入;支持通过自定义工具在实时交互中完成预定日历、发送邮件等任务。抗干扰力提升,误回复率与误打断率大幅降低;判停延迟缩短约250ms,复杂场景抢话比例下降40%,用户主动打断延迟缩短约300ms。适用于汽车智能座舱、智能硬件、智能客服等场景。 模型发布 语音 推荐理由: 豆包实时语音模型3.0带来的全双工实时工具调用,把语音助手从对讲机变成了真人助理,判停延迟和抢话率的改善数据扎实,做车载和智能硬件的团队该认真看看。

模型发布 语音
AI HOT ·

ChatGPT 图像生成器可被绕过滤镜生成暴力和色情内容

19:47 Hacker News 热门(buzzing.cc 中文翻译) 精选 79 Mindgard 红队研究发现,ChatGPT 的图像生成器可通过简单提示词轻易绕过内容过滤器,在未直接请求的情况下自动生成性暴力、血腥谋杀等露骨图像。一个热门的“恢复照片”提示词因输入模糊而绕过输入过滤器,结果如同俄罗斯轮盘赌;进一步添加虚假图像 ID 和“不做审查”指令后,模型持续生成高度性化女性图像,甚至出现被捆绑殴打的尸体,并自动赋予惊悚标题。研究指出,OpenAI 此前声称修复的裸体问题仍未解决,暴露了 AI 工具广泛可及性与不足内容过滤的现实风险。 OpenAI 图像生成 安全/对齐 推荐理由: 这是自 ChatGPT 图片功能上线以来最严重的安全漏洞曝光,Mindgard 用简单句子就绕过所有 filter 直接生成极端暴力色情图片,OpenAI 的回应和处理令人失望,暴露了训练数据治理的根本问题。

OpenAI 图像生成 安全/对齐
AI HOT ·

皮尤民调:63%美国人认为AI发展太快,ChatGPT使用率翻番

20:14 IT之家(RSS) 精选 71 皮尤研究中心最新民调显示,63%美国人认为AI发展速度过快。ChatGPT使用率较2023年翻番,44%受访者曾使用。49%偶尔使用聊天机器人,仅16%认为AI会有积极社会影响。青年群体使用率更高但更悲观:18–29岁中66%用过,48%认为有负面影响,仅14%看好。30–49岁中34%每天至少使用一次。约四成用AI处理工作,30%认为提高效率,28%认为帮助获取信息。此外,66%成年人担心AI传播错误信息。 现象/趋势 行业动态 推荐理由: 皮尤数据显示63%美国人认为AI过快,年轻人用得多却更悲观,这是AI产品信任危机的真实信号,做体验的该关注。

现象/趋势 行业动态
AI HOT ·

保障AI智能体的未来安全

21:19 Google DeepMind:Blog(RSS) 精选 65 Google DeepMind发布AI Control Roadmap,这是一套针对内部先进AI智能体的系统级安全框架。该框架在传统模型对齐之上增加防线,假设AI智能体可能不对齐,通过威胁建模、沙箱隔离、端点安全、提示注入防御以及基于已验证行为逐步授予权限的机制建立信任。据估算,到2030年仅美国市场AI智能体就能创造2.9万亿美元经济价值。 智能体 DeepMind 安全/对齐 部署/工程 推荐理由: DeepMind 首次系统性地公开了内部 AI 代理安全控制路线图,把代理当潜在「内鬼」来防的思路很务实,分析了 100 万个任务轨迹的监控实践尤其值得做 Agent 安全的人细看。

智能体 DeepMind 安全/对齐 部署/工程
AI HOT ·

首个统一科学大模型 LOGOS 正式开源

10:40 公众号:通义实验室(千问) 精选 75 LOGOS 由 ATH-Token Foundry 联合中国人民大学高瓴人工智能学院开源,是首个基于统一“科学语法”的多领域科学生成基础模型。LOGOS-1B(1B参数)在六大科学任务上匹配或超越领域专用方法:口袋条件配体生成纯序列范式首次超越3D扩散模型,超越NatureLM(8×7B);逆合成预测Top-1准确率74.8%;口袋位点识别仅靠序列达58.5% Top-n准确率;MOF材料生成NBB提升至17.78%。模型采用统一词汇表将蛋白质、小分子等编码为离散Token,通过空间交互离散化实现无需3D坐标的序列预测。预训练与下游任务形式与目标一致,跨领域知识迁移经实验验证有效。已完整开源模型权重、推理代码与技术报告。 开源生态 数据/训练 模型发布 关联讨论 1 条 IT之家(RSS) 推荐理由: LOGOS用一套统一科学语法把蛋白质、小分子、材料等塞进同一个LLM框架,纯序列建模就干过了专用扩散模型,参数量却只有NatureLM的1/56,做AI4S的得认真看一眼。

开源生态 数据/训练 模型发布
AI HOT ·

cuTile Rust:安全无数据竞争的 GPU 内核系统

11:14 Hacker News 热门(buzzing.cc 中文翻译) 精选 70 cuTile Rust 是一个基于 tile 的 GPU 编程系统,允许用 Rust 编写内存安全、无数据竞争的内核。它通过 `#[cutile::module]` 宏将内核 AST 嵌入主机二进制,在运行时经 CUDA Tile IR JIT 编译为 GPU cubin。可变张量在启动前分割,不可变张量共享,启动器在 GPU 工作期间保持所有权。在 NVIDIA B200 上,逐元素操作达 7 TB/s(约 91% 峰值带宽),GEMM 达 2 PFlop/s(约 92% 密集 f16 峰值)。基于 cuTile Rust 构建的 Grout 推理引擎在 RTX 5090 上解码 Qwen3-4B 达 171 tokens/s,在 B200 上解码 Qwen3-32B 达 82 tokens/s。项目处于早期研究阶段。 arXiv Hugging Face 开源/仓库 开源生态 推荐理由: 用Rust的所有权模型保证GPU内核无数据竞争,性能还能达到峰值的92%,这个方向可能是安全GPU编程的未来,系统编程和推理引擎开发者值得一试。

arXiv Hugging Face 开源/仓库 开源生态
AI HOT ·

Sumi:从头训练的7B开源均匀扩散语言模型

11:43 HuggingFace Daily Papers(社区热门论文) 精选 74 Sumi(日语“墨”)是一个完全开源的7B参数均匀扩散语言模型,从零开始在1.5T模型token上预训练。它在知识、推理和编程评测中与同等token预算的自回归模型表现相当,但在常识推理benchmark上略逊,教育密集型数据混合可能是原因之一。Sumi开放模型权重、检查点及完整训练配方(含公开语料数据混合说明),为社区提供首个大规模均匀扩散模型的基准参考。 arXiv Hugging Face 开源生态 数据/训练 推荐理由: Sumi 是第一个完全从零预训练的大规模均匀扩散语言模型,填补了社区在这方向的研究空白,做扩散语言模型的人终于有个可以摸的起点。

arXiv Hugging Face 开源生态 数据/训练
AI HOT ·

MOSS-TTS-Local-Transformer-v1.5 在 SGLang-Omni 上:原生流式 48 kHz 语音服务

13:56 LMSYS:Blog(Chatbot Arena 团队) 精选 67 MOSS-TTS-Local-Transformer-v1.5 是一款开源 TTS 模型,支持 48 kHz 立体声、零样本声音克隆、最长 10 分钟长文本合成、时长控制及 31 种语言。其核心采用 Qwen3-4B 骨干与约 2B 参数的 MOSS-Audio-Tokenizer-v2 音频编解码器,通过 12 个 RVQ 码本运行。SGLang-Omni 以三阶段流水线部署该模型。在 Seed-TTS-Eval 上词错误率 5.10%、语音相似度 69.23%,CV3-Eval 上 WER 7.48%、SIM 61.59%,MiniMax Multilingual 上 WER 6.37%、SIM 75.31%,X Voice 上 WER 20.48%、SIM 63.00%。 产品更新 语音 部署/工程 推荐理由: SGLang-Omni 把 MOSS-TTS 的端到端服务拆成三阶段并做了大量底层优化,对想落地实时语音合成的团队是现成的技术方案,技术细节扎实,可以直接照着搭。

产品更新 语音 部署/工程
AI HOT ·

免费开源乔木画布:AI生图+抠图,一键部署Vercel

15:54 向阳乔木 @ vista8 精选 79 乔木画布推出免费开源在线图像编辑器,可一键部署Vercel为网站,功能类似简化版PS。支持Seedream和GPT-image-2生图、图片模板存储分享、一键抠图、2万图标和常见Emoji,甚至能绘制PRD。随时创建3:4/16:9/21:9等不同尺寸画布。原计划高级功能收费,庆祝端午节现全免费开源。在线体验:https://ps.qiaomu.ai/,GitHub见评论区。 OpenAI 图像生成 开源/仓库 开源生态 推荐理由: 这个开源画布把AI生图和简易设计工具打包,一键部署Vercel,对偶尔做图的产品人和开发者很友好,全免费开源的诚意值得点开收藏。

OpenAI 图像生成 开源/仓库 开源生态
AI HOT ·

我们全新"Midjourney Scanner"的技术深潜。

09:45 Midjourney @ midjourney 精选 71 产品更新 图像生成 推荐理由: Midjourney 官方放出 Scanner 的技术深度解读,我觉得它把传统扫描和生成式 AI 结合的方式挺有启发,不只是一个滤镜,而是重构了图像输入流程,做图像产品的值得认真看看。

产品更新 图像生成
AI HOT ·

上交所发布指引:AI大模型企业可适用科创板第五套上市标准

09:14 IT之家(RSS) 精选 72 上海证券交易所6月17日发布指引,支持尚未形成稳定收入的优质人工智能大模型企业通过科创板第五套上市标准发行上市。申报企业需在行业地位、产业链优势、目标市场需求、研发进度及关键指标方面具备突出竞争力。指引明确,申报时至少有一个大模型产品已完成上线发布并实现规模化应用,以验证商业模式可行性。下一步,上交所将在中国证监会指导下推进符合标准的企业上市。 政策/监管 行业动态 推荐理由: 上交所给AI大模型企业开了科创板上市的明确通道,但附加了苛刻但合理的要求——至少有一个大模型上线且规模化应用,这会让那些只有PPT的伪AI公司现原形。

政策/监管 行业动态
AI HOT ·

苹果 Xcode 27 核心首次深度集成 AI 智能体:支持自然语言修 Bug、构建 App

09:14 IT之家(RSS) 精选 71 在 2026 年 WWDC 期间,苹果发布 Xcode 27,其核心组件首次整合 AI 智能体,能理解 Swift 语言并通过多轮自然语言对话辅助开发。AI 可跨多个文件修改整个代码库,也能根据提示与资源生成应用设计并独立构建完整应用,建成后仍可通过对话添加特效、动画等。Xcode 27 支持接入 Anthropic、OpenAI 和 Google 等第三方 AI 模型,同时引入 Core AI 框架提供现代 Swift API 调用端侧模型,并升级开源框架 MLX。 智能体 产品更新 编码 推荐理由: Xcode 27 把 AI 智能体直接嵌进 IDE,支持多文件编辑和第三方模型,对苹果生态开发者是效率跃迁,非苹果开发者可以略过。

智能体 产品更新 编码