AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

Codex现可通过OpenAI Developers插件,帮助您利用OpenAI API更快地构建AI应用和智能体。

04:01 OpenAI Developers @ OpenAIDevs 精选 69 智能体 OpenAI 产品更新 编码 关联讨论 3 条 X:Berry Xia (@berryxia) X:邵猛 (@shao__meng) X:Greg Brockman (@gdb) 推荐理由: 把 Codex 直接接入 OpenAI API 开发流程,这是在给自家开发者递快刀,做 AI 应用和 Agent 的可以第一时间装上,省掉的不只是时间,还有调试的心力。

智能体 OpenAI 产品更新 编码
AI HOT ·

情绪板曾是最精彩的部分。如今它只是起点。 上传你的参考素材。设定方向。Luma Agents 会将其从情绪板转化为完整的广告。 生成广告 → http://lumalabs.ai/app

04:59 Luma @ LumaLabsAI 精选 73 智能体 产品更新 图像生成 视频 推荐理由: Luma这次把情绪板直接变广告,做创意的终于不用在PPT和渲染之间反复横跳了,一键出片的感觉很像去年Midjourney上线V6。

智能体 产品更新 图像生成 视频
AI HOT ·

推出Daybreak:面向网络防御者的前沿AI。 Daybreak汇集了最强大的OpenAI模型、Codex以及我们的安全合作伙伴,以加速网络防御并持续保障软件安全。 朝着安全团队能以防御所需速度行动的未来迈进一步。

05:10 OpenAI @ OpenAI 精选 60 OpenAI 产品更新 安全/对齐 关联讨论 1 条 X:Kim (@kimmonismus) 推荐理由: OpenAI 把最强模型和 Codex 打包成安全防御专用工具,虽然目前更像是给安全团队的定向特供,但「AI for defense」这个产品化方向本身值得留意。

OpenAI 产品更新 安全/对齐
AI HOT ·

ChatGPT 在 2026 年初如何扩大应用范围

06:13 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 66 2026年第一季度,ChatGPT的用户采用率大幅上升,其中35岁以上用户群体的增长最为迅速,同时用户性别比例也趋于均衡。这表明以ChatGPT为代表的人工智能技术正加速融入主流社会,其应用范围已突破早期以年轻技术爱好者为主的局限,向更广泛、更多元化的普通用户群体拓展。 OpenAI 现象/趋势 推荐理由: 这是我今年看过最值得留意的用户数据,ChatGPT正跳出早期极客圈,35岁以上用户成为增长主力,所有面向大众的AI产品都得重新思考用户画像。

OpenAI 现象/趋势
AI HOT ·

纳德拉出庭反击马斯克诉讼案:他明明有我的手机号,但从未抱怨过微软与 OpenAI 的合作

07:36 IT之家(RSS) 精选 77 微软CEO纳德拉在马斯克诉OpenAI案中作证,反驳了马斯克关于OpenAI背离非营利初衷的指控。他出示了马斯克2016年的感谢邮件,证明其当时完全支持微软与OpenAI的合作,且微软为此承受了1500万美元亏损。纳德拉强调,双方一直保持沟通,但马斯克在合作深化期间从未提出抱怨,直至2024年才提起诉讼。他还将2023年OpenAI董事会解雇CEO奥尔特曼的事件评价为“业余之举”,并透露自己曾介入帮助奥尔特曼复职。 Microsoft OpenAI 行业动态 推荐理由: 纳德拉的证词猛料不少,从2016年马斯克感谢微软到微软为OpenAI承受亏损,直接打脸马斯克的诉讼主张。关注AI权力格局演变的,这篇必读。

Microsoft OpenAI 行业动态
AI HOT ·

在AWS上进行基础模型训练与推理的核心构建模块

07:43 Hugging Face:Blog(RSS) 精选 58 本文面向使用开源框架的机器学习工程师,阐述了AWS如何为大规模基础模型的全生命周期提供核心基础设施。其核心是三大紧密集成的组件:配备多代NVIDIA GPU(如H100、H200及新一代Blackwell B200/B300)的大显存加速计算实例;用于集体通信的高带宽、低延迟网络(节点内NVLink与节点间EFA);以及可扩展的分布式存储。这些基础设施与Slurm/Kubernetes等资源编排系统、PyTorch/JAX等ML框架协同,共同支撑预训练、后训练和推理工作负载,并可通过Prometheus/Grafana实现全栈可观测性。 开源生态 教程/实践 数据/训练 部署/工程 推荐理由: 这篇把AWS上训大模型的全套基础设施串了一遍,从GPU选型到网络存储再到Slurm/K8s编排,是做云端大规模训练的工程师的必读参考。

开源生态 教程/实践 数据/训练 部署/工程
AI HOT ·

我们正在对FrontierMath的Tiers 1-4进行AI辅助审查。 这已标记出约三分之一题目存在致命错误, 且我们相信大多数标记是有效的。 在完成全面人工审核后, 我们将在修正的数据集上发布更新后的分数。

08:35 Epoch AI @ EpochAIResearch 精选 77 数据/训练 评测/基准 推荐理由: FrontierMath 是衡量模型数学推理的核心基准,三分之一题目有致命错误这件事会让之前的所有满分评分变得可疑,做评估的人必须重新审视数据。

数据/训练 评测/基准
AI HOT ·

谷歌表示,犯罪黑客利用人工智能发现了一个重大的软件漏洞

08:55 Hacker News 热门(buzzing.cc 中文翻译) 精选 73 谷歌披露,犯罪黑客利用人工智能技术发现并利用了一个重大的软件漏洞。该漏洞存在于广泛使用的开源软件中,可能导致大规模数据泄露或系统入侵。谷歌威胁分析小组追踪到此次攻击,并确认黑客借助AI工具显著提升了漏洞挖掘的效率与精准度。目前漏洞细节尚未公开,但相关软件维护方已发布安全更新。这一事件凸显了AI技术被恶意用于网络攻击的现实风险,对全球网络安全防御体系提出了新的挑战。 Google 安全/对齐 关联讨论 1 条 IT之家(RSS) 推荐理由: 这不是演习,谷歌亲口确认黑客用AI挖到了真实漏洞,AI降低攻击门槛不再是理论推演,安全从业者该重新评估威胁模型了。

Google 安全/对齐
AI HOT ·

Cursor 在 Microsoft Teams 可用了 最新集成方式有:Slack、Linear 和 Microsoft Teams 如果你们公司在用微软产品体系,Microsoft Teams 还是必选项,这个集成比较实用,在这安装: https://cursor.com/dashboard/integrations#integrations

09:05 meng shao @ shao__meng 精选 71 智能体 产品更新 推荐理由: 虽然只是多了一个 Teams 集成,但对于严重依赖微软生态的团队,Cursor 终于不再是‘只有 Slack 才能用’的工具了。

智能体 产品更新
AI HOT ·

Thinking Machines发布原生多模态"交互模型",实现实时人机协作

10:49 歸藏(guizang.ai) @ op7418 精选 71 前OpenAI CTO Mira创立的Thinking Machines公司发布了一种创新的“交互模型”。该模型能原生、持续地接收音频、视频和文本等多模态输入,并实时思考与响应,而非通过Agent串联多个独立模型。其架构分为两部分:前台交互模型以200毫秒为节点处理输入并维持用户“在场感”,支持随时打断;后台推理模型则处理长程规划、工具调用等复杂任务。两者协同工作,最终呈现为一个既能实时交互又能处理重度任务的统一界面。 多模态 推理 模型发布 推荐理由: Mira 从 OpenAI 出来后搞了个真正全模态实时交互的原生模型,不再是多个模型串起来的 Agent 架子,这可能是下一代 AI 交互的雏形,做产品的必须看一眼。

多模态 推理 模型发布
AI HOT ·

信息的结构与呈现方式本身正成为AI智能层的关键。当前,让大语言模型以HTML格式输出,能提供比默认Markdown更丰富的视觉布局与交互性,是值得尝试的技巧。长远来看,人类虽偏好用音频输入,但视觉(图像/动画/视频)才是更理想的AI输出形式,因为大脑约三分之一皮层专司视觉处理。AI输出形态将沿"原始文本→Markdown→HTML→交互式神经视频/模拟"的路径演进,最终可能由扩散神经网络直接生成交互视频。同时,输入方式也需融合音频、文本、视频及手势等多模态交互。在人机输入输出深度融合方面,仍有巨大发展空间。

11:12 SiliconFlow @ SiliconFlowAI 精选 74 OpenAI 多模态 大佬观点 关联讨论 3 条 X:Andrej Karpathy (@karpathy) X:Yuchen Jin (@Yuchenj_UW) X:阿易 AI Notes (@AYi_AInotes) 推荐理由: Karpathy 给的路线图从文本到 HTML 再到神经视频,其中第一步的‘让 LLM 输出 HTML’你今晚就能用上。未来交互形态的思考,值得产品经理细读。

OpenAI 多模态 大佬观点
AI HOT ·

全国首例 AI 代写"种草笔记"案宣判,法院判决工具提供者赔偿平台 10 万元

12:36 IT之家(RSS) 精选 72 全国首例 AI 代写“种草笔记”不正当竞争案在浙江省杭州市中级人民法院宣判。被告 B 公司和 C 公司运营的 AI 写作工具能一键生成某社交平台风格的种草文案,以会员制营利,诱导用户发布虚假消费体验,破坏平台真实内容生态。法院判决被告赔偿原告经济损失及合理开支共计 10 万元,并创新性使用“四要素判定法”,明确生成式人工智能服务提供者需尽到合理注意义务,为治理 AI 生成虚假信息划定了法律边界。 政策/监管 现象/趋势 推荐理由: 司法首次给AI生成内容工具划定注意义务边界,这起首例判罚直接定义了做种草文案生成器的法律红线,四要素判定法很可能成为后续案件的参照。

政策/监管 现象/趋势
AI HOT ·

npm 生态遭大范围投毒:TanStack、Mistral AI、UiPath 等受波及,可窃取云密钥与 GitHub 令牌

12:36 IT之家(RSS) 精选 71 网络安全机构Socket发现针对npm生态的大规模供应链攻击“Mini Shai-Hulud”。攻击者组合利用GitHub Actions的三种漏洞,绕过了双重身份验证等保护机制,向TanStack、Mistral AI、UiPath等知名项目的软件包中植入恶意版本。被篡改的包在安装时会自动执行恶意代码,窃取AWS、GCP、Kubernetes、GitHub令牌及SSH私钥等敏感凭证。此次攻击波及超过160个包名、近373个恶意版本,目前所有恶意版本已被清理。 安全/对齐 开源生态 行业动态 推荐理由: 这轮 npm 投毒把 TanStack、Mistral AI 和 UiPath 全卷进去了,甚至能直接窃取云密钥和 GitHub 令牌,搞开发的建议立刻按文末应急措施检查自己的依赖树。

安全/对齐 开源生态 行业动态
AI HOT ·

Qwen-Image-2.0技术报告

12:44 HuggingFace Daily Papers(社区热门论文) 精选 76 Qwen-Image-2.0是一个统一高保真生成与精确编辑的全能图像生成基础模型。它采用Qwen3-VL作为条件编码器,结合多模态扩散变换器进行联合建模,并通过大规模数据整理与多阶段训练实现强化。该模型支持长达1K令牌的指令输入,能生成幻灯片、海报等富文本内容,显著提升多语言文本渲染与排版质量。在生成方面,它增强了细节、纹理真实感与光照一致性,并更可靠遵循复杂指令。人工评估表明,其在生成和编辑任务上均大幅超越前代模型。 arXiv 图像生成 多模态 模型发布 推荐理由: 这是 Qwen-Image 系列第一次把多模态理解和生成真正拧到同一框架里,长文本渲染和多语言排版提升肉眼可见,做海报和幻灯片的可以重点关注。 12:36 IT之家(RSS) 精选 71 npm 生态遭大范围投毒:TanStack、Mistral AI、UiPath 等受波及,可窃取云密钥与 GitHub 令牌 网络安全机构Socket发现针对npm生态的大规模供应链攻击“Mini Shai-Hulud”。攻击者组合利用GitHub Actions的三种漏洞,绕过了双重身份验证等保护机制,向TanStack、Mistral AI、UiPath等知名项目的软件包中植入恶意版本。被篡改的包在安装时会自动执行恶意代码,窃取AWS、GCP、Kubernetes、GitHub令牌及SSH私钥等敏感凭证。此次攻击波及超过160个包名、近373个恶意版本,目前所有恶意版本已被清理。 安全/对齐 开源生态 行业动态 推荐理由: 这轮 npm 投毒把 TanStack、Mistral AI 和 UiPath 全卷进去了,甚至能直接窃取云密钥和 GitHub 令牌,搞开发的建议立刻按文末应急措施检查自己的依赖树。 12:36 IT之家(RSS) 精选 72 全国首例 AI 代写"种草笔记"案宣判,法院判决工具提供者赔偿平台 10 万元 全国首例 AI 代写“种草笔记”不正当竞争案在浙江省杭州市中级人民法院宣判。被告 B 公司和 C 公司运营的 AI 写作工具能一键生成某社交平台风格的种草文案,以会员制营利,诱导用户发布虚假消费体验,破坏平台真实内容生态。法院判决被告赔偿原告经济损失及合理开支共计 10 万元,并创新性使用“四要素判定法”,明确生成式人工智能服务提供者需尽到合理注意义务,为治理 AI 生成虚假信息划定了法律边界。 政策/监管 现象/趋势 推荐理由: 司法首次给AI生成内容工具划定注意义务边界,这起首例判罚直接定义了做种草文案生成器的法律红线,四要素判定法很可能成为后续案件的参照。 11:12 SiliconFlow @ SiliconFlowAI 精选 74 信息的结构与呈现方式本身正成为AI智能层的关键。

arXiv 图像生成 多模态 模型发布 安全/对齐 开源生态 行业动态 政策/监管 现象/趋势 OpenAI 大佬观点 推理 智能体 产品更新 Google 数据/训练 评测/基准 教程/实践 部署/工程 Microsoft Op