AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

加拿大不列颠哥伦比亚省拟起诉OpenAI:未上报ChatGPT暴力对话致校园枪击惨案

18:15 IT之家(RSS) 精选 75 加拿大不列颠哥伦比亚省7月7日宣布将起诉OpenAI,指控其未向执法部门上报一名ChatGPT用户2025年6月封禁前的暴力相关对话内容。该用户随后于今年2月在塔布勒岭制造校园枪击案,杀害8人。OpenAI CEO萨姆·奥尔特曼今年4月为此公开致歉,承认本应上报但未执行。受害家属已在加州法院提起诉讼,省政府正协调独立诉讼,要求赔偿用于社区重建。 OpenAI 安全/对齐 行业动态 推荐理由: 这是AI公司因用户对话内容失察而被政府追责的里程碑案例,胜诉将推动平台安全上报义务的重新定义,对全行业治理影响深远。

OpenAI 安全/对齐 行业动态
AI HOT ·

美国商务部批准OpenAI大规模发布GPT-5.6,Sol明日亮相

12:15 IT之家(RSS) 精选 80 美国商务部正式批准OpenAI大规模发布GPT-5.6。OpenAI宣布GPT-5.6 Sol将于本周四完成最后准备后,与Terra和Luna一同面向公众推出。此前因国家安全考量,美国政府要求分阶段发布,仅允许向经批准的有限实体开放。此次全面放行标志着临时管控结束。获批前,美国商务部下属AI标准与创新中心执行了测试,OpenAI技术团队驻扎华盛顿配合沟通。美国最新AI行政令即将出台,旨在为先进AI模型发布建立正式评估框架。 OpenAI 政策/监管 关联讨论 1 条 The Decoder:AI News(RSS) 推荐理由: 美国政府撤销 GPT-5.6 的发布限制,Sol 明日亮相,这是 AI 监管的一次实际测试,开发者终于能摸到真东西了。

OpenAI 政策/监管
AI HOT ·

AI 审计代理在 Cloudflare CIRCL 中发现 7 个漏洞

12:44 Hacker News 热门(buzzing.cc 中文翻译) 精选 71 zkSecurity 的 AI 审计代理 zkao 持续扫描 Cloudflare 的 CIRCL 密码学库,使用 Opus 4.6 + skills 和 GPT-5.3 + skills 等模型发现并确认了 7 个真实漏洞。其中包括阈值 RSA 中 float64 精度丢失(AI 自评 Critical)和属性基加密(CP-ABE)访问控制完全失效(Critical,由 zkao 自行发现)。所有漏洞已在上游修复,多数在 HackerOne 上获得确认和奖励。AI 生成的候选发现仍需人工验证,但 zkao 已能自动完成大部分验证工作。 Anthropic OpenAI 安全/对齐 编码 推荐理由: zkSecurity用AI扫了Cloudflare的密码学库,挖出7个真实漏洞,从浮点数精度损失到访问控制完全破防。这是AI在密码学审计里第一次证明自己能找到能用的漏洞,不是纸上谈兵。虽然后面发现AI对严重性的判断还很瞎,但整体值得安全从业者一读。

Anthropic OpenAI 安全/对齐 编码
AI HOT ·

工信部发布Claude Code后门安全风险提示

14:05 小互 @ xiaohu 精选 79 中国工信部发布风险提示,指出 Claude Code 2.1.91 至 2.1.196 版本内置监控机制,未经用户同意即向远程服务器回传用户地域、身份标识等敏感信息。建议相关单位立即全面排查,对受影响版本卸载或升级至已清除后门代码的最新安全版本,并加强开发工具外联权限管控与流量监测,防止敏感数据违规外传。 Anthropic 安全/对齐 编码 部署/工程 推荐理由: 工信部这份公告不是泛泛的安全提醒,而是直接点名Claude Code特定版本内置数据回传,这对所有中国开发者团队都是一个立即行动的命令,Claude Code在中国的信任危机开始了。

Anthropic 安全/对齐 编码 部署/工程
AI HOT ·

黑客可利用9款最流行的AI工具组装大规模僵尸网络

15:17 Ars Technica:AI(RSS) 精选 78 提示注入已成为AI安全的首要威胁——大语言模型无法区分合法指令与恶意指令。此前推送式和拉取式攻击规模均有限。研究人员提出一种名为HalluSquatting的新型拉取式提示注入攻击,首次能组装大规模僵尸网络、执行分布式拒绝服务攻击(DDoS)并大规模感染设备。该攻击可作用于AI编码工具,标志着提示注入攻击从单点突破转向规模化利用。 智能体 GitHub 安全/对齐 论文/研究 推荐理由: 这项研究首次揭示了利用 LLM 幻觉进行大规模 botnet 攻击的可行路径,影响范围覆盖几乎所有主流 AI 编程助手,每个依赖这些工具的开发者都该看一眼。

智能体 GitHub 安全/对齐 论文/研究
AI HOT ·

Runway Dev 发布

23:35 Runway:News(网页) 精选 58 Runway 官网以 Cookie 设置页面代替了产品介绍,未提供 Runway Dev 的功能、参数、可用性等任何具体信息。 产品更新 图像生成 多模态 视频 推荐理由: Runway 把视频、图像、音频生成整合成一个统一 API,加上不用客户数据训练的承诺,对需要快速集成 AI 媒体的产品团队来说是省心选择,技术层面虽无新模型,但集成价值明显。 23:25 Replit ⠕ @ Replit 精选 68 本周新功能 🚀 Replit 社区档案--vibe coders 的工作证明。 你的档案,你的展示。获取你的智能体使用和检查点的活跃度图表,外加面向专业用户的 Replit 力量排名。 登录,认领你的档案,挑选你最棒的项目,与朋友分享你的数据。 立即查看 → http://replit.com/community 智能体 产品更新 编码 推荐理由: Replit 给 vibe coders 加上了个人主页和工作证明,用活动图和排名展示 agent 使用,让 AI 编程社区有了社交层,但实质还是功能小更新,对非重度用户意义有限。 23:25 OpenRouter @ OpenRouter 精选 65 新功能:聊天室一键ZDR(零数据保留) 在完全隐私保护下横向对比模型:https://openrouter.ai/chat 产品更新 推荐理由: OpenRouter 聊天室新加了一键 ZDR,对比模型时请求数据不存储,注重隐私的开发者会开心,但毕竟只是个开关,算不上大新闻。 22:33 Mistral AI:News(网页) 精选 70 Robostral Navigate:Mistral AI 首个具身导航模型 Robostral Navigate 是 Mistral AI 首个具身导航模型(8B 参数),仅用单 RGB 摄像头,在 R2R-CE 验证集上取得 76.6%(unseen)和 79.4%(seen)的成功率,超越最佳单摄像头方法 9.7 个百分点,超越使用深度或多摄像头的系统 4.5 个百分点。模型通过 pointing 预测目标坐标并结合强化学习持续改进,全部在模拟中训练(约 40 万轨迹、6000 场景),采用 prefix-caching 实现高效训练。通用适配轮式、腿式和飞行机器人,能适应真实环境中未训练的障碍。 具身智能 多模态 模型发布 推荐理由: Mistral 首个具身导航模型,只用单 RGB 摄像头就在未见环境中跑赢深度传感器方案,对机器人行业是个真信号,做物流和制造的可以仔细看看。 21:22 字节 Seed:Research Feed(网页内嵌数据) 精选 78 Seedream 5.0 Pro 发布:不止"生成",更懂"设计" 字节 Seed 今日发布多模态图像

产品更新 图像生成 多模态 视频 智能体 编码 具身智能 模型发布 GitHub MCP/工具 开源/仓库 OpenAI 安全/对齐 行业动态 论文/研究 Anthropic 部署/工程 政策/监管 arXiv 推理 Hugging Face 开源生态 数据/训练 大佬观点 教程/实践 Meta Microsoft 现象/趋势 Google 评测/基准
AI HOT ·

AlayaWorld:长程可玩视频世界生成

10:18 HuggingFace Daily Papers(社区热门论文) 精选 73 AlayaWorld 是一个全栈开源框架,用于构建交互式生成世界。该框架支持开放式实时交互,用户可自由导航并执行战斗、施法、召唤怪物等多种动作。AlayaWorld 将数据准备、模型架构、训练、推理加速和部署统一在模块化可扩展的架构中,并发布了可复现流程、参考实现、评估工具和完整文档,为生成世界模型的未来研究与实时应用奠定基础。 arXiv 具身智能 开源/仓库 视频 推荐理由: AlayaWorld 把生成世界从 demo 变成了可交互的全栈开源框架,放出了完整 pipeline,对做游戏和具身智能的团队来说是一套可以立刻跑起来的工具链,值得落地尝试。

arXiv 具身智能 开源/仓库 视频
AI HOT ·

Nemotron-Labs-Diffusion:统一自回归、扩散与自我推测解码的三模式语言模型

10:18 HuggingFace Daily Papers(社区热门论文) 精选 72 Nemotron-Labs-Diffusion 是一种三模式语言模型,通过联合自回归(AR)和扩散损失训练,在单一架构中统一了 AR、扩散和自我推测解码。研究显示 AR 与扩散目标互补:扩散增强前瞻规划,AR 提供从左至右的语言先验。自我推测模式下,扩散充当草稿模型、AR 负责验证,其接受率和实际设备效率均优于多 token 预测(MTP)。在最优化采样器下,单次前向传播产出 token 数比自我推测最多高 76.5%。该系列包含 3B、8B、14B 参数的基础、指令和视觉语言模型,在准确率和速度上均超越现有开源 AR 和扩散 LM。例如 8B 模型单次前向解码 token 数是 Qwen3-8B 的 6 倍,在 GB200 GPU 上使用 SGLang 运行 SPEED-Bench 时吞吐量提升 4 倍。 arXiv 多模态 推理 模型发布 推荐理由: NVIDIA 把自回归和扩散塞进同一个模型,吞吐量拉高 4 倍,做实时应用的团队可以开始换架构了。

arXiv 多模态 推理 模型发布
AI HOT ·

蚂蚁集团旗下Robbyant开源LingBot-Vision:1B参数边界中心视觉基础模型,用于密集空间感知

11:24 MarkTechPost(RSS) 精选 71 蚂蚁集团旗下具身智能公司Robbyant开源LingBot-Vision,一套自监督视觉Transformer家族,专为密集空间感知设计。旗舰ViT-g/16参数约1.1B,采用掩膜边界建模训练,将边界作为原生预训练信号。在密集空间任务中,该1B模型匹配或超越参数规模高达7倍的大模型(如7B DINOv3)。模型以Apache-2.0许可证在Hugging Face开源,提供ViT-g、ViT-L(300M)、ViT-B(86M)、ViT-S四个规模。 具身智能 多模态 模型发布 推荐理由: 在视觉基础模型里把边界当作核心信号,这个思路很反常识,1B模型在深度估计上超过7B的DINOv3,做机器人的可以认真看看。

具身智能 多模态 模型发布
AI HOT ·

Pulpie:用于清理网络的Pareto最优模型

09:43 Hacker News 热门(buzzing.cc 中文翻译) 精选 75 Pulpie是一族Pareto最优模型,用于从HTML页面提取主要内容。其最小模型pulpie-orange-small(210M参数)在WebMainBench上取得0.862的ROUGE-5 F1分数,接近600M参数的Dripper(0.864),但成本仅1/20。在NVIDIA L4 GPU上,Pulpie处理速度13.7页/秒,Dripper仅0.68页/秒。清理10亿页HTML,Pulpie成本约$7,900,Dripper需$159,000。模型采用编码器架构,单次前向传播即可标记每个HTML块为内容或模板,已在HuggingFace开源。 Hugging Face 开源生态 数据/训练 模型发布 推荐理由: 做网页清洗的同行该更新工具了,Pulpie 以二十分之一的成本追平 SOTA 质量,而且开箱即用,是今年数据管线里最值得换的组件之一。

Hugging Face 开源生态 数据/训练 模型发布
AI HOT ·

使用来自 @SpaceXAI 的 Grok 4.5,一旦它上线,无需更改代码。 ~x-ai/grok-latest 始终路由到最新的 Grok。现在指向它(今天为 Grok 4.3),当 4.5 发布时它会自动升级到 4.5。 尝试:https://openrouter.ai/~x-ai/grok-latest

23:55 OpenRouter @ OpenRouter 精选 68 xAI 产品更新 推理 推荐理由: OpenRouter 的 grok-latest 别名让开发者零代码升级到 Grok 4.5,虽然是个小功能,但省掉了版本切换的繁琐,用 Grok 做产品的团队现在就该把端点切过去。 23:35 Runway:News(网页) 精选 58 Runway Dev 发布 Runway 官网以 Cookie 设置页面代替了产品介绍,未提供 Runway Dev 的功能、参数、可用性等任何具体信息。 产品更新 图像生成 多模态 视频 推荐理由: Runway 把视频、图像、音频生成整合成一个统一 API,加上不用客户数据训练的承诺,对需要快速集成 AI 媒体的产品团队来说是省心选择,技术层面虽无新模型,但集成价值明显。 23:25 Replit ⠕ @ Replit 精选 68 本周新功能 🚀 Replit 社区档案--vibe coders 的工作证明。 你的档案,你的展示。获取你的智能体使用和检查点的活跃度图表,外加面向专业用户的 Replit 力量排名。 登录,认领你的档案,挑选你最棒的项目,与朋友分享你的数据。 立即查看 → http://replit.com/community 智能体 产品更新 编码 推荐理由: Replit 给 vibe coders 加上了个人主页和工作证明,用活动图和排名展示 agent 使用,让 AI 编程社区有了社交层,但实质还是功能小更新,对非重度用户意义有限。 23:25 OpenRouter @ OpenRouter 精选 65 新功能:聊天室一键ZDR(零数据保留) 在完全隐私保护下横向对比模型:https://openrouter.ai/chat 产品更新 推荐理由: OpenRouter 聊天室新加了一键 ZDR,对比模型时请求数据不存储,注重隐私的开发者会开心,但毕竟只是个开关,算不上大新闻。 22:33 Mistral AI:News(网页) 精选 70 Robostral Navigate:Mistral AI 首个具身导航模型 Robostral Navigate 是 Mistral AI 首个具身导航模型(8B 参数),仅用单 RGB 摄像头,在 R2R-CE 验证集上取得 76.6%(unseen)和 79.4%(seen)的成功率,超越最佳单摄像头方法 9.7 个百分点,超越使用深度或多摄像头的系统 4.5 个百分点。模型通过 pointing 预测目标坐标并结合强化学习持续改进,全部在模拟中训练(约 40 万轨迹、6000 场景),采用 prefix-caching 实现高效训练。通用适配轮式、腿式和飞行机器人,能适应真实环境中未训练的障碍。 具身智能 多模态 模型发布 推荐理由: Mistr

xAI 产品更新 推理 图像生成 多模态 视频 智能体 编码 具身智能 模型发布 GitHub MCP/工具 开源/仓库 OpenAI 安全/对齐 行业动态 论文/研究 Anthropic 部署/工程 政策/监管 arXiv Hugging Face 开源生态 数据/训练 大佬观点 教程/实践 Meta Microsoft 现象/趋势 Google 评测/基准
AI HOT ·

蚂蚁集团周俊AICon演讲:从Token数量到Token密度,万亿参数模型效率优先

09:10 公众号:蚂蚁百灵(Ling) 精选 64 蚂蚁集团副总裁周俊在AICon演讲指出,万亿参数模型每运行15分钟算力成本约等于一辆特斯拉,效率是智能体时代最需解决的问题。团队提出从“更多Token”转向“更高Token密度”策略,采用7份Lightning Attention加1份MLA的混合线性注意力架构,使256K长上下文成本从指数级降至线性级,算力更多用于思考。通过Kpop算法区分工具调用与自然语言Token,结合思维链剪枝、自蒸馏等,Token输出减少约4倍而能力不降。在LongBench、BFCL等基准上提升显著,千亿参数模型在Agent任务中超越部分更大模型;小模型flash吞吐达2.4倍,五轮对话成本下降10倍以上。 智能体 大佬观点 推理 推荐理由: 蚂蚁百灵副总裁周俊这次分享,把大模型效率问题从零散优化推到了架构、训练、智能体协同设计的范式层面,7+1 混合注意力方案和 Kpop 算法对做模型的人是实质参考。

智能体 大佬观点 推理
AI HOT ·

Hugging Face Storage 成为 SkyPilot 一级后端:零出站费跨云存储

03:18 Hugging Face:Blog(RSS) 精选 67 Hugging Face Storage 现为 SkyPilot 的一级后端。用户通过 hf:// URL 和现有 HFTOKEN 即可将 Hugging Face Bucket(读写)或模型/数据集/Space 仓库(只读)挂载到 SkyPilot 任务中,支持 MOUNT(FUSE 懒加载)或 COPY 模式。SkyPilot 可将任务调度到 20+ 云、Kubernetes、Slurm 及本地集群的任意可用 GPU 上。Hugging Face 不收取出站及 CDN 费用,故跨云读取数据无额外成本。存储价格 $12–18/TB/月,低于 AWS S3 加出站费。Bucket 基于 Xet,增量检查点和模型变体仅存储和传输改动部分。 Hugging Face 产品更新 开源生态 部署/工程 推荐理由: Hugging Face 和 SkyPilot 把存储和算力真正解耦了,跨云读取模型零出口费,用过 SkyPilot 的团队可以立刻省下那块 egress 账单。

Hugging Face 产品更新 开源生态 部署/工程
AI HOT ·

Krea 2 的身份保留功能已发布,配套模型和 ComfyUI 节点也已上线。🔥

04:51 Krea @ krea_ai 精选 66 Brie Wensleydale🧀🐭 : Now this is the type of ID preservation type functionality that I crave. I'm gonna be traveling tomorrow, so I won't be ... 图像生成 开源/仓库 开源生态 推荐理由: Krea 2的ID保持终于被社区做出来了,附带ComfyUI节点,想稳定控制角色一致性的人可以立刻用起来。

图像生成 开源/仓库 开源生态
AI HOT ·

Rowboat:开源、本地优先的桌面AI助手

06:11 Hacker News:AI 热帖 精选 73 Rowboat 是一个开源、本地优先的桌面 AI 助手,将邮件、会议、Slack 等数据索引为 Obsidian 风格的知识图谱,提供持久上下文记忆。内置邮件客户端、浏览器、会议记录器、代码模式(可调用 Claude Code 或 Codex 代理),并支持按事件或定时运行的背景代理。用户可通过 MCP 协议接入 Exa 搜索、GitHub 等外部工具。所有数据以纯 Markdown 格式本地存储,无供应商锁定,支持 Ollama/LM Studio 本地模型或使用 API 密钥的托管模型。 智能体 MCP/工具 产品更新 推荐理由: Rowboat 把整个工作台搬到了本地,知识图谱长期记忆的设计比大多数『聊天+搜索』的 AI 桌面工具更深,如果你受够了云端的隐私焦虑和冷启动,这个开源项目值得关注。

智能体 MCP/工具 产品更新
AI HOT ·

《人生设计课》Prompt实测:用Claude设计人生的四个阶段

08:20 公众号:数字生命卡兹克 精选 75 作者将斯坦福《人生设计课》理论体系制成Prompt,通过Claude逐步提问、追问和分析。Prompt融合设计思维、心流理论和积极心理学,分为看清现状、找到指南针、寻路、制定奥德赛计划四阶段,主线问题控制在6到9个。AI引导用户给健康、工作、娱乐、爱打分,区分重力问题与可设计的真问题,生成三个五年人生版本,最终输出8000至12000字的《个人人生设计蓝图》。作者实测效果超预期。 Anthropic 教程/实践 推荐理由: 卡兹克把《人生设计课》的整套方法论炼成了一个追问型Prompt,它不替你规划人生,但能用一连串苏格拉底式逼问把你心里一直没厘清的线头拽出来。比心理咨询轻量,比鸡汤硬核,想用AI认真盘一盘自己方向的人值得花半小时玩一遍。

Anthropic 教程/实践
AI HOT ·

微软为降成本在Copilot中用自研MAI模型替换OpenAI和Anthropic模型

03:07 The Decoder:AI News(RSS) 精选 71 微软正用自研MAI模型替换Copilot产品中的OpenAI和Anthropic模型以降低支出。MAI模型已在Excel和Outlook中每周处理数万次请求,但占比仍小。Build大会上发布推理模型MAI-Thinking 1,声称编码媲美Sonnet 4.6和Opus 4.6,但基准测试大幅落后,仅与DeepSeek V3.2相当。AI负责人承认目标是削减并消除对Anthropic的支出。CEO暗示未来可能按用量计费,MAI为默认,第三方模型付费附加。微软称MAI使用干净商业许可数据,实际基于Common Crawl。 Microsoft 现象/趋势 行业动态 推荐理由: 微软正悄悄把Copilot里的OpenAI和Anthropic模型换成自家MAI,用户可能要为更弱的AI付同样的钱。这对所有依赖Copilot的团队是个警告,现在就该重新评估工作流。

Microsoft 现象/趋势 行业动态
AI HOT ·

YC CEO声称每日用AI部署3.7万行代码,开发者审查发现前端代码大量臃肿低效

02:12 Hacker News 热门(buzzing.cc 中文翻译) 精选 73 Y Combinator CEO Garry Tan在X上宣称,他与AI编码代理每天在五个项目中部署37000行代码,并保持连续72天发布记录。波兰开发者Gregorein深入审查Tan网站前端代码,发现大量臃肿与低效问题:页面加载169次请求、总计6.42MB数据(对比Hacker News仅7次12KB);包含28个测试文件、78个未使用的JavaScript控制器、八种格式Logo(含空文件)、未压缩的旧PNG等。Gregorein指出,AI虽能快速生成代码,但质量仍应优先于数量。 智能体 现象/趋势 编码 推荐理由: Garry Tan 日行三万七千行的神话被代码审查拆穿,这不是节奏问题,是 AI 编码‘有量无质’的典型病征。认为 AI 编码能光速开发的人该冷静一下了。

智能体 现象/趋势 编码
AI HOT ·

短视频概览功能已正式在移动端和网页端面向所有英语用户全面上线! 一如既往,您的意见对我们至关重要。请在下方分享您最喜欢的作品,并告诉我们接下来需要添加哪些功能!❤️

01:50 NotebookLM @ NotebookLM 精选 67 Google 产品更新 多模态 推荐理由: NotebookLM 把 Audio Overviews 升级成短视频,谷歌想让笔记工具自己「讲」出内容,思路比功能本身更值得关注,但目前只是锦上添花。

Google 产品更新 多模态