AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

在网络不稳定的地区,小型AI模型正逐渐普及

15:10 Hacker News 热门(buzzing.cc 中文翻译) 精选 70 2019年,Adebayo Alonge因服务器远在美国致RxScanner单次扫描超5分钟,工程师2小时内将AI模型缩小至可在Android手机本地运行,此后RxScanner能在无宽带、缺电地区验药。小AI模型参数通常至多几十亿,可在手机或Raspberry Pi上运行,功耗仅数瓦。类似案例包括印度腰果病害检测无人机、乌拉圭蚂蚁入侵识别、疟蚊检测及巴西基于Arduino的心电图设备。世界银行报告显示,全球最穷国家仅0.7%互联网用户用过ChatGPT,发达国家达四分之一;行长认为小AI是为缺乏算力与电力的地区提供生命救助服务的关键。 现象/趋势 端侧 推荐理由: 这篇IEEE特写把AI的镜头从硅谷转向了没有宽带的地方,用假药检测、无人机农场等案例讲清楚了一个被忽视的真相:对多数世界而言,能跑在手机上的小型模型才是真正的AI。

现象/趋势 端侧
AI HOT ·

美国首批自主地面车辆在乌克兰参战

17:20 TechCrunch:AI(RSS) 精选 70 美国自动驾驶车辆公司 Forterra 宣布,过去九个月已向乌克兰战场部署超过 100 辆基于 Polaris ATV 的 Lancer 自主地面车辆。这些汽油动力车辆可携带 750 公斤货物,加装 Starlink 天线实现远程操控,已执行 1100 多次任务,行驶 2500 英里,运送 777,440 磅物资,完成 52 次伤员撤离。目前车辆主要采用远程操作,因自主系统尚无法实时识别并应对敌方威胁。Forterra 已融资超 5 亿美元,正将经典机器人方法与生成式 AI 结合以提升自主能力。美军专家认为地面自主技术已具实战价值。 具身智能 行业动态 部署/工程 推荐理由: 这是首次有美国自主地面车辆在实战中长期部署的详细报道,做军事 AI 的人可以认真读,但对多数从业者来说只是猎奇。

具身智能 行业动态 部署/工程
AI HOT ·

Sysdig 澄清首例"智能体勒索软件"JadePuffer:AI 执行攻击但人类仍负责设置与选目标

08:19 TechCrunch:AI(RSS) 精选 72 云安全公司 Sysdig 记录了首例“智能体勒索软件”攻击 JadePuffer,AI 智能体独立完成入侵、窃取凭证、横向移动、加密超 1,300 条配置记录并撰写赎金信,还能在 31 秒内修复失败登录并以自然语言注释解释推理过程。但 Sysdig 高级威胁研究总监 Michael Clark 澄清,人类仍负责设置攻击基础设施、选择受害目标、提供通过此前入侵获取的数据库凭证。Sysdig 未能识别驱动该智能体的具体模型;AI 智能体在攻击中窃取了 OpenAI、Anthropic、DeepSeek 和 Gemini 的 API 密钥,Clark 表示这些密钥属于“战利品”而非驱动模型。微软研究员 Geoff McDonald 推测模型为移除安全训练的开源权重模型。 智能体 行业动态 推荐理由: 号称首例AI全自主勒索攻击其实仍需人类‘选目标’,关键澄清浇灭了一些恐慌,但代理化攻击的廉价复制性仍是真难题。

智能体 行业动态
AI HOT ·

字节 Seed 发布 EdgeBench:衡量真实世界环境学习,发现新 Scaling Law

11:48 字节 Seed:Research Feed(网页内嵌数据) 精选 55 字节 Seed 发布超长程评测集 EdgeBench,含 134 个真实任务(覆盖六大领域),每个任务支持 Agent 持续工作至少 12 小时。基于约 38000 小时交互数据,发现 Agent 环境学习表现遵循高精度 log-sigmoid 曲线(平均 R²=0.998);自 2025 年 9 月至 2026 年 5 月,前沿模型学习速度约每三个月翻一倍。EdgeBench 已开源 51 个任务及完整评测框架。 智能体 数据/训练 论文/研究 关联讨论 1 条 字节 Seed:Research Papers(网页内嵌数据) 推荐理由: 字节此基准首次量化了长程环境学习规律,log-sigmoid 曲线拟合精度极高,学习速度每三个月翻倍的趋势对 Agent 研究有方向性意义,但尚属学术探索。

智能体 数据/训练 论文/研究
AI HOT ·

蚂蚁 inclusionAI 开源多智能体协作基础设施 Avernet V0.1

12:19 蚂蚁 inclusionAI:GitHub 新仓库 精选 72 蚂蚁 inclusionAI 开源的多智能体协作基础设施 Avernet V0.1 正式发布。该项目聚焦 Agent 注册、发现、邀请等协作层问题,不替代 Agent 自身推理能力。通过群组、会话和共享上下文构建多方共识,支持自由聊天、领导-跟随等协作模式,并利用协作反馈形成观察、评估到复用、优化的自动进化闭环。支持 OpenClaw、自定义 Agent、第三方 Agent 引擎及现有 bot 平台等异构生态,提供 Docker 与本地两种快速部署路径。 智能体 开源/仓库 部署/工程 推荐理由: 蚂蚁开源的Avernet把多agent协作的发现、连接、共识和可追踪执行做成基础设施,做agent应用的团队可以拿来即用,虽早期但方向对。

智能体 开源/仓库 部署/工程
AI HOT ·

MIRA是一个可玩、多人的世界模型,被形容为"火箭联盟的梦"。它基于10k小时公开机器人收集的数据训练,学习四玩家游戏动态,根据按键实时生成画面,帧率达20 FPS。模型由General Intuition与Kyutai Labs联合构建,Epic Games提供协作。Ethan Mollick称从最早的扩散DOOM玩过来,多人20 FPS效果出色。演示、技术报告及开源代码已公开,在ICML Booth 111现场展示。

12:50 Ethan Mollick @ emollick 精选 75 General Intuition : Introducing MIRA. A playable, multiplayer world model. A dream of Rocket League. Trained on 10k hours of data collected ... 产品更新 开源生态 视频 推荐理由: 世界模型终于跑通了实时多人游戏,20 FPS 的 Rocket League 梦境能直接上手玩,代码和报告都开源,做游戏和交互的值得试试。

产品更新 开源生态 视频
AI HOT ·

2026年科技公司AI裁员名单:Microsoft、Oracle、GitLab等十家公司裁减数千岗位

02:49 TechCrunch:AI(RSS) 精选 78 2026年以来,多家科技公司以AI为由大规模裁员。Microsoft裁减约4800岗位(2.1%),Oracle裁减21000人(13%),GitLab裁减350人(14%)以投资AI基础设施,Google Cloud持续裁减员工(外界估计1500-3000+工程师),Intuit裁减3000人(17%),Meta裁减8000人(10%)并转岗7000人至AI,Cisco裁减近4000人(5%),Cloudflare裁减1100人(20%),GM裁减500-600 IT岗位,Coinbase裁减700人(14%)。据Layoffs.fyi统计,2026年累计已裁约12万个技术岗位。 Google Microsoft 行业动态 推荐理由: 这不是简单的裁员名单,而是AI正在改写工作方式的证据链,每一条都让“AI不会导致失业”的安慰显得苍白。职场人该面对现实了。

Google Microsoft 行业动态
AI HOT ·

Claude Code 团队详解四种智能体循环类型

03:13 ClaudeDevs @ ClaudeDevs 精选 70 Claude Code 团队将“设计循环”定义为智能体重复工作直到满足停止条件,划分四种类型:1)回合循环——手动提示触发,Claude 自判完成,适合短任务,可通过 SKILL.md 提升验证;2)目标循环—— /goal 手动触发,达成目标或达最大轮数停止,需确定性完成标准(如测试通过数);3)时间循环—— /loop 和 /schedule 按间隔触发,适合同步消息、检查 PR 等重复任务,可云端运行;4)主动循环——事件或计划触发,无人实时参与,每个子任务独立退出。建议从最简单方案开始,选择性使用复杂循环。 智能体 Anthropic 教程/实践 编码 关联讨论 1 条 X:邵猛 (@shao__meng) 推荐理由: Claude Code 团队官方的循环设计指南,把 `/goal`、`/loop` 这些原语讲得很清楚,想从单次提示转向自主代理工作流的开发者可以直接照着搭。

智能体 Anthropic 教程/实践 编码
AI HOT ·

xAI 为 Grok Voice 新增 21 个旗舰语音

06:43 xAI:News(网页) 精选 68 xAI 发布 21 个新旗舰语音,加入原有的 5 个语音。所有新语音均支持多语言,已在实时 Voice Agent API、Text to Speech API 及新推出的 Grok Voice Agent Builder 中可用。每个语音针对客服、角色、解说、广告、教育等场景定制,支持通过 [pause] 等语音标签控制表达。原始 5 个语音(Ara、Eve、Leo、Rex、Sal)经重训练后,节奏、措辞和重音的自然度提升。所有语音原生支持 Grok Voice 的 25 种以上语言。 xAI 产品更新 语音 推荐理由: Grok 一口气放出21种多语言语音,对做语音 agent 的团队是个弹药库更新,但影响的半径基本止于 xAI 生态内部。

xAI 产品更新 语音
AI HOT ·

Claude Code v2.1.202 发布

07:09 Claude Code:GitHub Releases(RSS) 精选 67 Claude Code v2.1.202 在 /config 中新增“Dynamic workflow size”设置,可控制动态工作流的 agent 数量规模(小/中/大),作为指导性建议而非硬性上限。工作流派生的 agent 现在会发射 workflow.run_id 和 workflow.name 的 OpenTelemetry 属性。修复了 mTLS 握手失败、远程控制发送命令失败、移动端发送无说明图片被静默丢弃、语音听写在麦克风故障时无限重试(改为暂停输入)、重载已有技能导致重复指令等问题。改进了工作流 agent 列表布局,MCP 错误消息更清晰。 /review <pr> 恢复为快速单次审查,多 agent 审查请使用 /code-review 。 智能体 Anthropic 产品更新 推荐理由: 这波修复让远程控制和工作流终于稳了,以前被 silent drop 的文件和无线重试的 bug 都治好了,Claude Code 重度用户升级后体验会好一个档次。

智能体 Anthropic 产品更新
AI HOT ·

OfficeCLI:为AI智能体设计的开源Office套件

07:10 Hacker News 热门(buzzing.cc 中文翻译) 精选 75 OfficeCLI是全球首个专为AI智能体设计的开源Office套件,以单二进制文件运行,无需安装Office或任何依赖。它内置HTML渲染引擎,可将.docx/.xlsx/.pptx转换为HTML或PNG,形成“渲染→查看→修复”的视觉闭环,使AI代理能自主创建、读取和修改Word、Excel、PowerPoint文档。支持公式、图表、条件格式、RTL布局、修订追踪、表格、数据透视表等复杂功能。提供CLI命令和基于自然语言的桌面应用AionUi,并可一键安装到Claude Code、Cursor、Windsurf、GitHub Copilot等AI编码工具中。 智能体 MCP/工具 开源/仓库 推荐理由: 我觉得这个工具把 AI 代理操作 Office 的最后一公里走通了,特别是内置渲染引擎让代理能‘看见’文档布局,而不是盲猜 DOM,对自动化报表和批处理文档的团队很有价值。

智能体 MCP/工具 开源/仓库
AI HOT ·

用可解释性理解标注者安全策略

02:09 Apple Machine Learning Research(RSS) 精选 56 标注分歧可源于操作失败、政策模糊或价值多元。Annotator Policy Models(APMs)是一种可解释模型,仅从标注行为学习标注者内在的安全策略,无需额外负担。验证表明模型准确率超过80%,能忠实预测反事实编辑并恢复已知差异。将APMs应用于LLM和人类标注者,可揭示不同标注者对安全指令解释的差异(政策模糊)以及不同人口群体在安全优先级上的系统性差异(价值多元),支持更具针对性、透明和包容的安全策略设计。 GitHub 安全/对齐 论文/研究 推荐理由: 我觉得 APMs 把标注分歧的根源从「猜」变成了「看」,对安全团队澄清政策模糊和价值观差异挺有实操价值,代码也给了,做对齐的可以上手试。

GitHub 安全/对齐 论文/研究
AI HOT ·

OpenClaw 登陆 @huggingface 本地应用 🦞🤝🤗 1. 在 hf 上挑任意 GGUF/MLX 模型 2. 复制 openclaw onboard 设置 3. Voila,你得到一个完全本地的工具调用智能体。无云端、无密钥、无人监控。 让你的 claw 本地化到极致。抵抗是徒劳的 🦞

02:09 OpenClaw🦞 @ openclaw 精选 65 智能体 Hugging Face MCP/工具 产品更新 推荐理由: OpenClaw 把本地工具调用代理做成了 HuggingFace 的一键部署,隐私敏感场景下的 Agent 开发终于有了低门槛方案,做本地自动化的值得一试。

智能体 Hugging Face MCP/工具 产品更新
AI HOT ·

AI 世界观

01:37 Tomer Tunguz 博客(VC 分析) 精选 56 《经济学人》以世界价值观调查评测 25 个前沿 AI 模型。实验室来源对世界观的预测力弱于训练与对齐选择:Gemini 与 Qwen 立场接近,GPT-4o 与 DeepSeek R1 近乎相同,而 DeepSeek R1 与 DeepSeek V4 Flash 则截然不同。模型的世界观在代码生成中不可见,但在商业分析、预测、招聘与政策工作中是活跃的输入变量。 大佬观点 安全/对齐 推荐理由: 这个发现让我重新思考选模型思路,出身不重要,训练方法才决定价值观,做产品的别光看benchmark,得在意模型‘性格’。

大佬观点 安全/对齐
AI HOT ·

Google 更新隐私设置,默认用媒体数据训练 AI,用户可手动退出

01:18 TechCrunch:AI(RSS) 精选 75 Google 于 6 月通过客户邮件低调更新了搜索服务隐私设置,新增“搜索服务历史”和“个性化推荐”两项开关,默认将用户上传的图片、文件、音频和视频录制等媒体数据保存并用于训练 AI 模型。该更新适用于搜索、地图、购物、航班、酒店、翻译、新闻等服务。用户可通过取消勾选“保存媒体”框来退出,同时可设置数据自动删除周期(3/18/36 个月)。此前独立的网络与应用活动设置不再影响搜索服务数据保留。Meta 等其他公司也在大规模收集用户媒体数据用于 AI 训练。 Google 教程/实践 数据/训练 推荐理由: Google 悄悄把用户上传的媒体数据默认用于训练 AI,这篇教程是及时且实用的避坑指南,花两分钟改设置就能保护隐私,所有 Google 用户都该看看。

Google 教程/实践 数据/训练
AI HOT ·

免费开源API中转站监测网站tokhub.me上线

22:08 向阳乔木 @ vista8 精选 75 作者与姚老师合作开发中转站评测网站tokhub.me,通过真实充值调用API进行模型监控,区别于单纯速度评测。代码完全开源,支持一键Docker部署,还可作为公司内部Token和网关管理系统,省去繁杂的API Key和Base URL管理。开源代码见Github评论区。 GitHub 开源/仓库 开源生态 推荐理由: 向阳乔木开源的这个中转站监测工具,直接解决了我选 API 服务时最头疼的稳定性问题,自掏腰包用真实调用做监控,比纯速度评测有意义得多。 20:07 Hacker News 热门(buzzing.cc 中文翻译) 精选 77 AI颠覆初级程序员就业市场:斯坦福数据揭示年轻开发者就业锐减19% 斯坦福数字经济实验室基于ADP薪资数据发现,美国22-25岁软件开发人员就业较2022年峰值下降19%,而41-49岁增长14%。入门级岗位招聘减少28%,计算机科学毕业生失业率达6.1%,高于文科专业。核心推手是2024-2025年兴起的智能体编程(Agentic programming)。总程序员就业增长4.4%,但全部来自年长群体。GitHub一年新增3600万账号,80%新用户一周内使用Copilot。编程工作未消失,但“初级程序员”头衔正在消亡。 GitHub 现象/趋势 编码 推荐理由: 用斯坦福、BLS、GitHub和App Store的数据把“初级程序员被替代”讲成了确凿事实,更关键是指出编程正从职业变成每个人的基本能力——对所有写代码的人是必读。 18:03 IT之家(RSS) 精选 73 Meta 被曝让外包人员伪装未成年人,诱导竞争对手 AI 聊敏感话题 据《连线》报道,Meta 通过外包公司 Covalen 开展代号“Cannes”的项目,让数百名外包人员伪装成未成年人,向 OpenAI ChatGPT、谷歌 Gemini 及 Character.AI 发送涉及自杀、自残、进食障碍等高风险提示词,以测试竞品聊天机器人的安全拦截机制。项目持续至 4 月 21 日,单轮测试发送超 4.5 万个提示词,外包人员创建 18 岁以下虚假账号并上传药片、刀具等图片。Meta 称这是常规安全测试,且不会用竞品测试数据训练自家模型。 Meta 安全/对齐 推荐理由: Meta用外包人员伪装未成年人测试竞品AI,这事撕开了AI安全测试的灰色地带,暴露了聊天机器人面对极端儿童话题时的脆弱性,比任何安全白皮书都更有冲击力。 17:06 Hacker News 热门(buzzing.cc 中文翻译) 精选 75 AT&T 1956年专利法令:公共天才的私有化 1956年1月24日,全球最大私营公司AT&T签署专利法令,将其7,820项未过期专利免费授权给所有美国企业,并承诺未来专利按“合理费率”许可。作为

GitHub 开源/仓库 开源生态 现象/趋势 编码 Meta 安全/对齐 政策/监管 数据/训练 具身智能 行业动态 模型发布 语音 产品更新 智能体 Anthropic 教程/实践 推理 部署/工程 图像生成
AI HOT ·

SGLang 集成 DSpark 推测解码:置信度驱动的可变长度验证

01:11 LMSYS:Blog(Chatbot Arena 团队) 精选 63 SGLang 团队将 DSpark 推测解码算法集成到开源推理引擎中。该算法采用半自回归块起草器一次生成一组 token,并利用置信度头与顺序温度缩放(STS)为每个请求动态分配可变验证长度,从而在高负载下裁剪无效验证成本。SGLang 支持密集模型(如 Qwen3)和稀疏模型(如 DeepSeek-V4),通过全 CUDA 图处理不规则的每请求验证长度。提供三种验证模式: static (全长)、 compact (生产路径)和 cap-accept (接受上限测量)。还引入了零开销调度、基于离线成本表的在线调度器、融合 Triton 核等优化。在 H200 上使用 DeepSeek-V4-Flash 的测试中,DSpark 在整个并发扫描范围内比 MTP 和非推测基线实现了更优的吞吐量-延迟权衡。 产品更新 推理 部署/工程 推荐理由: DSpark 这版推测解码的工程落地比论文本身更有看头——SGLang 用 ragged CUDA Graph 和动态调度把 trimm 掉的计算按字节级回收,383 tok/s 的单请求速度对部署方是即时可用的性能增益。

产品更新 推理 部署/工程
AI HOT ·

AI颠覆初级程序员就业市场:斯坦福数据揭示年轻开发者就业锐减19%

20:07 Hacker News 热门(buzzing.cc 中文翻译) 精选 77 斯坦福数字经济实验室基于ADP薪资数据发现,美国22-25岁软件开发人员就业较2022年峰值下降19%,而41-49岁增长14%。入门级岗位招聘减少28%,计算机科学毕业生失业率达6.1%,高于文科专业。核心推手是2024-2025年兴起的智能体编程(Agentic programming)。总程序员就业增长4.4%,但全部来自年长群体。GitHub一年新增3600万账号,80%新用户一周内使用Copilot。编程工作未消失,但“初级程序员”头衔正在消亡。 GitHub 现象/趋势 编码 推荐理由: 用斯坦福、BLS、GitHub和App Store的数据把“初级程序员被替代”讲成了确凿事实,更关键是指出编程正从职业变成每个人的基本能力——对所有写代码的人是必读。

GitHub 现象/趋势 编码