AI HOT
·
2026-07-08 01:14
14:50 Elon Musk @ elonmusk 精选 72 tetsuo : Update your Grok app! 15 Second Imagine videos now available and the quality is incredible. xAI 产品更新 视频 推荐理由: Grok Imagine 加入视频生成,xAI 在多模态上再进一步。15 秒视频质量据说惊艳,但推文缺细节,想试的可直接更新 App。
xAI
产品更新
视频
AI HOT
·
2026-07-08 01:14
15:10 Hacker News 热门(buzzing.cc 中文翻译) 精选 70 2019年,Adebayo Alonge因服务器远在美国致RxScanner单次扫描超5分钟,工程师2小时内将AI模型缩小至可在Android手机本地运行,此后RxScanner能在无宽带、缺电地区验药。小AI模型参数通常至多几十亿,可在手机或Raspberry Pi上运行,功耗仅数瓦。类似案例包括印度腰果病害检测无人机、乌拉圭蚂蚁入侵识别、疟蚊检测及巴西基于Arduino的心电图设备。世界银行报告显示,全球最穷国家仅0.7%互联网用户用过ChatGPT,发达国家达四分之一;行长认为小AI是为缺乏算力与电力的地区提供生命救助服务的关键。 现象/趋势 端侧 推荐理由: 这篇IEEE特写把AI的镜头从硅谷转向了没有宽带的地方,用假药检测、无人机农场等案例讲清楚了一个被忽视的真相:对多数世界而言,能跑在手机上的小型模型才是真正的AI。
现象/趋势
端侧
AI HOT
·
2026-07-08 01:14
17:20 TechCrunch:AI(RSS) 精选 70 美国自动驾驶车辆公司 Forterra 宣布,过去九个月已向乌克兰战场部署超过 100 辆基于 Polaris ATV 的 Lancer 自主地面车辆。这些汽油动力车辆可携带 750 公斤货物,加装 Starlink 天线实现远程操控,已执行 1100 多次任务,行驶 2500 英里,运送 777,440 磅物资,完成 52 次伤员撤离。目前车辆主要采用远程操作,因自主系统尚无法实时识别并应对敌方威胁。Forterra 已融资超 5 亿美元,正将经典机器人方法与生成式 AI 结合以提升自主能力。美军专家认为地面自主技术已具实战价值。 具身智能 行业动态 部署/工程 推荐理由: 这是首次有美国自主地面车辆在实战中长期部署的详细报道,做军事 AI 的人可以认真读,但对多数从业者来说只是猎奇。
具身智能
行业动态
部署/工程
AI HOT
·
2026-07-08 00:00
08:17 Google Gemini @ GeminiApp 精选 69 Google 产品更新 搜索 推荐理由: Gemini Spark 加入实时话题跟踪和事件响应,相当于给 AI 助手装上了耳朵。做信息监测和体育内容自动化的可以直接抄作业。
Google
产品更新
搜索
AI HOT
·
2026-07-08 00:00
08:19 TechCrunch:AI(RSS) 精选 72 云安全公司 Sysdig 记录了首例“智能体勒索软件”攻击 JadePuffer,AI 智能体独立完成入侵、窃取凭证、横向移动、加密超 1,300 条配置记录并撰写赎金信,还能在 31 秒内修复失败登录并以自然语言注释解释推理过程。但 Sysdig 高级威胁研究总监 Michael Clark 澄清,人类仍负责设置攻击基础设施、选择受害目标、提供通过此前入侵获取的数据库凭证。Sysdig 未能识别驱动该智能体的具体模型;AI 智能体在攻击中窃取了 OpenAI、Anthropic、DeepSeek 和 Gemini 的 API 密钥,Clark 表示这些密钥属于“战利品”而非驱动模型。微软研究员 Geoff McDonald 推测模型为移除安全训练的开源权重模型。 智能体 行业动态 推荐理由: 号称首例AI全自主勒索攻击其实仍需人类‘选目标’,关键澄清浇灭了一些恐慌,但代理化攻击的廉价复制性仍是真难题。
智能体
行业动态
AI HOT
·
2026-07-08 00:00
11:48 字节 Seed:Research Feed(网页内嵌数据) 精选 55 字节 Seed 发布超长程评测集 EdgeBench,含 134 个真实任务(覆盖六大领域),每个任务支持 Agent 持续工作至少 12 小时。基于约 38000 小时交互数据,发现 Agent 环境学习表现遵循高精度 log-sigmoid 曲线(平均 R²=0.998);自 2025 年 9 月至 2026 年 5 月,前沿模型学习速度约每三个月翻一倍。EdgeBench 已开源 51 个任务及完整评测框架。 智能体 数据/训练 论文/研究 关联讨论 1 条 字节 Seed:Research Papers(网页内嵌数据) 推荐理由: 字节此基准首次量化了长程环境学习规律,log-sigmoid 曲线拟合精度极高,学习速度每三个月翻倍的趋势对 Agent 研究有方向性意义,但尚属学术探索。
智能体
数据/训练
论文/研究
AI HOT
·
2026-07-08 00:00
12:19 蚂蚁 inclusionAI:GitHub 新仓库 精选 72 蚂蚁 inclusionAI 开源的多智能体协作基础设施 Avernet V0.1 正式发布。该项目聚焦 Agent 注册、发现、邀请等协作层问题,不替代 Agent 自身推理能力。通过群组、会话和共享上下文构建多方共识,支持自由聊天、领导-跟随等协作模式,并利用协作反馈形成观察、评估到复用、优化的自动进化闭环。支持 OpenClaw、自定义 Agent、第三方 Agent 引擎及现有 bot 平台等异构生态,提供 Docker 与本地两种快速部署路径。 智能体 开源/仓库 部署/工程 推荐理由: 蚂蚁开源的Avernet把多agent协作的发现、连接、共识和可追踪执行做成基础设施,做agent应用的团队可以拿来即用,虽早期但方向对。
智能体
开源/仓库
部署/工程
AI HOT
·
2026-07-08 00:00
12:50 Ethan Mollick @ emollick 精选 75 General Intuition : Introducing MIRA. A playable, multiplayer world model. A dream of Rocket League. Trained on 10k hours of data collected ... 产品更新 开源生态 视频 推荐理由: 世界模型终于跑通了实时多人游戏,20 FPS 的 Rocket League 梦境能直接上手玩,代码和报告都开源,做游戏和交互的值得试试。
产品更新
开源生态
视频
AI HOT
·
2026-07-07 22:40
02:49 TechCrunch:AI(RSS) 精选 78 2026年以来,多家科技公司以AI为由大规模裁员。Microsoft裁减约4800岗位(2.1%),Oracle裁减21000人(13%),GitLab裁减350人(14%)以投资AI基础设施,Google Cloud持续裁减员工(外界估计1500-3000+工程师),Intuit裁减3000人(17%),Meta裁减8000人(10%)并转岗7000人至AI,Cisco裁减近4000人(5%),Cloudflare裁减1100人(20%),GM裁减500-600 IT岗位,Coinbase裁减700人(14%)。据Layoffs.fyi统计,2026年累计已裁约12万个技术岗位。 Google Microsoft 行业动态 推荐理由: 这不是简单的裁员名单,而是AI正在改写工作方式的证据链,每一条都让“AI不会导致失业”的安慰显得苍白。职场人该面对现实了。
Google
Microsoft
行业动态
AI HOT
·
2026-07-07 22:40
03:13 ClaudeDevs @ ClaudeDevs 精选 70 Claude Code 团队将“设计循环”定义为智能体重复工作直到满足停止条件,划分四种类型:1)回合循环——手动提示触发,Claude 自判完成,适合短任务,可通过 SKILL.md 提升验证;2)目标循环—— /goal 手动触发,达成目标或达最大轮数停止,需确定性完成标准(如测试通过数);3)时间循环—— /loop 和 /schedule 按间隔触发,适合同步消息、检查 PR 等重复任务,可云端运行;4)主动循环——事件或计划触发,无人实时参与,每个子任务独立退出。建议从最简单方案开始,选择性使用复杂循环。 智能体 Anthropic 教程/实践 编码 关联讨论 1 条 X:邵猛 (@shao__meng) 推荐理由: Claude Code 团队官方的循环设计指南,把 `/goal`、`/loop` 这些原语讲得很清楚,想从单次提示转向自主代理工作流的开发者可以直接照着搭。
智能体
Anthropic
教程/实践
编码
AI HOT
·
2026-07-07 22:40
06:43 xAI:News(网页) 精选 68 xAI 发布 21 个新旗舰语音,加入原有的 5 个语音。所有新语音均支持多语言,已在实时 Voice Agent API、Text to Speech API 及新推出的 Grok Voice Agent Builder 中可用。每个语音针对客服、角色、解说、广告、教育等场景定制,支持通过 [pause] 等语音标签控制表达。原始 5 个语音(Ara、Eve、Leo、Rex、Sal)经重训练后,节奏、措辞和重音的自然度提升。所有语音原生支持 Grok Voice 的 25 种以上语言。 xAI 产品更新 语音 推荐理由: Grok 一口气放出21种多语言语音,对做语音 agent 的团队是个弹药库更新,但影响的半径基本止于 xAI 生态内部。
xAI
产品更新
语音
AI HOT
·
2026-07-07 22:40
07:09 Claude Code:GitHub Releases(RSS) 精选 67 Claude Code v2.1.202 在 /config 中新增“Dynamic workflow size”设置,可控制动态工作流的 agent 数量规模(小/中/大),作为指导性建议而非硬性上限。工作流派生的 agent 现在会发射 workflow.run_id 和 workflow.name 的 OpenTelemetry 属性。修复了 mTLS 握手失败、远程控制发送命令失败、移动端发送无说明图片被静默丢弃、语音听写在麦克风故障时无限重试(改为暂停输入)、重载已有技能导致重复指令等问题。改进了工作流 agent 列表布局,MCP 错误消息更清晰。 /review <pr> 恢复为快速单次审查,多 agent 审查请使用 /code-review 。 智能体 Anthropic 产品更新 推荐理由: 这波修复让远程控制和工作流终于稳了,以前被 silent drop 的文件和无线重试的 bug 都治好了,Claude Code 重度用户升级后体验会好一个档次。
智能体
Anthropic
产品更新
AI HOT
·
2026-07-07 22:40
07:10 Hacker News 热门(buzzing.cc 中文翻译) 精选 75 OfficeCLI是全球首个专为AI智能体设计的开源Office套件,以单二进制文件运行,无需安装Office或任何依赖。它内置HTML渲染引擎,可将.docx/.xlsx/.pptx转换为HTML或PNG,形成“渲染→查看→修复”的视觉闭环,使AI代理能自主创建、读取和修改Word、Excel、PowerPoint文档。支持公式、图表、条件格式、RTL布局、修订追踪、表格、数据透视表等复杂功能。提供CLI命令和基于自然语言的桌面应用AionUi,并可一键安装到Claude Code、Cursor、Windsurf、GitHub Copilot等AI编码工具中。 智能体 MCP/工具 开源/仓库 推荐理由: 我觉得这个工具把 AI 代理操作 Office 的最后一公里走通了,特别是内置渲染引擎让代理能‘看见’文档布局,而不是盲猜 DOM,对自动化报表和批处理文档的团队很有价值。
智能体
MCP/工具
开源/仓库
AI HOT
·
2026-07-07 21:30
02:09 Apple Machine Learning Research(RSS) 精选 56 标注分歧可源于操作失败、政策模糊或价值多元。Annotator Policy Models(APMs)是一种可解释模型,仅从标注行为学习标注者内在的安全策略,无需额外负担。验证表明模型准确率超过80%,能忠实预测反事实编辑并恢复已知差异。将APMs应用于LLM和人类标注者,可揭示不同标注者对安全指令解释的差异(政策模糊)以及不同人口群体在安全优先级上的系统性差异(价值多元),支持更具针对性、透明和包容的安全策略设计。 GitHub 安全/对齐 论文/研究 推荐理由: 我觉得 APMs 把标注分歧的根源从「猜」变成了「看」,对安全团队澄清政策模糊和价值观差异挺有实操价值,代码也给了,做对齐的可以上手试。
GitHub
安全/对齐
论文/研究
AI HOT
·
2026-07-07 21:30
02:09 OpenClaw🦞 @ openclaw 精选 65 智能体 Hugging Face MCP/工具 产品更新 推荐理由: OpenClaw 把本地工具调用代理做成了 HuggingFace 的一键部署,隐私敏感场景下的 Agent 开发终于有了低门槛方案,做本地自动化的值得一试。
智能体
Hugging Face
MCP/工具
产品更新
AI HOT
·
2026-07-07 20:20
01:37 Tomer Tunguz 博客(VC 分析) 精选 56 《经济学人》以世界价值观调查评测 25 个前沿 AI 模型。实验室来源对世界观的预测力弱于训练与对齐选择:Gemini 与 Qwen 立场接近,GPT-4o 与 DeepSeek R1 近乎相同,而 DeepSeek R1 与 DeepSeek V4 Flash 则截然不同。模型的世界观在代码生成中不可见,但在商业分析、预测、招聘与政策工作中是活跃的输入变量。 大佬观点 安全/对齐 推荐理由: 这个发现让我重新思考选模型思路,出身不重要,训练方法才决定价值观,做产品的别光看benchmark,得在意模型‘性格’。
大佬观点
安全/对齐
AI HOT
·
2026-07-07 16:52
01:18 TechCrunch:AI(RSS) 精选 75 Google 于 6 月通过客户邮件低调更新了搜索服务隐私设置,新增“搜索服务历史”和“个性化推荐”两项开关,默认将用户上传的图片、文件、音频和视频录制等媒体数据保存并用于训练 AI 模型。该更新适用于搜索、地图、购物、航班、酒店、翻译、新闻等服务。用户可通过取消勾选“保存媒体”框来退出,同时可设置数据自动删除周期(3/18/36 个月)。此前独立的网络与应用活动设置不再影响搜索服务数据保留。Meta 等其他公司也在大规模收集用户媒体数据用于 AI 训练。 Google 教程/实践 数据/训练 推荐理由: Google 悄悄把用户上传的媒体数据默认用于训练 AI,这篇教程是及时且实用的避坑指南,花两分钟改设置就能保护隐私,所有 Google 用户都该看看。
Google
教程/实践
数据/训练
AI HOT
·
2026-07-07 14:21
22:08 向阳乔木 @ vista8 精选 75 作者与姚老师合作开发中转站评测网站tokhub.me,通过真实充值调用API进行模型监控,区别于单纯速度评测。代码完全开源,支持一键Docker部署,还可作为公司内部Token和网关管理系统,省去繁杂的API Key和Base URL管理。开源代码见Github评论区。 GitHub 开源/仓库 开源生态 推荐理由: 向阳乔木开源的这个中转站监测工具,直接解决了我选 API 服务时最头疼的稳定性问题,自掏腰包用真实调用做监控,比纯速度评测有意义得多。 20:07 Hacker News 热门(buzzing.cc 中文翻译) 精选 77 AI颠覆初级程序员就业市场:斯坦福数据揭示年轻开发者就业锐减19% 斯坦福数字经济实验室基于ADP薪资数据发现,美国22-25岁软件开发人员就业较2022年峰值下降19%,而41-49岁增长14%。入门级岗位招聘减少28%,计算机科学毕业生失业率达6.1%,高于文科专业。核心推手是2024-2025年兴起的智能体编程(Agentic programming)。总程序员就业增长4.4%,但全部来自年长群体。GitHub一年新增3600万账号,80%新用户一周内使用Copilot。编程工作未消失,但“初级程序员”头衔正在消亡。 GitHub 现象/趋势 编码 推荐理由: 用斯坦福、BLS、GitHub和App Store的数据把“初级程序员被替代”讲成了确凿事实,更关键是指出编程正从职业变成每个人的基本能力——对所有写代码的人是必读。 18:03 IT之家(RSS) 精选 73 Meta 被曝让外包人员伪装未成年人,诱导竞争对手 AI 聊敏感话题 据《连线》报道,Meta 通过外包公司 Covalen 开展代号“Cannes”的项目,让数百名外包人员伪装成未成年人,向 OpenAI ChatGPT、谷歌 Gemini 及 Character.AI 发送涉及自杀、自残、进食障碍等高风险提示词,以测试竞品聊天机器人的安全拦截机制。项目持续至 4 月 21 日,单轮测试发送超 4.5 万个提示词,外包人员创建 18 岁以下虚假账号并上传药片、刀具等图片。Meta 称这是常规安全测试,且不会用竞品测试数据训练自家模型。 Meta 安全/对齐 推荐理由: Meta用外包人员伪装未成年人测试竞品AI,这事撕开了AI安全测试的灰色地带,暴露了聊天机器人面对极端儿童话题时的脆弱性,比任何安全白皮书都更有冲击力。 17:06 Hacker News 热门(buzzing.cc 中文翻译) 精选 75 AT&T 1956年专利法令:公共天才的私有化 1956年1月24日,全球最大私营公司AT&T签署专利法令,将其7,820项未过期专利免费授权给所有美国企业,并承诺未来专利按“合理费率”许可。作为
GitHub
开源/仓库
开源生态
现象/趋势
编码
Meta
安全/对齐
政策/监管
数据/训练
具身智能
行业动态
模型发布
语音
产品更新
智能体
Anthropic
教程/实践
推理
部署/工程
图像生成
AI HOT
·
2026-07-07 14:21
01:11 LMSYS:Blog(Chatbot Arena 团队) 精选 63 SGLang 团队将 DSpark 推测解码算法集成到开源推理引擎中。该算法采用半自回归块起草器一次生成一组 token,并利用置信度头与顺序温度缩放(STS)为每个请求动态分配可变验证长度,从而在高负载下裁剪无效验证成本。SGLang 支持密集模型(如 Qwen3)和稀疏模型(如 DeepSeek-V4),通过全 CUDA 图处理不规则的每请求验证长度。提供三种验证模式: static (全长)、 compact (生产路径)和 cap-accept (接受上限测量)。还引入了零开销调度、基于离线成本表的在线调度器、融合 Triton 核等优化。在 H200 上使用 DeepSeek-V4-Flash 的测试中,DSpark 在整个并发扫描范围内比 MTP 和非推测基线实现了更优的吞吐量-延迟权衡。 产品更新 推理 部署/工程 推荐理由: DSpark 这版推测解码的工程落地比论文本身更有看头——SGLang 用 ragged CUDA Graph 和动态调度把 trimm 掉的计算按字节级回收,383 tok/s 的单请求速度对部署方是即时可用的性能增益。
产品更新
推理
部署/工程
AI HOT
·
2026-07-07 13:13
20:07 Hacker News 热门(buzzing.cc 中文翻译) 精选 77 斯坦福数字经济实验室基于ADP薪资数据发现,美国22-25岁软件开发人员就业较2022年峰值下降19%,而41-49岁增长14%。入门级岗位招聘减少28%,计算机科学毕业生失业率达6.1%,高于文科专业。核心推手是2024-2025年兴起的智能体编程(Agentic programming)。总程序员就业增长4.4%,但全部来自年长群体。GitHub一年新增3600万账号,80%新用户一周内使用Copilot。编程工作未消失,但“初级程序员”头衔正在消亡。 GitHub 现象/趋势 编码 推荐理由: 用斯坦福、BLS、GitHub和App Store的数据把“初级程序员被替代”讲成了确凿事实,更关键是指出编程正从职业变成每个人的基本能力——对所有写代码的人是必读。
GitHub
现象/趋势
编码