AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

AI 版支付宝开放公测,蚂蚁阿宝无需邀请码即可体验

11:03 IT之家(RSS) 精选 80 支付宝阿宝 AI 助手今日正式开放公测,iOS 和安卓用户可在应用商店或支付宝 App 搜索“阿宝”或“蚂蚁阿宝”直接体验。开通后右滑进入新版,以对话方式安排办事,例如说出“查公积金”,阿宝会自动匹配对应小程序和服务入口,用户点击确认即可完成。支付宝承诺所有资金变动与支付环节均需用户本人确认,扫码、转账等功能已预留入口。 智能体 产品更新 推荐理由: 支付宝把 AI 助手从内测推进公测,对话式办事对普通用户来说很直观,省去了多层菜单跳转,虽然支付等敏感环节还是手动确认,但体验上的进步是实在的。

智能体 产品更新
AI HOT ·

据Financial Times和CNBC报道,OpenAI提议向美国政府提供公司5%的股份,按近期8520亿美元估值计算,价值约426亿美元。OpenAI CEO Sam Altman表示,此举是与公众分享AI发展红利的最佳方式。

16:02 🚨 AI News | TestingCatalog @ testingcatalog 精选 75 Andrew Curran : OpenAI is proposing handing over a 5% stake to the Trump administration according to the Financial Times. OpenAI 行业动态 关联讨论 2 条 The Verge:AI(RSS) The Decoder:AI News(RSS) 推荐理由: 当估值8520亿的AI巨头主动将5%股份交给政府,这不再是普通的游说策略,而是可能重新定义公私关系的标志性一步。我觉得这件事的长期影响比任何模型发布都更深远。

OpenAI 行业动态
AI HOT ·

Claude Sonnet 5 发布

今日热点 TOP 4 1 14 信源 · 1天前 2 重新部署 Claude Fable 5 9 信源 · 1天前 3 Claude Code负责人承认留有后门,明日回滚 6 信源 · 1天前 4 OpenAI 拟向特朗普政府提供5%股份,谈判处于早期概念阶段 3 信源 · 5小时前

AI HOT ·

构建AI智能体应优先设计路由

04:35 Tomer Tunguz 博客(VC 分析) 精选 60 构建AI智能体时,应优先设计路由(router)而非选择模型。路由决定每个请求由哪层模型处理。正确路由可使70-80%流量运行在免费本地模型或异步推理上,将AI开销降低90%+。Brian Armstrong指出Coinbase通过更好的默认设置、路由和缓存,在token使用量增长的同时将AI支出减半。路由分三层:技能分类器、路由器、模型选择器。本地计算近乎零成本,异步批量推理比实时推理便宜两个数量级。大多数工作无需秒级返回。同步预测器标记复杂任务,夜间批量评估器更新路由权重。技能蒸馏后,非编码类任务中70-80%智能体流量可由本地模型处理。 大佬观点 部署/工程 推荐理由: Tunguz 把代理架构的设计重心从模型选择拉回到路由上,三层分类器-路由器-选择器的划分很清晰,做 AI 应用的团队可以参考,但其中的新东西不多。

大佬观点 部署/工程
AI HOT ·

Claude Code v2.1.198 发布

04:49 Claude Code:GitHub Releases(RSS) 精选 64 Claude Code v2.1.198 更新。Claude in Chrome 现已全面可用。为 claude agents 新增后台智能体通知(agent_needs_input / agent_completed)。新增 /dataviz 技能,提供图表与仪表盘设计指导及配色验证器。Gateway 增加 AWS 上的 Claude Platform 作为上游提供商。后台智能体在 worktree 中完成代码后自动提交、推送并创建草稿 PR。内置 Explore 智能体现继承主会话模型(上限 opus)。修复网络短暂断开导致响应中断、后台任务卡在“Running”状态、智能体团队队友因 API 错误失败等问题。 智能体 Anthropic 产品更新 编码 推荐理由: 如果你是Claude Code用户,这次更新很实在,Chrome版终于正式可用,背景agent的自动提PR和通知功能能省不少事,/dataviz也能辅助可视化。

智能体 Anthropic 产品更新 编码
AI HOT ·

Emil Kowalski 发布设计工程师 Skills,让 AI 编码工具具备 UI 动画审美

09:07 meng shao @ shao__meng 精选 77 Emil Kowalski 将多年 UI/动画原则沉淀为三个 Skill,使 Codex、Claude Code、Cursor 等 Coding Agents 具备资深设计工程师的审美判断。核心规则:动画必须有理由;每天 100+ 次的高频操作禁用动画;UI 动画控制在 300ms 内;只动画 transform 和 opacity;入口从 scale(0.95)+opacity:0 开始;尊重 prefers-reduced-motion(仅移除位移动画)。review-animations 以严格标准审查动画代码,输出 Before/After/Why 表格。animation-vocabulary 将模糊描述(如“弹一下的效果”)转为专业动效术语。 智能体 GitHub 教程/实践 编码 推荐理由: Emil 把设计工程直觉变成了 AI 编码代理能理解的规则,clone 下来就能让 Claude Code 和 Cursor 产出有品味的动效,做前端的值得立刻试试。

智能体 GitHub 教程/实践 编码
AI HOT ·

昆仑万维天工3.2发布Skywork Tags,AI智能体加入工作群聊

11:00 公众号:昆仑万维(天工) 精选 67 昆仑万维天工3.2发布Skywork Tags,将AI智能体以团队成员身份接入Slack、飞书、钉钉、Discord、Telegram等即时通讯工具。团队可在原有工作群中@Skywork参与讨论,无需切换窗口或迁移数据。共享版Agent持续吸收多样上下文后表现反超精心调教的个人版,团队最终完全改用共享版。Skywork Tags不要求改变工作方式,让AI积累团队上下文并越用越强。 智能体 MCP/工具 产品更新 推荐理由: Skywork Tags 的思路走对了——不逼团队搬家,而是让 AI 进群,内部测试也证明共享 Agent 能远超个人调教,做协作工具的产品人可以借鉴。

智能体 MCP/工具 产品更新
AI HOT ·

Meta 大规模 AI 存储蓝图

01:39 Meta Engineering Blog(RSS) 精选 71 Meta 运营数百 EB 级存储集群,基于 Tectonic 分层存储层构建 BLOB 存储架构,以应对两大挑战:最大化 GPU 利用率与研究迭代速度。传统 BLOB 架构的多层元数据查询可导致数百毫秒延迟,使 GPU 因 I/O 等待停顿。新架构将训练栈逐步迁移到 BLOB 存储接口上,利用闪存提供可预测的低 pMax 延迟,避免单 GPU 慢速拖慢整批任务。同时,统一的数据湖访问支持地理分布 GPU 间的数据高速注入与跨区移动,提升研究效率。 Meta 数据/训练 现象/趋势 部署/工程 推荐理由: Meta的存储架构复盘给出了一条明确路径,从重写元数据到分层缓存,他们把GPU利用率和研究者迭代速度同时提升了一个档次,做AI训练平台的值得细读。

Meta 数据/训练 现象/趋势 部署/工程
AI HOT ·

Google Cloud Workbench Notebooks 扩展发布:在 VS Code 中连接云端 Jupyter 环境

01:17 Google Developers Blog(RSS) 精选 68 Google Cloud Workbench Notebooks 扩展正式上线,开发者可在 VS Code 中直接连接可扩展的云端 Jupyter 环境,无需切换上下文即可利用高性能 Google Cloud 基础设施完成机器学习全流程。该扩展已完全开源,可在 GitHub 和 VS Code Marketplace 获取。 Google 产品更新 部署/工程 推荐理由: 这个扩展把Google Cloud的Jupyter环境直接嵌进VS Code,做ML的开发者不用再切换窗口,工作流会流畅不少,但对行业格局影响不大。

Google 产品更新 部署/工程
AI HOT ·

Meta效仿SpaceX,将过剩AI算力变现

22:01 TechCrunch:AI(RSS) 精选 72 据Bloomberg报道,Meta正计划推出云基础设施业务Meta Compute,对外出售AI计算能力和模型访问权限,直接与AWS、Google Cloud及Azure竞争。Meta已承诺未来几年投入1829亿美元建设AI基础设施,其中俄亥俄州数据中心(规模如曼哈顿)将于今年上线。新业务由基础设施主管Santosh Janardhan、Meta超级智能实验室负责人Daniel Gross和总裁Dina Powell McCormick领导。Meta可能效仿CoreWeave出售裸计算能力,并像AWS一样托管AI模型(包括近期发布的闭源模型Muse Spark)。扎克伯格此前已表示云业务“definitely on the table”。 Meta 行业动态 部署/工程 推荐理由: Meta 进入云市场不只是大厂的新业务,而是算力资产化的信号,未来 AI 竞争可能从模型军备赛转向数据中心所有权,开发者能拿到更便宜的 GPU 但绑定生态的风险也得权衡。

Meta 行业动态 部署/工程
AI HOT ·

Cloudflare 推出全新AI流量管理选项:区分搜索、智能体与训练爬虫,保护广告页面

22:20 Cloudflare Blog 精选 58 Cloudflare 为所有网站所有者提供更精细的AI流量管控选项,取代一刀切的屏蔽方式。用户可轻松区分并管理搜索爬虫、AI智能体爬虫和训练爬虫,同时新增保护广告变现页面的能力。 智能体 产品更新 搜索 关联讨论 1 条 TechCrunch:AI(RSS) 推荐理由: Cloudflare 把 AI 流量管理拆成了搜索、Agent 和训练三类,对依赖广告收入的站长是个实用功能,早期控制 bot 访问可能影响 SEO,值得测试。 22:01 TechCrunch:AI(RSS) 精选 72 Meta效仿SpaceX,将过剩AI算力变现 据Bloomberg报道,Meta正计划推出云基础设施业务Meta Compute,对外出售AI计算能力和模型访问权限,直接与AWS、Google Cloud及Azure竞争。Meta已承诺未来几年投入1829亿美元建设AI基础设施,其中俄亥俄州数据中心(规模如曼哈顿)将于今年上线。新业务由基础设施主管Santosh Janardhan、Meta超级智能实验室负责人Daniel Gross和总裁Dina Powell McCormick领导。Meta可能效仿CoreWeave出售裸计算能力,并像AWS一样托管AI模型(包括近期发布的闭源模型Muse Spark)。扎克伯格此前已表示云业务“definitely on the table”。 Meta 行业动态 部署/工程 推荐理由: Meta 进入云市场不只是大厂的新业务,而是算力资产化的信号,未来 AI 竞争可能从模型军备赛转向数据中心所有权,开发者能拿到更便宜的 GPU 但绑定生态的风险也得权衡。 18:10 The Decoder:AI News(RSS) 精选 70 OpenAI论文揭示GPT-5.6三个Pro变体,打破单一顶级策略 OpenAI论文首次列出GPT-5.6的三个Pro变体:Luna Pro、Terra Pro和Sol Pro,取代以往单一Pro模式。在基因组学基准中,Sol Pro通过率31.5%居60个测试模型之首,领先标准Sol(28.7%)和Claude Opus 4.8(16.0%)。Pro相比标准版本提升逐级递减:Luna Pro提升7.1个百分点(16.5%→23.6%),Terra Pro提升5.2(23.3%→28.5%),Sol Pro仅提升2.8(28.7%→31.5%)。Terra Pro(28.5%)几乎与标准Sol(28.7%)持平。论文未披露Pro运行的token用量,也不清楚该分层是否会在ChatGPT中实际推出。 OpenAI 推理 行业动态 推荐理由: 论文意外曝光 GPT-5.6 Pro 将有三个变体,Pro 不再只是一个最强模型,而是让用户按推理需求选版本,这

智能体 产品更新 搜索 Meta 行业动态 部署/工程 OpenAI 推理 开源生态 模型发布 编码 GitHub 教程/实践 Anthropic 安全/对齐 政策/监管 论文/研究 Google 视频 端侧 MCP/工具 图像生成 语音 大佬观点 现象/趋势 多模态
AI HOT ·

推出 ZCode,GLM-5.2 的官方开发环境 - GLM Coding Plan 订阅用户:现可在 ZCode 获得 1.5 倍使用配额 - 支持 BYOK:可与您现有的订阅和 API 配合使用 - 适用于 macOS、Windows 和 Linux 立即下载:http://zcode.z.ai/en

00:07 Z.ai @ Zai_org 精选 67 产品更新 编码 推荐理由: 智谱为 GLM-5.2 推出官方 IDE,1.5 倍配额和自带密钥对已有订阅的人挺实用,但整体只是常规产品完善,算不上行业级事件。

产品更新 编码
AI HOT ·

xAI 发布 Voice Agent Builder 测试版

00:20 xAI:News(网页) 精选 77 xAI 推出 Voice Agent Builder 测试版,这是一个基于 Grok Voice 的无代码平台,可在两分钟内创建生产级语音智能体。它集成电话、知识检索、工具、MCP、Guardrails 及可观测性,支持连接现有 SIP 号码、API 和 WebSocket,采用语音到语音路径。在 τ-voice Bench 上,Grok Voice Think Fast 1.0 得分 67.3%,领先 Gemini 3.1 Flash Live(43.8%)和 GPT Realtime 1.5(35.3%)。定价为每分钟音频 0.05 美元、电话费 0.01 美元,提供 80+ 种语音及声音克隆,每个账户附赠一个免费电话号码。 智能体 MCP/工具 xAI 产品更新 关联讨论 1 条 X:xAI (@xai) 推荐理由: xAI 用 Grok Voice 原生的语音到语音路径,把生产级语音代理的搭建门槛降到了无代码、两分钟,计费也简单,做语音业务的人值得试试。

智能体 MCP/工具 xAI 产品更新
AI HOT ·

NVIDIA 发布 Nemotron-Labs-TwoTower 开放权重扩散语言模型

16:32 MarkTechPost(RSS) 精选 73 NVIDIA 发布 Nemotron-Labs-TwoTower,基于冻结的自回归骨干 Nemotron-3-Nano-30B-A3B 的扩散语言模型。采用双塔架构:上下文塔冻结,降噪器塔训练,通过层对齐交叉注意力和状态播种协作。在 2×H100 上 BF16 评估,保留 98.7% 的 AR 基线质量,生成吞吐量提升 2.42 倍(γ=0.8,块大小 S=16)。降噪器在约 2.1T token 上训练,骨干使用 25T token 预训练。总参数约 60B,每 token 活跃参数约 3B/塔。支持扩散、模拟 AR 和 AR 三种解码模式。 开源生态 推理 模型发布 部署/工程 推荐理由: NVIDIA这个TwoTower把扩散解码接在已有的AR骨干上,几乎无损质量却让吞吐翻倍,并且开源可商用,对批量文本生成的团队是实在的加速工具。

开源生态 推理 模型发布 部署/工程
AI HOT ·

OpenAI论文揭示GPT-5.6三个Pro变体,打破单一顶级策略

18:10 The Decoder:AI News(RSS) 精选 70 OpenAI论文首次列出GPT-5.6的三个Pro变体:Luna Pro、Terra Pro和Sol Pro,取代以往单一Pro模式。在基因组学基准中,Sol Pro通过率31.5%居60个测试模型之首,领先标准Sol(28.7%)和Claude Opus 4.8(16.0%)。Pro相比标准版本提升逐级递减:Luna Pro提升7.1个百分点(16.5%→23.6%),Terra Pro提升5.2(23.3%→28.5%),Sol Pro仅提升2.8(28.7%→31.5%)。Terra Pro(28.5%)几乎与标准Sol(28.7%)持平。论文未披露Pro运行的token用量,也不清楚该分层是否会在ChatGPT中实际推出。 OpenAI 推理 行业动态 推荐理由: 论文意外曝光 GPT-5.6 Pro 将有三个变体,Pro 不再只是一个最强模型,而是让用户按推理需求选版本,这才是匹配 200 美元月费该有的逻辑。

OpenAI 推理 行业动态
AI HOT ·

亚马逊 AWS 砸 10 亿美元,派遣工程师进驻客户公司

15:03 IT之家(RSS) 精选 70 亚马逊 AWS 宣布设立新部门,组建前置驻场工程师团队,先期投入 10 亿美元(约 67.97 亿元人民币)。团队分批派驻客户企业,每批 5-6 组工程师,驻场周期 45 天,协助客户落地人工智能软件与智能体应用。该模式在 Palantir、Salesforce、Anthropic、谷歌云等企业已有先例,领英数据显示 2023 至 2025 年间同类岗位需求增长 42 倍。新部门员工规模将达数千人,首批客户包括 NBA 与理光。 行业动态 部署/工程 推荐理由: AWS 砸 10 亿美元建驻场工程师团队,帮客户 45 天落地 AI 智能体。这不是卖云资源,是卖业务结果,对考虑用 AI 的企业是个信号,巨头开始贴身服务了。

行业动态 部署/工程
AI HOT ·

mattpocockuk 的 /writing-great-skills:编写可预测 AI Skill 的指南

09:33 meng shao @ shao__meng 精选 75 mattpocockuk 的 /writing-great-skills 成为其最常调用的 Skill,指导如何编写稳定可预测的 AI Skill。核心:以过程可预测为目标;区分 model-invoked(自动触发)与 user-invoked(用户调用),description 应作触发器;采用三层信息结构(主步骤、参考、外部文件)实现渐进式披露;每步骤需明确完成标准;拆分 Skill 是为了控制模型注意力;利用 leading word 压缩行为要求。同时诊断五种失败模式:Premature completion、Duplication、Sediment、Sprawl、No-op,并提供 No-op 测试作为判断句子是否有效的标准。 Matt Pocock : /writing-great-skills is quickly becoming my most often-invoked skill It's just really good at writing skills, guys. npx... 智能体 GitHub 教程/实践 推荐理由: Matt Pocock 把写 Skill 从玄学变成了可拆解的工程,其中领先词和完成标准这两个概念,能立刻让你的自定义工具行为更稳定,搞 Agent 的都应该试一下。

智能体 GitHub 教程/实践
AI HOT ·

美团 LongCat-2.0 正式发布:国产算力集群训练的万亿参数大模型

12:00 公众号:龙猫LongCat(美团) 精选 82 美团于6月30日发布新一代万亿参数大模型LongCat-2.0并开源。总参数1.6T,平均激活约48B,原生支持1M超长上下文,在五万卡国产算力集群上完成全流程训练与推理。采用LSA稀疏注意力、零计算专家、ScMoE及MOPD多专家融合(Agent/Reasoning/Interaction三组专家)架构。评测中SWE-bench Pro获59.5,SWE-bench Multilingual获77.3。预览版已通过OpenRouter和longcat.ai开放,月调用量跻身OpenRouter全球前三。 开源生态 推理 模型发布 编码 关联讨论 9 条 X:硅基流动 SiliconFlow (@SiliconFlowAI) X:美团 LongCat (@Meituan_LongCat) Hacker News 热门(buzzing.cc 中文翻译) X:Emad Mostaque (@EMostaque) IT之家(RSS) X:邵猛 (@shao__meng) X:Testing Catalog (@testingcatalog) 公众号:卡尔的AI沃茨 X:Rohan Paul (@rohanpaul_ai) 推荐理由: 国产算力上首个全流程自训的万亿开源模型,1M上下文和动态专家架构直指Agentic Coding场景,OpenRouter调用量已经冲到前三,不是Demo是生产力。

开源生态 推理 模型发布 编码