AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
The Verge:AI(RSS) ·

欧盟裁定 Google 必须向竞争对手开放 Android 和 Search,影响 Gemini 等 AI 服务

欧盟依据《数字市场法案》(DMA)裁定 Google 必须向竞争对手开放 Android 和 Google Search 的关键部分,包括允许第三方 AI 助手和搜索引擎获得更大访问权限。这两项决定可能削弱 Google 对两大核心平台的控制,并为其 AI 工具 Gemini 的未来格局带来深远影响,同时为竞争对手创造新的发展机会。

行业动态
AI HOT ·

Telegram 无服务器架构

23:59 Hacker News 热门(buzzing.cc 中文翻译) 精选 77 Telegram Serverless 允许开发者直接在 Telegram 基础设施上运行 Bot 和 Mini App 的后端代码,无需配置服务器或容器。开发者编写普通 JavaScript 模块,通过 npx tgcloud push 单命令部署,代码在靠近 Bot API 和内建数据库的轻量级 V8 隔离沙箱中执行。 产品更新 教程/实践 部署/工程 推荐理由: Telegram 给机器人开发搭了一套完整的无服务器后端,内置数据库和 CLI,从写代码到部署都在一个文件夹里完成。做 Telegram 机器人的开发者可以彻底扔掉 VPS 和云函数了。 19:05 X.PIN @ thexpin 精选 78 阿里Qwen将集成至Apple Intelligence服务中国用户 阿里巴巴的Qwen模型将被集成到Apple Intelligence中,为中国的iOS、iPadOS、macOS和visionOS用户提供文本与图像理解、内容生成等AI功能。中国网信办已公布包括Apple Intelligence、华为小艺大模型、OPPO AndesGPT在内的七项移动端生成式AI服务备案信息。阿里巴巴董事会主席蔡崇信表示,苹果在选定阿里前曾与多家中国公司洽谈。 政策/监管 端侧 行业动态 另有 5 家信源报道 X:Berry Xia (@berryxia) TechCrunch:AI(RSS) IT之家(RSS) X:小互 (@xiaohu) X:X.PIN (@thexpin) 推荐理由: 苹果选阿里Qwen为中国AI引擎,蔡崇信已确认,网信办也已备案,这事对国内AI厂商的竞争格局影响不小,做国内市场的应该认真看一眼。 16:41 IT之家(RSS) 精选 70 金山办公推出 WPS Comate AI 办公客户端 金山办公在2026 AI生产力大会上推出面向员工的AI办公客户端WPS Comate,可连接组织数据与流程。该产品提供AI岗位专家、Skill技能生态、自动化任务等六大模块,并支持云端与本地双任务模式,个人用户可直接下载体验。 智能体 产品更新 推荐理由: 金山办公把WPS Comate从聊天工具升级成能连接组织数据、自动执行任务的AI办公平台,对国内WPS用户群是个实际提效选项,但具体落地效果和第三方集成深度还有待验证。 16:41 IT之家(RSS) 精选 82 国行 Apple 智能完成备案,阿里千问将集成至苹果 AI 能力 苹果技术开发(上海)有限公司的“Apple 智能”大模型已于 2026 年 7 月 8 日完成备案,适用场景为苹果手机。阿里千问将作为 AI 能力集成至 Apple 智能,为 iOS、iPadOS、macOS 和 visionOS 的中

产品更新 教程/实践 部署/工程 政策/监管 端侧 行业动态 智能体 多模态 现象/趋势 MCP/工具 模型发布 语音 开源/仓库 编码 OpenAI 安全/对齐 推理 Google 数据/训练 Anthropic GitHub
Google Developers Blog(RSS) ·

Gemini Enterprise Agent Platform 新增 Parallel Web Search 网络接地提供商

Google Cloud 与 Parallel Web Systems 合作,将 Parallel 的搜索基础设施作为新的网络接地提供商原生集成到 Gemini Enterprise Agent Platform 中。该集成使开发者能将 AI 智能体锚定在可验证的实时网络结果上,以提升企业工作流的事实准确性。用户还可编程提取、永久缓存并与其他大语言模型一起处理网络数据。

Google 产品更新 搜索
AI HOT ·

金山办公推出 WPS Comate AI 办公客户端

16:41 IT之家(RSS) 精选 70 金山办公在2026 AI生产力大会上推出面向员工的AI办公客户端WPS Comate,可连接组织数据与流程。该产品提供AI岗位专家、Skill技能生态、自动化任务等六大模块,并支持云端与本地双任务模式,个人用户可直接下载体验。 智能体 产品更新 推荐理由: 金山办公把WPS Comate从聊天工具升级成能连接组织数据、自动执行任务的AI办公平台,对国内WPS用户群是个实际提效选项,但具体落地效果和第三方集成深度还有待验证。

智能体 产品更新
AI HOT ·

阿里Qwen将集成至Apple Intelligence服务中国用户

19:05 X.PIN @ thexpin 精选 78 阿里巴巴的Qwen模型将被集成到Apple Intelligence中,为中国的iOS、iPadOS、macOS和visionOS用户提供文本与图像理解、内容生成等AI功能。中国网信办已公布包括Apple Intelligence、华为小艺大模型、OPPO AndesGPT在内的七项移动端生成式AI服务备案信息。阿里巴巴董事会主席蔡崇信表示,苹果在选定阿里前曾与多家中国公司洽谈。 政策/监管 端侧 行业动态 另有 5 家信源报道 X:Berry Xia (@berryxia) TechCrunch:AI(RSS) IT之家(RSS) X:小互 (@xiaohu) X:X.PIN (@thexpin) 推荐理由: 苹果选阿里Qwen为中国AI引擎,蔡崇信已确认,网信办也已备案,这事对国内AI厂商的竞争格局影响不小,做国内市场的应该认真看一眼。

政策/监管 端侧 行业动态
AI HOT ·

国行 Apple 智能完成备案,阿里千问将集成至苹果 AI 能力

16:41 IT之家(RSS) 精选 82 苹果技术开发(上海)有限公司的“Apple 智能”大模型已于 2026 年 7 月 8 日完成备案,适用场景为苹果手机。阿里千问将作为 AI 能力集成至 Apple 智能,为 iOS、iPadOS、macOS 和 visionOS 的中国用户提供文本与图像理解、内容生成等功能,用户无需在应用间切换即可直接体验。 多模态 端侧 行业动态 另有 1 家信源报道 IT之家(RSS) 推荐理由: 苹果AI备案落地,国行iPhone用户终于等到,但集成的不是自研而是阿里千问,对苹果AI生态和国内AI格局都算一个交代。

多模态 端侧 行业动态
IT之家(RSS) ·

台积电上调2026年资本支出预测至600~640亿美元,A14制程进展顺利

台积电在2026Q2财报说明会上将2026年资本支出预测上调至600~640亿美元,此前预测接近560亿美元。董事长魏哲家表示,预计2028年量产的A14制程(1.4nm)开发进展顺利,移动和HPC客户兴趣强烈,将成为比2nm更大、更持久的工艺。台积电预计2026Q3合并营收446~458亿美元,2026全年美元收入增幅将超过40%。

行业动态 部署/工程
MarkTechPost(RSS) ·

Patter SDK 教程:构建餐厅预订电话智能体,支持动态变量、护栏、延迟仪表盘与评估检查

Patter SDK 发布教程,演示如何构建一个餐厅预订场景的语音智能体工作流。该流程支持动态调用变量、注册可调用工具、应用输出护栏(如PII脱敏、脏话过滤、话题范围限制),并可在无需实时电话凭证的情况下运行脚本化通话模拟。教程还涵盖延迟与成本指标追踪、回归式评估检查,以及将智能体逻辑、工具调用、安全检查和通话模拟整合为单一结构化管线。

MCP/工具 教程/实践 语音
AI HOT ·

数据中心已使美国公众电费增加230亿美元,回收成本困难重重

11:59 Hacker News 热门(buzzing.cc 中文翻译) 精选 72 数据中心对电力的需求已导致美国公众电费增加230亿美元,这一涨价将持续至2028年底。由于电价由州公用事业委员会根据复杂的成本分摊规则设定,数据中心可利用其用电灵活性(如避开系统峰值负荷)规避部分成本分摊,而普通居民难以效仿。监管机构正面临如何公平分配电网基础设施投资成本的挑战。 政策/监管 现象/趋势 部署/工程 推荐理由: 文章拆开了美国电力市场成本分配的规则漏洞,原来数据中心能靠预测高峰期降载来逃掉电费,普通住户根本没法复制,最后账单还是落在我们头上。

政策/监管 现象/趋势 部署/工程
AI HOT ·

Airtap iMessage 新功能:发条短信让 AI 替你操作手机

10:42 AYi @ AYi_AInotes 精选 78 Airtap 推出 iMessage 新功能,用户只需给美国号码发一条 iMessage,其云手机上的 AI Agent 就能通过视觉模拟点击,替用户完成 TikTok 刷视频、星巴克点单等操作,无需安装对应 App。其架构分为三层:大脑(理解指令)、AutoPilot(视觉操控屏幕)、云手机(24小时在线)。但支付等敏感操作仍需用户手动完成,信任与授权仍是所有 Agent 厂商的难题。 AYi : 卧槽真的有点炸裂兄弟们,我在国内连 TikTok 都装不了,结果在手机里发了条 iMessage,一个远在美国的 AI Agent 竟然替我注册了一个TikTok号,还帮我刷完了 10 条 TikTok 热门视频,把视频总结都直接发了回来,... 智能体 MCP/工具 教程/实践 另有 2 家信源报道 X:阿易 AI Notes (@AYi_AInotes) X:Francois Chollet (@fchollet) 推荐理由: 阿易实测 Airtap 从刷 TikTok 到点星巴克,把 Agent 从信息处理推到交易环节,虽然最后支付还得手动,但不用装 App 就能办事这条路,真的在敲碎原有产品入口逻辑。做产品的值得盯着,信任问题也是所有 Agent 绕不过去的。

智能体 MCP/工具 教程/实践
公众号:千问APP(阿里) ·

千问APP联合武汉发布举办AI求职实战课,演示简历诊断与办公自动化

千问APP与武汉发布在武汉举办AI求职实战课,现场演示了用千问进行简历诊断、PPT制作和表格分析。产品经理提出"给全材料、说明目标、定义标准、划定边界、索要可编辑文件"五步法,并展示了将486行杂乱销售数据浓缩为一页结论PPT的"建、理、算、析、呈"方法论。

教程/实践 数据/训练
AI HOT ·

开源 LLM TODO Skill"阿福":用 Claude Code 和 Codex 实现知识管理到排期自动化

10:10 公众号:卡尔的AI沃茨 精选 71 作者基于 API 版 Fable5 和 Codex 开发了开源 TODO Skill“阿福”,用于将收件箱中的待办资料自动转为 Markdown 任务卡,识别信息不完整项(如视频链接需通过 yt-dlp 和本地 Whisper 提取字幕),并支持批量排期、AI 分组合并、拖拽调整周视图及同步到 Mac 日历或飞书日历。项目已开源在 GitHub,安装仅需一条命令。 智能体 开源/仓库 教程/实践 推荐理由: 卡尔把三年知识管理教训封装成一个能自动扫描、合并排期的 TODO Skill,如果你也被碎片信息淹没,这个工具比任何大纲都实用。

智能体 开源/仓库 教程/实践
AI HOT ·

阿里发布 Qwen-Audio-3.0-Realtime,在 Artificial Analysis 语音推理子项中综合排名第一

10:40 公众号:通义实验室(千问) 精选 73 阿里通义实验室发布实时语音交互模型 Qwen-Audio-3.0-Realtime,在 Artificial Analysis 的 Speech Reasoning 子项中综合排名第一,超越 OpenAI GPT-Realtime-2。 智能体 多模态 模型发布 语音 另有 1 家信源报道 IT之家(RSS) 推荐理由: 我觉得Qwen-Audio-3.0-Realtime把情感表达和背景降噪结合得很好,加上工具调用,语音交互终于从聊天走向任务执行,有API可以直接上手,推荐语音产品经理试试。

智能体 多模态 模型发布 语音
AI HOT ·

每天Vibe Coding 16小时,作者分享Fable 5与GPT-5.6 Sol的AI开发流程

08:10 公众号:数字生命卡兹克 精选 64 作者每天Vibe Coding约16小时,认为Claude Fable 5在大型方案初版设计上“当世独一档”,GPT-5.6 Sol能有效纠错并优化方案。核心流程为:Fable 5出方案初版 → GPT-5.6 Sol审查纠错 → 在Codex中开启“目标模式”全自动化执行,最长曾连续运行17小时。 智能体 教程/实践 编码 另有 1 家信源报道 X:卡兹克 (@Khazix0918) 推荐理由: 卡兹克把每天16小时Vibe Coding磨出的流程讲透了,Claude出方案、GPT纠错、Codex目标模式全自动执行,这条流水线能让你的开发瓶颈从写代码转移到测试和方案设计上,值得一试。

智能体 教程/实践 编码
AI HOT ·

OpenAI 用 AI 攻击自家 AI:GPT-Red 自动发现安全漏洞,成功率 84% 远超人类

03:57 The Decoder:AI News(RSS) 精选 71 OpenAI 训练了内部 AI 模型 GPT-Red,通过自我对弈强化学习自动模拟提示词注入等攻击,在测试场景中成功率达 84%,而人类红队仅为 13%。GPT-Red 的发现直接用于训练,使 GPT-5.6 Sol 在直接提示词注入上的故障次数比四个月前的最佳模型减少六倍,且未影响通用性能。约 3.8% 的“更强”提示词注入仍能成功,GPT-Red 暂不对外开放。 OpenAI 安全/对齐 推荐理由: OpenAI让AI攻击自己找漏洞,成功率84%把人甩在后面,直接拉低了GPT-5.6的注入失败率六倍,这比人类红队靠谱多了,但别忘了3.8%的缺口照样能捅娄子。

OpenAI 安全/对齐
AI HOT ·

Grok Build 现已开源

05:14 Elon Musk @ elonmusk 精选 76 SpaceXAI : 我们已开源 Grok Build,并重置了所有用户的使用限制。 开源 Grok Build 让任何人都能参与构建一个可靠且稳健的测试框架。欢迎查看我们的代码,包括 Grok Build CLI 的 Git 仓库。 http://x.ai/o... xAI 开源/仓库 编码 推荐理由: xAI 把 Grok Build 直接开源了,虽然还没说明详细功能,但代码已经能看,做 AI 编程的开发者可以提前摸一摸架构。

xAI 开源/仓库 编码
AI HOT ·

Google AI 发布 Gemini 3.5 Live Translate,支持 70+ 语言近实时语音到语音翻译

23:33 Google AI Developers @ googleaidevs 精选 70 Google AI 发布 Gemini 3.5 Live Translate,支持 70+ 语言、近实时延迟的语音到语音翻译。该模型直接处理原始音频流,保留说话者语调、节奏和音高。东南亚超级应用 Grab 正探索将其用于司机与乘客间的跨语言沟通,其用户每月发起超 1000 万次语音通话。开发者可通过 Gemini Live API 集成 LiveKit、Fishjam、Pipecat 或 Vision Agents 构建应用。LiveKit 已实现虚拟会议室多语言即时理解;Software Mansion 结合 MoQ 协议突破流媒体瓶颈;VisionAgents AI 展示了动态多语言切换能力。开发者可在 Google AI Studio 试用并获取 Cookbook 示例代码。 Google 产品更新 语音 部署/工程 推荐理由: Google把Gemini 3.5的语音翻译做到了近实时、保持语调,这对出海产品是个很实际的升级,实时通话翻译终于从demo走向可用。

Google 产品更新 语音 部署/工程
AI HOT ·

纽约州暂停所有新建大型数据中心项目

23:34 TechCrunch:AI(RSS) 精选 71 纽约州成为全美首个暂停数据中心建设的州。州长Kathy Hochul签署行政令,暂时禁止州政府批准50兆瓦及以上大型数据中心的新建许可,可能影响十余个项目。Hochul表示数据中心不应带来更高的电费、水资源消耗或噪音污染,且不能豁免地方区划和审批。禁令将在州政府完成数据中心环境审查流程后解除,预计耗时约一年。Hochul还考虑要求数据中心为州电网提供资金支持,并阻止超大规模数据中心享受税收优惠。此举正值纽约州立法机构推进更严格措施之际,上月一项法案已推进暂停20兆瓦以上数据中心建设一年。 政策/监管 另有 3 家信源报道 Ars Technica:AI(RSS) Hacker News 热门(buzzing.cc 中文翻译) The Verge:AI(RSS) 推荐理由: 纽约州开了第一枪,暂停所有大型数据中心审批,这可能是AI狂飙时代开始遇到物理世界的硬约束,做基础设施的得重新掂量选址风险了。 23:33 Google AI Developers @ googleaidevs 精选 70 Google AI 发布 Gemini 3.5 Live Translate,支持 70+ 语言近实时语音到语音翻译 Google AI 发布 Gemini 3.5 Live Translate,支持 70+ 语言、近实时延迟的语音到语音翻译。该模型直接处理原始音频流,保留说话者语调、节奏和音高。东南亚超级应用 Grab 正探索将其用于司机与乘客间的跨语言沟通,其用户每月发起超 1000 万次语音通话。开发者可通过 Gemini Live API 集成 LiveKit、Fishjam、Pipecat 或 Vision Agents 构建应用。LiveKit 已实现虚拟会议室多语言即时理解;Software Mansion 结合 MoQ 协议突破流媒体瓶颈;VisionAgents AI 展示了动态多语言切换能力。开发者可在 Google AI Studio 试用并获取 Cookbook 示例代码。 Google 产品更新 语音 部署/工程 推荐理由: Google把Gemini 3.5的语音翻译做到了近实时、保持语调,这对出海产品是个很实际的升级,实时通话翻译终于从demo走向可用。 23:23 HuggingFace Daily Papers(社区热门论文) 精选 76 小米发布Xiaomi-Robotics-U0:380亿参数多模态自回归模型统一具身合成 小米推出Xiaomi-Robotics-U0,一个380亿参数的多模态自回归模型,用于统一具身合成。该模型将具身生成视为基础图像与视频生成的延伸,联合优化文生图、图像编辑、具身场景生成、具身迁移及具身视频生成。它是首个支持跨多种机器人形态的高质量多视角场

政策/监管 Google 产品更新 语音 部署/工程 arXiv 具身智能 多模态 论文/研究 Anthropic 其他 行业动态 DeepMind 大佬观点 安全/对齐 智能体 教程/实践 视频 开源生态 模型发布 现象/趋势 数据/训练 端侧 GitHub OpenAI 编码 评测/基准