AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

更智能的 Google AI Edge Gallery:MCP 集成、通知和会话连续性

04:25 Google Developers Blog(RSS) 精选 65 Google AI Edge Gallery 应用在安卓平台上扩展了设备端 AI 能力,通过引入对开源模型上下文协议(MCP)的实验性支持,使得 Gemma 4 模型能够协调处理跨 Google Workspace 和 Google Maps 等外部数据源的复杂任务。此次更新添加了“定时通知”技能,用于实现日常事务的自动化管理,并新增了持久化聊天记录功能,允许用户近乎即时地恢复长会话上下文。该平台依托开源工具包,积极鼓励社区开发者通过其 GitHub 仓库构建并分享专注实用的工作流、提示配置与工具集成。 Google MCP/工具 产品更新 端侧 关联讨论 1 条 Google Developers Blog(RSS) 推荐理由: MCP 终于跑在 Android 设备上了,虽然是实验性支持,但 Gemma 4 能直连 Workspace 和 Maps,做自动化的开发者可以上手试试。

Google MCP/工具 产品更新 端侧
AI HOT ·

全新的 @Antigravity 生态系统是您终极的智能体优先开发平台。 对于任何构建或编排智能体的开发者,以下是 Google I/O 上发布的内容 🚀↓

04:00 Google AI Developers @ googleaidevs 精选 71 智能体 Google 产品更新 关联讨论 1 条 X:Testing Catalog (@testingcatalog) 推荐理由: Google I/O上这个Antigravity平台的发布,算是大厂对agent-first开发范式的正式表态,构建和编排agent的开发者应该认真看一眼。

智能体 Google 产品更新
AI HOT ·

Gemini Omni不仅能构建逼真的场景,还能推理接下来应该发生什么。它结合了对物理的直观理解与Gemini在历史、科学和文化背景方面的知识。 今日起,通过@Geminiapp + Google Flow和@YouTube Shorts,向全球Google AI Plus、Pro和Ultra订阅用户推出视频生成功能。

03:29 Sundar Pichai @ sundarpichai 精选 79 Google 多模态 模型发布 视频 推荐理由: Gemini Omni 把物理直觉和历史知识喂给了视频模型,生成的不再是静态快照而是有因果的画面,Google 这一步直接把战线拉到了 Sora 的对立面,YouTube Shorts 集成是个杀手应用。

Google 多模态 模型发布 视频
AI HOT ·

到现在,你可能已经听说了 Gemini Omni,这是我们新推出的模型,旨在从任意输入(从视频开始)创造任何内容。 但……这有什么大不了的? 让我们来分解一下 🧵👇

03:40 Google AI @ GoogleAI 精选 74 Google 多模态 模型发布 视频 推荐理由: Google 这次押注全模态生成,从视频切入,方向很对。如果体验不翻车,内容创作者的工具箱会迎来一次大升级,值得跟进后续实测。

Google 多模态 模型发布 视频
AI HOT ·

阿里千问最强智能体模型 Qwen3.7-Max 发布

11:55 IT之家(RSS) 精选 76 阿里云千问大模型今日正式发布新一代旗舰智能体模型 Qwen3.7-Max,定位为全能的智能体基座。该模型在编程、办公自动化及长周期自主任务方面能力突出,其中在一项持续35小时、超过1000次工具调用的内核优化实验中验证了其稳定的推理与执行能力。基准测试显示,Qwen3.7-Max 在 SWE-Pro、MCP-Mark、GPQA Diamond 等多项评测中成绩领先,其编程、通用智能体及推理能力已达到业界顶尖水平。该模型即将通过阿里云百炼 API 提供服务。 智能体 推理 模型发布 推荐理由: 这次发布不是常规升级,千问在智能体长时间自主执行上把门槛拉高了一大截,想做agent的团队都得重新对标。 10:55 IT之家(RSS) 精选 74 消息称微软内部示警:GitHub 面临生存级风险,AI 编程工具削弱托管必要性 微软内部发出警告,称其代码托管平台GitHub正面临“生存级风险”。主要原因是Cursor、Claude Code等AI编程助手兴起,改变了开发者工作流,削弱了持续将代码上传至GitHub的必要性。为统一工具链并控制成本,微软已要求部分团队在2026年6月底前停止试用Claude Code,转而使用自有工具GitHub Copilot CLI。同时,OpenAI曾考虑自建替代平台,也加剧了对GitHub地位的潜在威胁。 智能体 GitHub Microsoft 编码 推荐理由: 微软内部把 GitHub 风险定义为“生存级”,这不再是外部竞争猜测,AI 编程工具真的在动摇代码托管的根基。 10:49 Qwen:Blog Retrieval(API) 精选 79 Qwen3.7:智能体前沿 Qwen Studio推出Qwen3.7模型,提供覆盖聊天机器人、图像与视频理解、图像生成、文档处理、网页搜索集成、工具调用及工件生成等功能。该模型整合了当前AI智能体的关键能力,旨在推动多模态交互与实际任务执行向更综合、自主的方向发展。 智能体 模型发布 关联讨论 2 条 X:阿里云 / Alibaba Cloud (@alibaba_cloud) Hacker News 热门(buzzing.cc 中文翻译) 推荐理由: Qwen推出了新模型3.7,直指Agent能力前沿。虽然官方博客这次很简短,但按照Qwen一贯的节奏,工具调用和自主任务能力应该会刷新上限,做Agent的朋友可以关注后续实测。 07:33 Anthropic:Newsroom(网页) 精选 65 拓宽关于前沿AI的对话 Anthropic为构建负责任的先进AI,正与全球多元群体展开对话。首轮讨论汇集了超过15个宗教、哲学及跨文化传统的学者与伦理学者,旨在为Claude等模型的道德形成与价值观对齐提供多元视角。受“外部良知”概念启发,团队开发并

智能体 推理 模型发布 GitHub Microsoft 编码 Anthropic 安全/对齐 Google 产品更新 部署/工程 教程/实践 OpenAI 图像生成 现象/趋势
AI HOT ·

Google Tensor ML SDK 测试版发布

03:25 Google Developers Blog(RSS) 精选 69 Google Tensor ML SDK 进入测试版,支持开发者直接在 Pixel 10 设备的 TPU 上构建和部署高性能机器学习模型。该 SDK 集成边缘部署框架 LiteRT,提供统一工作流,可高效转换、编译并运行 PyTorch 或 TFLite 模型,并具备稳定回退机制。此外,新推出的模型库包含超过 100 个经典及生成式 AI 模型(如 Gemma 3),支持低延迟、注重隐私的语音识别、计算机视觉与文本生成等功能。 Google 产品更新 端侧 推荐理由: Google 把 TPU 塞进了 Pixel 10,现在开发者能直接在手机上跑 Gemma 3 了,这是移动端 AI 从「能用」到「好用」的关键一步,做 app 的值得关注。

Google 产品更新 端侧
AI HOT ·

介绍Gemini Omni,我们的新模型,可以从任何输入创建任何内容,首先从视频开始。 借助Gemini Omni,您可以将图像、视频和文本作为输入组合,并生成基于Gemini现实世界知识的高质量视频。#GoogleIO

03:08 Google Gemini @ GeminiApp 精选 81 Google 多模态 模型发布 视频 关联讨论 1 条 X:Gemini (@GeminiApp) 推荐理由: Google IO 上 Gemini Omni 的发布,让视频生成从“文生”进化到“多媒体融合生成”。输入图、文、视频,输出带着真实世界理解的连贯视频,不是拼接而是再创作。

Google 多模态 模型发布 视频
AI HOT ·

我们希望借助AI帮助科学家发现下一个重大突破。 Gemini for Science是我们全新的实验性工具套件,旨在帮助他们探索更多假设、大规模验证工作、轻松解析文献等。🧵

03:11 Google DeepMind @ GoogleDeepMind 精选 61 DeepMind Google 产品更新 多模态 推荐理由: Google DeepMind 把 Gemini 能力封装成科研专用工具,虽然还在实验阶段,但这是 AI 真正吃进科学数据的第一步,做研究的值得关注具体怎么落地。

DeepMind Google 产品更新 多模态
AI HOT ·

Google推出Gemini 3.5 Flash模型,现已向所有用户开放,并集成到其产品与API中。相比Gemini 3.1 Pro,3.5 Flash在几乎所有基准测试中均有提升,编程能力进步尤为显著。该模型性能媲美顶尖模型,但生成速度极快(比其他前沿模型快4倍),在"智能与输出速度"的评估维度中位于顶尖象限,实现了效率与效果的卓越平衡。

09:19 StepFun @ StepFun_ai 精选 68 Sundar Pichai : Just off stage at #GoogleIO, some highlights from this morning 🧵 Gemini 3.5 Flash is available today for everyone in @a... Google 多模态 编码 行业动态 推荐理由: StepFun 转推 Sundar 的 Flash 发布,这种坦然像在说“赛道还长”,而 Flash 在编码和速度上的领先,确实让国产模型在性价比上又要追一阵了。 07:33 Anthropic:Newsroom(网页) 精选 65 拓宽关于前沿AI的对话 Anthropic为构建负责任的先进AI,正与全球多元群体展开对话。首轮讨论汇集了超过15个宗教、哲学及跨文化传统的学者与伦理学者,旨在为Claude等模型的道德形成与价值观对齐提供多元视角。受“外部良知”概念启发,团队开发并测试了伦理承诺提醒工具,初步实验显示其能有效降低模型不对齐行为。公司计划未来将对话拓展至法律、心理学及公民社会等领域,以共同应对AI对社会结构的重塑。 Anthropic 安全/对齐 推理 关联讨论 1 条 X:Anthropic (@AnthropicAI) 推荐理由: Anthropic在做一件少见的事——请神学家和哲学家帮忙塑造Claude的‘性格’,初步实验发现让模型在决策前暂停反思能降低偏差,做AI对齐的值得读一下。 07:33 Google AI Developers @ googleaidevs 精选 73 通过使用Gemini API中的新托管代理功能,@Ramp在无需接触后端基础设施的情况下构建了其高级财务代理。 了解更多 ↓ 智能体 Google 产品更新 推荐理由: Google把agent构建的后端复杂度藏起来了,Ramp没碰基础设施就上了金融agent,这对所有想做agent的产品团队都是个明确信号,门槛降了不少。 06:10 Claude Code:GitHub Releases(RSS) 精选 64 Claude Code v2.1.145版本更新 本次更新为Claude Code工具带来了多项功能增强与问题修复。新功能包括:新增JSON格式的会话列表命令以便脚本化操作,并在OTEL追踪中完善了Agent父子关系。插件浏览界面现可预览详细信息。在稳定性方面,修复了权限提示被绕过的安全问题、MCP参数校验错误、终端窗口调整后的显示冻结,以及非ASCII名称导致的API调用失败等问题。同时改进了Read工具的文件超限处理,并优化了任务列表排序和状态栏信息显示等交互细节,整体提升了工具的易用性与可靠性。 智能体 Anthropic 产品更新 部署/工程 推荐理由: Cla

Google 多模态 编码 行业动态 Anthropic 安全/对齐 推理 智能体 产品更新 部署/工程 教程/实践 OpenAI 图像生成 现象/趋势 开源/仓库 安全
AI HOT ·

Google Flow 🤝 Gemini Omni 使用我们的最新模型创作更具电影感的故事,它带来了批量编辑、改进的角色一致性等功能。以下是@FlowbyGoogle的其他新功能 → https://goo.gle/42K2nge #GoogleIO

02:41 Google DeepMind @ GoogleDeepMind 精选 72 Google 产品更新 视频 推荐理由: Google Flow 终于把批量编辑和角色一致性拉上来了,对做视频内容的人能省不少事,虽然不算颠覆性的代际更新,但实用度提升明显。

Google 产品更新 视频
AI HOT ·

OlmoEarth v1.1: 更高效的模型家族

03:03 Hugging Face:Blog(RSS) 精选 65 Ai2(Allen Institute for AI)在Hugging Face平台发布了OlmoEarth模型家族的1.1版本。此次更新重点提升了模型的计算效率与运行性能,通过优化的模型架构与训练策略,使OlmoEarth v1.1在保持或增强任务表现的同时,显著降低了推理所需的计算资源与时间成本。这一改进旨在让该开源模型更适用于资源受限的部署场景,推动大规模语言模型的普惠应用。 开源生态 推理 模型发布 推荐理由: OlmoEarth v1.1 把重心放在效率上,如果降本幅度够大,对需要在本地跑开源模型的团队会是个实在的更新。

开源生态 推理 模型发布
AI HOT ·

每月有超过9亿用户使用Gemini应用。 这一增长的重要部分源于我们快速的发布节奏。以下是过去一年我们推出的一些最重要功能的回顾。🧵 #GoogleIO

02:38 Google Gemini @ GeminiApp 精选 76 Google 行业动态 推荐理由: Gemini 月活冲破 9 亿,这条线说明 AI 助手已不再是少数人的玩具,Google 的「快发版」策略正在把生成式 AI 塞进每一部安卓手机。产品经理应该看到这是从实验室到亿级设备的真实穿透率。

Google 行业动态
AI HOT ·

Daily Brief是一项新的个性化摘要功能,旨在成为您每天早晨的首选信息来源。 它从您的收件箱、日历和任务中收集信息,进行优先级排序、整理,并在专为快速浏览设计的超简洁晨间摘要中为您建议下一步行动。#GoogleIO

02:38 Google Gemini @ GeminiApp 精选 72 智能体 Google 产品更新 推荐理由: Google 终于把 Gemini 往真正的个人助理方向推了一步,整合邮件、日历、任务的每日摘要,如果执行到位会抢掉很多人的早晨首页。

智能体 Google 产品更新
AI HOT ·

谷歌搜索迎 25 年来最大改版,AI 重塑搜索体验与交互方式

02:55 IT之家(RSS) 精选 73 谷歌在2026年I/O开发者大会上宣布,旗下搜索业务迎来25年来最大改版,核心是用AI重塑搜索入口与交互方式,由最新Gemini 3.5 Flash模型提供支撑。主要变化包括:用户交互从输入关键词转向描述完整需求,搜索框将动态扩展并支持文本、图片、视频等多模态输入。用户可从AI概览中连续追问,形成聊天式对话。新版引入搜索智能体,可在后台24小时运行并追踪用户设定的目标。此外,谷歌将生成式界面功能引入搜索,并将个人智能扩展至98种语言、近200个国家。据悉,AI Mode月活用户已突破10亿,查询量每季度翻倍。 智能体 Google 产品更新 多模态 关联讨论 1 条 Hacker News 热门(buzzing.cc 中文翻译) 推荐理由: 谷歌搜索把AI从‘可选项’变成核心引擎,这次改版不只是界面调整,而是从输入到结果全面AI化,10亿月活用户的搜索习惯将被重塑。开发者得重新思考SEO了。

智能体 Google 产品更新 多模态
AI HOT ·

真正的"哇"时刻是 Gemini Omni。一个迈向 AGI 的世界模型。 它可以从任何输入创建任何内容。这太疯狂了。

02:30 Chubby♨️ @ kimmonismus 精选 81 Logan Kilpatrick : Introducing Gemini Omni 🔮........ Omni is our new model that can create anything from any input - starting with video (... Google 多模态 模型发布 视频 推荐理由: Google放出的Gemini Omni不只是新模型,是朝着世界模型走的一大步,视频生成是起点,开发者可以开始盯着API了。

Google 多模态 模型发布 视频
AI HOT ·

我们在#GoogleIO上宣布了多项Gemini更新,包括: - 采用神经表达技术的全新Gemini体验设计 - 即将推出的Gemini智能体功能,含每日简报与Gemini Spark - Gemini Omni与3.5 Flash模型 - 以及更多内容! 详情请见此线程🧵

02:38 Google Gemini @ GeminiApp 精选 68 智能体 Google 产品更新 多模态 推荐理由: Google IO上Gemini这波更新,从Neural Expressive到代理体验,是在把AI助手往主动帮你做事的方向推,产品人和开发者该认真看看。

智能体 Google 产品更新 多模态
AI HOT ·

Gemini Spark 是您的全天候个人AI代理,帮助您驾驭数字生活。 它将 Gemini 从一个回答您问题的助手,转变为一个在您的指导下、代表您完成工作的助手。#GoogleIO

02:38 Google Gemini @ GeminiApp 精选 76 智能体 Google 产品更新 推荐理由: Google IO上Gemini的重大转型,从被动回答到主动代理,很可能会重新定义「AI助手」的边界,开发者该重新评估应用层机会了。

智能体 Google 产品更新
AI HOT ·

从今天起,您可以在@openclaw中使用您的Grok或X Premium订阅。 与您的智能体对话,生成图像和视频,或搜索X帖子。 http://x.ai/news/grok-openclaw

04:14 xAI @ xai 精选 63 智能体 xAI 产品更新 搜索 关联讨论 1 条 X:OpenClaw (@openclaw) 推荐理由: 如果你已经是Grok和OpenClaw的用户,这个集成让模型直接进入agent工作流,搜帖子和生成媒体都更方便,但它没带来新模型或能力,只是换了个入口。

智能体 xAI 产品更新 搜索
AI HOT ·

谷歌更改了其搜索框

04:29 Hacker News 热门(buzzing.cc 中文翻译) 精选 72 谷歌于2026年5月对其搜索框进行了重大更新。此次更新的核心是在搜索结果顶部新增一个由人工智能驱动的“概览”区域,用于直接回答用户的查询。这一变化标志着谷歌搜索引擎从传统的链接列表,进一步转向提供整合信息的人工智能助手模式。 Google 产品更新 搜索 推荐理由: Google 终于对那行输入框动手了,新的设计把 AI 模式直接搬到前台,以后搜索可能不再是打字,而是直接对话。

Google 产品更新 搜索
AI HOT ·

Gemini Omni

04:29 Hacker News 热门(buzzing.cc 中文翻译) 精选 76 Google DeepMind 于 2026 年 5 月 19 日发布了新一代多模态大模型 Gemini Omni。该模型整合了文本、图像、音频与视频的理解与生成能力,旨在实现更自然的人机交互。在同期 Hacker News 讨论中获得 112 点赞,显示出技术社区对多模态融合趋势的持续关注。这标志着大模型从单模态向全模态感知与响应能力的进一步演进。 DeepMind 多模态 模型发布 推荐理由: Google 终于把全模态能力塞进了 Gemini,Omni 可能是 GPT-4o 第一个真正能打的对手,搞多模态应用的人现在就该去排队等 API。

DeepMind 多模态 模型发布