AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

600多种由MiniMax Speech 2.8 Turbo驱动的新声音现已登陆Together AI @togethercompute 🎙️✨ 立即体验:https://voicefinder.together.ai/minimax--speech-2.8-turbo

03:13 MiniMax (official) @ MiniMax_AI 精选 67 Together AI : We added 600+ new voices on Together AI! Introducing MiniMax Speech 2.8 Turbo on Together AI, an enterprise TTS model fo... 产品更新 语音 部署/工程 推荐理由: MiniMax 语音 2.8 Turbo 在 Together AI 一次性落地 600+ 种声音,做实时语音代理的可以直接在熟悉的基础设施里选型,试用成本极低,值得抽一分钟听听看。

产品更新 语音 部署/工程
AI HOT ·

Anthropic销售负责人如何利用Claude Cowork管理4000个客户账户

00:48 Claude:Blog(网页) 精选 59 Anthropic美国中端市场业务负责人Travis Bryant利用Claude Cowork自动化销售管理工作。该工具帮助他高效完成客户倾向性评分、每日客户简报准备及每周销售预测报告生成,每晚自动处理4000个账户数据,替代了以往跨部门团队需数百小时完成的工作。通过自动化日常任务调度,他每天节省约90分钟,并将数据整合为可交互的销售仪表板,使其能更专注于客户沟通与战略决策。 Anthropic 教程/实践 部署/工程 推荐理由: Travis 把 4000 个账户的评分一夜跑通,比自动报表更值得关注,中小销售团队照抄就能省掉跨部门数百小时,这是 Claude Cowork 在企业场景最落地的实践之一。

Anthropic 教程/实践 部署/工程
AI HOT ·

我们已将查询感知压缩技术投入生产,以实现更快、更清晰、更准确的搜索。 更好的上下文优于更多的上下文。 我们的系统可将上下文令牌最多削减70%,同时提升回答质量。

01:46 Perplexity @ perplexity_ai 精选 62 产品更新 搜索 推荐理由: Perplexity把上下文压缩做到了query感知级别,70% token削减还能质量上升,这是搜索架构层升级,日常用户不一定感知技术细节,但更快的结果就是最好的证明。

产品更新 搜索
AI HOT ·

用Gemini构建,改变世界🌍 我们正与@xprize合作,发起一场全球黑客松,旨在利用我们全新的智能体工具解决现实世界的挑战。 点击加入:https://www.geminixprize.com/

02:35 Google AI Developers @ googleaidevs 精选 71 智能体 Google 行业动态 推荐理由: Google 拉着 XPrize 搞全球黑客松,重点是用他们的新 agentic 工具解决真问题,对有想法的开发者来说,是个正经的曝光和拿钱入口。

智能体 Google 行业动态
AI HOT ·

OpenAI模型证伪了离散几何中的一个核心猜想

03:07 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 79 OpenAI开发的人工智能模型成功解决了数学界悬而未决逾80年的“单元距离问题”,并由此推翻了离散几何领域的一个核心猜想。这一突破被视作人工智能驱动数学研究的里程碑事件,标志着AI在基础科学理论探索中取得了实质性进展。该模型通过创新算法处理复杂的几何问题,展示了机器在自动化发现与验证数学猜想方面的巨大潜力。 OpenAI 推理 论文/研究 关联讨论 8 条 X:OpenAI (@OpenAI) X:Noam Brown (@polynoamial) X:Greg Brockman (@gdb) X:AI Safety Memes (@AISafetyMemes) X:Emad Mostaque (@EMostaque) Hacker News 热门(buzzing.cc 中文翻译) X:Sam Altman (@sama) TechCrunch:AI(RSS) 推荐理由: OpenAI模型独自推翻了一个80年未解的离散几何猜想,这种级别的数学突破以前只属于人类顶级大脑,现在AI也做到了,做理论研究的可以看看它怎么做的。

OpenAI 推理 论文/研究
AI HOT ·

如何加速你的日常研究工作流? 通过为AI提供正确的科学工具包。 我们为Google @Antigravity推出了Science Skills,整合了来自30多个主要生命科学来源的洞见,包括UniProt和AlphaFold数据库。

08:48 Google DeepMind @ GoogleDeepMind 精选 70 DeepMind 检索增强 产品更新 推荐理由: Google 把 AlphaFold 和 UniProt 变成 AI 的“科学技能”,这不是又一次数据库整合,而是让 AI 能直接查询实验知识的工具链,做生命科学的可以认真看看。 08:14 OpenCode @ opencode 精选 61 Grok Build现已在OpenCode中可用 xAI 产品更新 编码 推荐理由: Grok 的实时搜索和长上下文在终端里偶尔能帮上忙,对 OpenCode 用户来说算个实用补充,比用网页版 Grok 顺手。 07:56 IT之家(RSS) 精选 78 腾讯张军官宣操作系统层级 AI 助手"马维斯"正式上工,Windows、Mac、安卓端同步上线 腾讯于5月21日发布了操作系统层级AI助手“马维斯”,支持Windows、Mac和安卓平台同步上线。该助手具备文档归类解析、图片智能识别处理、系统维护等功能,并强调与操作系统深度集成,可调度不同模型处理任务,部分功能可在离线状态下使用。腾讯表示“马维斯”能完成市面主流Agent的大部分工作,并具备桌面操控手机应用等能力。这是继3月WorkBuddy和“龙虾”产品矩阵后,腾讯推出的又一AI助手产品。 智能体 产品更新 多模态 端侧 推荐理由: 腾讯把 AI 助手压到系统层,预装本地模型、拔网线也能跑,不是又一个套壳工具,而是真正冲着‘电脑变成可对话对象’去的,值得装上看看实操体验。 06:56 IT之家(RSS) 精选 72 冲刺 9 月上市,OpenAI 最快本周五提交 IPO 招股书草案 据CNBC报道,OpenAI预计最快本周五递交首次公开募股(IPO)招股书草案,这标志着公司向资本市场迈出关键一步。首席执行官萨姆·奥尔特曼设定最早于2026年9月上市的目标。公司正与高盛和摩根士丹利合作,借助这两家投行的资源推动上市申报和承销安排。此前,埃隆·马斯克针对OpenAI的诉讼失利后,上市障碍消除,进程明显加速。OpenAI目前私募估值超过8500亿美元,若顺利推进,可能成为公开市场历史上规模最大的首发之一。此外,公司最早考虑在今年第四季度上市,内部治理和运作已开始向上市公司转型,准备工作持续进行。 OpenAI 行业动态 关联讨论 1 条 TechCrunch:AI(RSS) 推荐理由: 虽然上市本身不直接关乎技术突破,但 OpenAI 冲击史上最大 IPO,对行业格局和人才流向的影响,可能比一次模型发布更深远。 06:47 Elon Musk @ elonmusk 精选 80 正如最近与@AnthropicAI扩大合作所展示的,@SpaceX正在大规模提供AI算力服务。 我们正在与其他公司进行类似合作的讨论。 随着时间的推移,特别是

DeepMind 检索增强 产品更新 xAI 编码 智能体 多模态 端侧 OpenAI 行业动态 Anthropic 部署/工程 推理 论文/研究 Google 大佬观点 开源生态 语音 数据/训练 教程/实践 图像生成 Meta 搜索 安全/对齐 MCP/工具 开源/仓库
AI HOT ·

提示💡 你无需担心自动路由(以及所有单独模型)的缓存未命中问题 OpenRouter会将你的会话固定在一个模型/提供商上,直到缓存过期

00:13 OpenRouter @ OpenRouter 精选 70 教程/实践 部署/工程 推荐理由: OpenRouter 这个 Auto Router 的缓存说明很实用,会话会被固定在一个提供者直到缓存过期,不用担心切换带来的不一致,API 开发者看一眼能省事。

教程/实践 部署/工程
AI HOT ·

谷歌的人工智能正遭到操纵。这家搜索巨头正在悄然反击

00:32 Hacker News 热门(buzzing.cc 中文翻译) 精选 74 谷歌的AI系统正面临被操纵的风险。为应对这一挑战,这家科技巨头已悄然启动防御措施,以保护其AI生成内容的结果免受恶意干扰。此举旨在确保搜索和AI服务的可靠性与可信度,反映了当前人工智能安全领域日益增长的对抗性问题。谷歌在未公开宣传的情况下,正在通过技术手段加强对其AI系统的防护。 Google 安全/对齐 行业动态 推荐理由: AI搜索结果被恶意操纵的问题终于被主流媒体深度报道,谷歌的暗中反制措施比想象中更复杂,做搜索和SEO的值得细看。

Google 安全/对齐 行业动态
AI HOT ·

开源插件为Codex App增添高级功能

00:02 向阳乔木 @ vista8 精选 75 一个开源项目允许用户增强Codex App的功能。即使通过API登录,也能通过安装插件的方式启用Computer Use特性并添加Goal指令。项目还支持界面自定义,例如调整为类似Chrome浏览器的顶部Tab样式,并可设置任务开始和完成的提醒音效。相关开源项目地址已在评论区提供。 智能体 MCP/工具 OpenAI 开源/仓库 推荐理由: 这不只是个插件,它把 Codex 从只能聊天变成了能动手的 Agent,用 API 登录也能开 Computer Use,是给开发者装上了超能力的实用补丁。

智能体 MCP/工具 OpenAI 开源/仓库
AI HOT ·

优化_anything:通用文本参数优化API

21:08 HuggingFace Daily Papers(社区热门论文) 精选 71 该研究提出了一种基于大语言模型的通用文本优化系统,将优化问题统一表述为通过评分函数改进文本产物。在六项任务中达到最优结果:智能体架构使Gemini Flash在ARC-AGI上的准确率从32.5%提升至89.5%;调度算法降低40%云成本;87%的CUDA内核匹配或超越PyTorch表现;圆包装问题超越AlphaEvolve。实验表明,可操作的附加信息比仅使用分数反馈收敛更快、得分更高;多任务搜索通过跨任务迁移学习,在同等预算下优于独立优化,且任务数量越多收益越大。该工作首次证明基于LLM的文本优化是通用问题解决范式,能统一传统领域特定算法。系统已开源,支持多种后端。 智能体 arXiv GitHub 搜索 推荐理由: 让一个LLM同时优化agent架构、调度算法和CUDA内核,还能将ARC-AGI从32%拉到89%,这可能是今年最突破认知的通用问题求解范式,做agent的人必须看。

智能体 arXiv GitHub 搜索
AI HOT ·

AI视频的一致性始于动作之前。 对于这个15秒的烹饪短片,我们首先在PixVerse中生成了一个清晰的角色分镜。 然后将其用作视频的参考。 相同的角色。清晰的故事节点。 镜头指导。动作细节。 转发 + 关注 + 回复 = 分镜工作流

23:03 PixVerse @ PixVerse_ 精选 64 产品更新 图像生成 视频 推荐理由: PixVerse 这个 storyboard 功能给了视频创作者一个保持角色一致性的新招,虽然不颠覆,但省时间是真的。

产品更新 图像生成 视频
AI HOT ·

Stability AI 推出音频模型 Stability Audio 3.0,可生成最长 6 分钟专业级歌曲

23:56 IT之家(RSS) 精选 71 Stability AI 推出 Stability Audio 3.0 音频生成模型家族,包含四款不同规格模型,参数从45900万到27亿。小型模型专注设备端运行,可本地生成两分钟以内的音频;中型和大型模型支持创作超过6分20秒的完整音乐, 多模态 开源/仓库 模型发布 推荐理由: Stability Audio 3.0 把AI音乐从几十秒的demo拉到了六分钟的完整歌曲,而且中小模型直接开源,任何一个能跑模型的设备都能玩,音乐创作的门槛继续被踩低。 23:03 PixVerse @ PixVerse_ 精选 64 AI视频的一致性始于动作之前。 对于这个15秒的烹饪短片,我们首先在PixVerse中生成了一个清晰的角色分镜。 然后将其用作视频的参考。 相同的角色。清晰的故事节点。 镜头指导。动作细节。 转发 + 关注 + 回复 = 分镜工作流 产品更新 图像生成 视频 推荐理由: PixVerse 这个 storyboard 功能给了视频创作者一个保持角色一致性的新招,虽然不颠覆,但省时间是真的。 21:08 HuggingFace Daily Papers(社区热门论文) 精选 71 优化_anything:通用文本参数优化API 该研究提出了一种基于大语言模型的通用文本优化系统,将优化问题统一表述为通过评分函数改进文本产物。在六项任务中达到最优结果:智能体架构使Gemini Flash在ARC-AGI上的准确率从32.5%提升至89.5%;调度算法降低40%云成本;87%的CUDA内核匹配或超越PyTorch表现;圆包装问题超越AlphaEvolve。实验表明,可操作的附加信息比仅使用分数反馈收敛更快、得分更高;多任务搜索通过跨任务迁移学习,在同等预算下优于独立优化,且任务数量越多收益越大。该工作首次证明基于LLM的文本优化是通用问题解决范式,能统一传统领域特定算法。系统已开源,支持多种后端。 智能体 arXiv GitHub 搜索 推荐理由: 让一个LLM同时优化agent架构、调度算法和CUDA内核,还能将ARC-AGI从32%拉到89%,这可能是今年最突破认知的通用问题求解范式,做agent的人必须看。 18:56 IT之家(RSS) 精选 76 投资超 600 亿美元,孙正义豪赌 OpenAI 引发内部质疑"迷信奥尔特曼如追星" 软银对OpenAI的投资承诺已超600亿美元,引发内部对孙正义过度信任其创始人奥尔特曼的担忧。部分高管质疑将巨额资本集中于单一公司存在风险,且软银虽持股超10%却无董事会席位,缺乏决策影响力。同时,Anthropic等竞争对手的崛起加剧了对OpenAI领先地位的挑战。尽管软银表示对OpenAI抱有“高度信心”,并已从中获得账面收益,但其股价下跌及信用展望被下调反映出市场对其

多模态 开源/仓库 模型发布 产品更新 图像生成 视频 智能体 arXiv GitHub 搜索 OpenAI 现象/趋势 行业动态 部署/工程 推理 Google 编码 教程/实践 安全/对齐 政策/监管 开源生态 数据/训练 论文/研究 Microsoft Anthropic
AI HOT ·

ZCube网络架构:破解大模型推理网络瓶颈

05:50 Z.ai @ Zai_org 精选 74 随着长上下文与Prefill-Decode分离部署成为主流,GPU集群网络已从次要部件转变为制约推理吞吐、尾部延迟和成本的关键瓶颈。传统静态网络拓扑与动态非对称的KV Cache流量模式冲突,导致局部拥塞。为此,Z.ai、Harnets.AI与清华大学联合研发了ZCube网络架构。该架构采用完全扁平化拓扑与混合接入设计,从源头解耦并分散流量以减少拥塞。在GLM-5.1生产测试中,ZCube在保持GPU与软件栈不变的前提下,实现了交换机与光模块成本降低33%、平均推理吞吐提升15%、首token时间P99降低40.6%的显著效果,证明网络架构创新能有效释放硬件潜力。 推理 论文/研究 部署/工程 推荐理由: 智谱把 SIGCOMM 论文里的网络架构 ZCube 真的部署到了线上推理集群,开关和光模块成本降了 1/3,吞吐提 15%,TTFT P99 降 40%,做推理部署的人该看一下。 05:35 Google AI Developers @ googleaidevs 精选 74 Google Stitch更新:AI设计助手实现全流程构建 Google推出了其AI设计伙伴Stitch的多项重要更新。新功能支持实时流式构建设计,允许用户在不中断流程的情况下直接进行编辑和互动反馈。Stitch现已能够导入现有代码库或Design.md文件,基于实际生产组件进行设计以保持品牌一致性。同时,工具新增了动态界面生成功能,并可将设计项目直接导出为可分享的线上URL,简化了从原型到生产的部署流程。该工具现已面向全球用户开放。 智能体 Google 产品更新 多模态 推荐理由: Stitch 这次更新把设计到生产流水线打通了,实时流加运动 UI 让原型更接近真产品,做移动端和 Web 的可以直接试试,比自己搭环境快太多。 05:18 OpenClaw🦞 @ openclaw 精选 66 OpenClaw 2026.5.19 🦞 📱 Android Talk Mode 实现实时化 🍎 Mac 设置界面更清爽 🔐 xAI 登录支持无头模式 🧵 Telegram 话题功能更稳定 大版本更新,简短公告。 https://github.com/openclaw/openclaw/releases/tag/v2026.5.19 产品更新 开源生态 语音 推荐理由: 一堆小修小补但都很实用,尤其 Android 实时对话模式,开源 AI 客户端里难得把体验做到这个程度,值得更新。 04:56 IT之家(RSS) 精选 72 英伟达 2027 财年第一财季归母净利润 583.21 亿美元,同比增长 211% 英伟达2027财年第一季度业绩创新高,营业总收入达816.15亿美元,同比增长85%。净利润为583.21亿美元,同比激增211%

推理 论文/研究 部署/工程 智能体 Google 产品更新 多模态 开源生态 语音 数据/训练 行业动态 OpenAI 教程/实践 编码 图像生成 Meta 搜索 Anthropic 安全/对齐 MCP/工具 开源/仓库
AI HOT ·

投资超 600 亿美元,孙正义豪赌 OpenAI 引发内部质疑"迷信奥尔特曼如追星"

18:56 IT之家(RSS) 精选 76 软银对OpenAI的投资承诺已超600亿美元,引发内部对孙正义过度信任其创始人奥尔特曼的担忧。部分高管质疑将巨额资本集中于单一公司存在风险,且软银虽持股超10%却无董事会席位,缺乏决策影响力。同时,Anthropic等竞争对手的崛起加剧了对OpenAI领先地位的挑战。尽管软银表示对OpenAI抱有“高度信心”,并已从中获得账面收益,但其股价下跌及信用展望被下调反映出市场对其豪赌的顾虑。 OpenAI 现象/趋势 行业动态 推荐理由: 孙正义对奥特曼的信任已经到内部人觉得像追星,砸下 600 亿却连个董事会席位都没拿到,WeWork 的教训仿佛没发生过,彭博这篇深访是理解 AI 泡沫风险的一扇窗。

OpenAI 现象/趋势 行业动态
AI HOT ·

Qwen Conference 2026:主题演讲议程 AI原生云、Agent原生云架构、推理的未来,以及多模态视觉技术发布。没有冗余内容,只有面向全球规模的工程蓝图。 注册:https://click.qwencloud.com/m/20000000190/

18:33 Alibaba Cloud @ alibaba_cloud 精选 60 推理 行业动态 部署/工程 推荐理由: 阿里云把 Qwen 大会的关键词押在推理和多模态视觉上,声称全是工程蓝图没有废话,对关注 Qwen 生态的技术人来说,可能是今年最重要的日程预告。

推理 行业动态 部署/工程
AI HOT ·

将Agent转变为自主工作者!🚀 ❌ 开源痛点:可用性低、运维成本高、可观测性差。 ✅ MSE AI调度器通过以下方式解决: • 高可用分布式调度 • 统一管理与细粒度权限 • 弹性伸缩以降低成本 • 全链路可观测性 支持OpenClaw、Dify等。免费公测现已开放! 🔗 https://int.alibabacloud.com/m/1000413115/ #AI #Agent #MSE

18:33 Alibaba Cloud @ alibaba_cloud 精选 65 智能体 产品更新 部署/工程 推荐理由: 阿里云这个调度器直击开源 Agent 部署的三大痛点,免费公测对在用 Dify 或 OpenClaw 的团队是个低成本试水方案,虽然不算突破性创新但实用性够强。

智能体 产品更新 部署/工程
AI HOT ·

将你的想法转化为激发故事的视觉画面 🧨 【引用 @Adamaestr0_】:大多数AI工具可以写作或生成图像。 但这个能同时做这两件事。 向你介绍 SenseNova U1。 一个能同时思考文本和图像的AI。 这改变了一切 🧵

18:46 SenseTime @ SenseTime_AI 精选 68 Adam : La mayoría de las herramientas de IA pueden escribir o generar imágenes. Pero esta hace AMBAS cosas a la vez. Te present... 多模态 模型发布 推荐理由: 商汤发了 SenseNova U1,主打文本和图像同时生成的「全模态」,但宣传语太简略,没给任何性能数据或技术细节,暂时看不出是真突破还是常规迭代,先标记关注。

多模态 模型发布
AI HOT ·

开源油猴脚本实现小红书、抖音、微信公众号的截图粘贴自动上传,并支持YouTube字幕复制、倍速调节及内容导出至NotebookLM、ChatGPT等工具。主推文作者表示,该工具增强了将X平台内容同步至国内平台的意愿,尽管部分平台体验欠佳。

14:31 向阳乔木 @ vista8 精选 76 向阳乔木 : 完成了第一项工作,开源自己常用的油猴脚本。 1. 小红书、抖音、微信贴图,截图粘贴自动上传。 2. Youtube字幕复制,倍速调节,复制字幕给NotebookLM、ChatGPT处理。 3. 小宇宙网页版倍速调整 开源地址:https:/... GitHub 开源/仓库 开源生态 推荐理由: 向阳乔木开源了一套油猴脚本,让截图直接粘贴上传到小红书、抖音等平台,对多平台内容分发的人来说是一个小而实在的时间节省利器。

GitHub 开源/仓库 开源生态