AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

@xai 的 Grok 创意套件中 3 款新模型现已在 OpenRouter 上线: • Grok Imagine Image Quality:照片级真实图像生成与编辑 • Grok Imagine Video:从文本、图像或参考生成短片 • Grok Voice TTS 1.0:支持 20 多种语言的 5 种语音 更多详情见下方 🧵

03:12 OpenRouter @ OpenRouter 精选 65 xAI 产品更新 多模态 语音 推荐理由: 如果你觉得官方 Grok API 麻烦,OpenRouter 现在一口气上线了 Imagine 图像、视频和 Voice TTS,做创意产品的开发者可以直接从这里调用了,省去多签一轮 API key 的功夫。

xAI 产品更新 多模态 语音
AI HOT ·

Qwen 3.7 预览版

03:34 Hacker News 热门(buzzing.cc 中文翻译) 精选 78 多模态 推理 模型发布 推荐理由: 阿里 Qwen 3.7 预览版来了,国产模型在推理和多模态上的推进速度令人侧目,虽然还是预览,但已经是一个值得开发者提前盯紧的信号。

多模态 推理 模型发布
AI HOT ·

埃隆·马斯克对山姆·阿尔特曼和OpenAI提起的诉讼败诉

02:34 Hacker News 热门(buzzing.cc 中文翻译) 精选 70 埃隆·马斯克对山姆·阿尔特曼及OpenAI提起的诉讼以败诉告终。这场广受关注的案件主要涉及人工智能公司OpenAI的创立初衷、公司治理结构以及未来发展方向等核心争议。法院的裁决标志着这一涉及商业、技术伦理与公司控制权的重大法律纠纷阶段性落幕。 OpenAI 行业动态 推荐理由: 马斯克输掉这场官司不算意外,难的是法律判例对“非营利转向营利”的实质约束几乎为零,以后这类协议怎么写,创业圈得重新想想了。

OpenAI 行业动态
AI HOT ·

你的Mac可以在你用手机工作时坚守岗位。 在Codex桌面应用中启用远程连接,然后开启"保持Mac唤醒"。 当Mac开机并接通电源时,Codex可以持续运行,而你则通过ChatGPT移动应用工作。

02:42 OpenAI Developers @ OpenAIDevs 精选 64 OpenAI 教程/实践 编码 推荐理由: 一个实用的小技巧,告诉你如何让 Mac 上的 Codex 保持运行,再用手机随时接手,适合需要灵活切换设备的开发者,但算不上大新闻。

OpenAI 教程/实践 编码
AI HOT ·

Anthropic收购SDK与MCP服务器工具开发商Stainless

01:06 Anthropic:Newsroom(网页) 精选 64 Anthropic宣布收购SDK与MCP服务器工具开发商Stainless。Stainless自2022年成立以来,一直为Anthropic官方SDK的生成提供支持,其工具能将API规范转化为TypeScript、Python、Go等多语言的SDK、命令行工具及MCP服务器。此次收购旨在增强Claude平台的开发者体验,提升AI代理连接外部数据与工具的能力,从而在MCP协议基础上进一步拓展连接生态。 智能体 Anthropic MCP/工具 行业动态 推荐理由: Anthropic收购Stainless,表面是SDK团队整合,深层是给Claude的Agent连接能力铺路。未来MCP服务器的质量和数量可能会跨一个台阶,做Agent开发的值得关注。

智能体 Anthropic MCP/工具 行业动态
AI HOT ·

OpenAI与Dell合作将Codex引入混合及本地企业环境

01:26 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 65 OpenAI与Dell达成合作,将Codex编程代理引入企业混合云及本地部署环境。该合作旨在帮助企业在自身数据和业务流程中安全集成AI编码能力,强化对敏感数据的管控。此举标志着企业级AI工具部署方式的重要扩展,为受监管行业提供了符合数据主权要求的解决方案。 OpenAI 产品更新 编码 部署/工程 推荐理由: Codex 进企业本地部署这步棋走得稳,但不算惊喜,对数据安全有硬要求的团队可以跟进下 Dell 的硬件方案。

OpenAI 产品更新 编码 部署/工程
AI HOT ·

Cursor 发布 Composer 2.5 编程模型

01:50 宝玉 @ dotey 精选 83 Cursor 发布了迄今最强的编程模型 Composer 2.5。该模型在长任务处理和复杂指令跟随方面更加稳定高效,官方称其效率最高可提升十倍。其技术亮点在于采用文本反馈方法,解决了超长轨迹(十万 token 级)下的学习难题,使模型能可靠执行连续数十甚至上百步的复杂编程任务。模型底座仍基于 Moonshot 的 Kimi K2.5 进行二次训练。同时,Cursor 宣布与 SpaceXAI 联合启动更大规模模型训练,将依托 Colossus 2 超算集群,这也意味着其算力基础已与马斯克旗下资源深度绑定。 推理 模型发布 编码 推荐理由: Cursor 模型做到长任务不掉链子,Kimi K2.5 底座的澄清补上了透明度欠账,更值得看的是背后 SpaceX 的算力布局,这家公司下一步怎么走全藏在这条推文里。

推理 模型发布 编码
AI HOT ·

AI产出格式决策指南:Markdown还是HTML?

22:45 AYi @ AYi_AInotes 精选 71 本文核心观点是判断AI产出格式的关键在于该产物是用于“阅读”还是“使用”。被阅读的文档、笔记适合Markdown;需要交互、可视化、一次性交付或直接分享的工具型产物则应选择HTML。文章提出了四组具体判断信号,如需要交互和可视化即指向HTML。作者使用Ring-2.6-1T模型实测了三个HTML工具,包括交互式项目计划页、Prompt调参器和可交互流程图,均能在几分钟内生成高质量、单文件且不依赖外部库的成品,效率大幅提升。同时,文章也指出了使用Ring生成HTML时可能遇到的输出不完整、SVG坐标系错误等常见问题及应对方法。 教程/实践 编码 推荐理由: 这篇把「HTML vs Markdown」的决策框架讲透了,三个可直接复用的 prompt 模板对产品人和开发者尤其实用,读完就能上手生成交互工具。

教程/实践 编码
AI HOT ·

PaddleOCR 3.5:使用Transformers后端运行OCR和文档解析任务

23:52 Hugging Face:Blog(RSS) 精选 68 PaddleOCR 发布 3.5 版本,正式将 Transformers 确立为运行 PP-OCRv5 及 PaddleOCR-VL 1.5 模型的可选推理后端之一。此次更新引入了更灵活的 `engine` 与 `engine_config` 参数,允许开发者自主选择后端并配置数据类型、设备等选项。其核心价值在于,显著降低了将文档处理能力集成至以 Transformers 为中心的主流开发栈(如 RAG、智能体、文档AI)的门槛,使开发者能更便捷地利用现有生态,减少集成阻力,从而专注于下游应用构建。 Hugging Face 检索增强 产品更新 多模态 推荐理由: PaddleOCR 3.5 最大的变化不是新模型,而是终于能跑在 Transformers 上了,做 RAG 和文档智能的开发者可以少写一堆胶水代码。 22:45 AYi @ AYi_AInotes 精选 71 AI产出格式决策指南:Markdown还是HTML? 本文核心观点是判断AI产出格式的关键在于该产物是用于“阅读”还是“使用”。被阅读的文档、笔记适合Markdown;需要交互、可视化、一次性交付或直接分享的工具型产物则应选择HTML。文章提出了四组具体判断信号,如需要交互和可视化即指向HTML。作者使用Ring-2.6-1T模型实测了三个HTML工具,包括交互式项目计划页、Prompt调参器和可交互流程图,均能在几分钟内生成高质量、单文件且不依赖外部库的成品,效率大幅提升。同时,文章也指出了使用Ring生成HTML时可能遇到的输出不完整、SVG坐标系错误等常见问题及应对方法。 教程/实践 编码 推荐理由: 这篇把「HTML vs Markdown」的决策框架讲透了,三个可直接复用的 prompt 模板对产品人和开发者尤其实用,读完就能上手生成交互工具。 22:37 Krea @ krea_ai 精选 78 今天,Krea 2正式向所有人开放。 为庆祝上线,我们将为所有订阅用户提供整整一周的无限次Krea 2生成服务。 免费试用 👇 产品更新 图像生成 推荐理由: Krea 2 正式开放,新版本性能值得关注,尤其免费一周无限生成,做视觉设计的可以趁现在使劲造图,试试成片质量能不能撼动 Midjourney。 21:45 Cloudflare Blog 精选 59 玻璃翼项目:Mythos向我们展示了什么 近期,团队将Mythos及其他聚焦安全的大语言模型应用于关键基础设施的实时代码测试。测试揭示了模型在识别漏洞和代码审计方面的优势,例如在复杂逻辑中发现潜在风险的能力,同时也暴露了其存在的局限性,包括产生误报以及对上下文理解的不稳定。文章指出,在将这些安全LLM的能力扩展到更大规模之前,必须围绕其建立一套可靠的工作流程,

Hugging Face 检索增强 产品更新 多模态 教程/实践 编码 图像生成 部署/工程 智能体 MCP/工具 视频 具身智能 行业动态 开源/仓库 D
AI HOT ·

构建长期代理的一些基础要素:https://openrouter.ai/long-horizon

00:11 OpenRouter @ OpenRouter 精选 60 智能体 MCP/工具 教程/实践 推荐理由: OpenRouter 把自己做长程 agent 踩过的坑总结成一组可复用的基础模式,做 agent 的开发者值得翻一遍,比读泛泛的架构文章接地气得多。

智能体 MCP/工具 教程/实践
AI HOT ·

在大规模运行Claude Code有哪些最佳实践? 关于我们从团队在数百万行单体仓库、数十年历史的遗留系统和分布式微服务中运行的经验总结,新博客文章已发布: https://claude.com/blog/how-claude-code-works-in-large-codebases-best-practices-and-where-to-start

00:13 ClaudeDevs @ ClaudeDevs 精选 73 Anthropic 教程/实践 编码 部署/工程 推荐理由: 官方终于出了一份给百万行单仓库和遗留系统的实操指南,比社区零散经验靠谱得多,做工程团队的可以抄作业。

Anthropic 教程/实践 编码 部署/工程
AI HOT ·

马斯克在推文中请求帮助提升 Grok Build。用户 @morganlinton 分享了使用 Grok Build 完成 PasteLocal 项目中 relay 功能开发的体验,称赞其全面性令人惊叹。该功能实现周期短,且包含了端到端加密、数据持久化、自动同步、双向命令行交互等关键技术特性,并经过了多轮严格的代码审查与修复。马斯克此举意在收集更广泛的反馈,以持续改进该开发工具。

00:50 Elon Musk @ elonmusk 精选 71 xAI 产品更新 开源/仓库 推荐理由: Elon 亲自下场拉票的 Grok Build 新功能,端到端加密剪贴板同步这招挺实用,开发者可以直接跑起来,是 xAI 生态里少见的即插即用模块。

xAI 产品更新 开源/仓库
AI HOT ·

我最近常用的一个提示词: 实现<SPEC>,同时维护一个持续更新的implementation-notes.html文件(或markdown),记录规范中未提及的决策、需要修改的内容、必须做出的权衡,以及其他我需要了解的事项。

00:55 Thariq @ trq212 精选 73 Anthropic 教程/实践 编码 推荐理由: 这个 prompt 让 AI 边写代码边记决策日志,简单但有效,做复杂项目的开发者现在就可以用上,它解决了 AI 编程最烦人的问题——你不知道它为什么这么写。

Anthropic 教程/实践 编码
AI HOT ·

Claude Code 大型代码库最佳实践

01:13 凡人小北 @ frxiaobei 精选 71 Anthropic 分享了在大型代码库中使用 Claude Code 的关键实践。核心建议包括:将 CLAUDE.md 配置分层,根目录放全局架构,子目录放局部约定;从子目录启动以精准加载上下文;测试和 lint 命令按子目录隔离运行;安装 LSP 以实现基于符号的精准代码定位;定期审查配置。组织层面需指定专人统一管理配置与规范,以促进最佳实践共享。 Anthropic 教程/实践 编码 推荐理由: 如果你在用Claude Code啃大型代码库,这几条配置经验能少走很多弯路,尤其是装LSP那一招,告别grep瞎找。

Anthropic 教程/实践 编码
AI HOT ·

GitHub爆火项目一键构建AI公司,集成Claude Code

09:45 AYi @ AYi_AInotes 精选 72 一个GitHub项目引发关注,据称已获得10万星标并被称为2026年增长最快的AI项目。该项目的核心功能是模拟一整家AI公司,包含146个不同领域的AI专家角色和12个完整部门。用户可以通过一条命令,将这些“员工”全部集成到Claude Code中,从而免费获得涵盖前端开发、安全审计、产品管理、增长黑客等多方面的7x24小时AI支持。 智能体 GitHub 开源/仓库 编码 推荐理由: 一个仓库塞了146个AI专家,一条命令全装进Claude Code,产品、开发、安全、增长全齐,做项目时拉个虚拟团队试试,比雇人便宜多了。

智能体 GitHub 开源/仓库 编码
AI HOT ·

Cursor新编码模型性能媲美Opus,价格低数十倍

10:02 小互 @ xiaohu 精选 70 Cursor发布自研编码模型Composer 2.5,其性能与Opus 4.7相当,但在成本上具有显著优势。价格方面,Composer 2.5的输入成本比Opus 4.7低10倍,输出成本低约30倍。技术层面,该模型在智能和行为表现上较前代有明显提升,尤其擅长处理长时间、大上下文的复杂任务,指令遵循的可靠性与协作流畅度也得到增强。 模型发布 编码 推荐理由: Cursor 终于下场做模型了,Composer 2.5 性能和 Opus 4.7 咬得很紧但价格便宜了一个数量级,做 AI 编程的成本马上要洗牌。

模型发布 编码
AI HOT ·

AI批量生成艺术风格,一键浏览380+大师作品

10:34 向阳乔木 @ vista8 精选 74 作者利用GPT-Image-2模型,批量生成了超过380位艺术家的画风作品。为便于直观学习和借鉴(用于AI生图提示),他创建了一个可体验的网站,将蒙德里安、葛饰北斋等不同风格的创作并置展示,帮助用户快速建立对艺术风格的认知。该项目代码已在GitHub开源。 GitHub 图像生成 开源/仓库 推荐理由: 乔木用 GPT-Image-2 把 380+ 艺术家风格做成可视化图谱,每张图用同一个 prompt 生成,让你一眼看懂风格差异,做 AI 生图的可以直接借鉴,代码还开源了。

GitHub 图像生成 开源/仓库
AI HOT ·

工具使用代理认知与行动脱节机制研究

05:08 elvis @ omarsar0 精选 71 该可解释性论文聚焦工具使用代理,通过探测隐藏状态发现模型常能识别应调用工具,但实际调用失败,不匹配率达26%-54%。问题完全集中于认知到行动的过渡阶段,而非认知本身。内部探测方向可解码,但后期层的最后令牌机制使信号旋转,几乎与产生的行动正交。研究旨在预测干预措施效果,指出常见归因如提示或训练不足可能忽略后期层几何结构,这为工具使用提示A/B测试中的性能上限提供了合理解释。 智能体 MCP/工具 大佬观点 推荐理由: 如果你在反复调 tool-use prompt 撞墙,这篇论文能解释你那个诡异的上限——模型早知道自己该调工具,但最后一层把信号转歪了。

智能体 MCP/工具 大佬观点