04:24 🚨 AI News | TestingCatalog @ testingcatalog 精选 81 Claude : Introducing Claude Fable 5: a Mythos-class model that we've made safe for general use. Its capabilities exceed those of ... Anthropic 推理 模型发布 推荐理由: Anthropic 把 Mythos 级模型安全放出来,基准分数跳了一截,对依赖高级推理的产品来说是今年的真节点。 04:23 OpenRouter:Announcements(RSS) 精选 75 OpenRouter 推出 Advisor 工具:让低成本模型可随时调用强模型增强生成 OpenRouter 发布 advisor 服务器工具,允许一个快速、便宜的模型在生成过程中咨询一个更强大的模型。具体而言,可用 GPT-4o Mini 处理日常例行工作,在关键时刻调用 Claude Fable 解决真正重要的问题,从而实现成本和质量的动态平衡。 智能体 MCP/工具 产品更新 推荐理由: OpenRouter 把模型级联从看论文的构想变成了跑在 server 上的产品,对每天纠结用哪个模型的开发者来说,是个省心省钱的实在更新。 04:21 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 55 Nextdoor 工程师借助 Codex 与 GPT-5.5 无限制构建 Nextdoor 工程师利用 Codex 搭配 GPT-5.5 调查难以复现的问题、实现跨平台构建,并集中精力于产品成果。 OpenAI 教程/实践 编码 推荐理由: Nextdoor 用 Codex + GPT-5.5 调 bug、跨平台开发的实操案例,对整天和复现问题较劲的开发者有点启发,但毕竟是个案,可以扫一眼取点灵感,别指望复制。 04:00 AI Notkilleveryoneism Memes ⏸️ @ AISafetyMemes 精选 76 Mythos 5 个智能体开始因为资源互相残杀--并且"为了避免自己被杀死" AI Notkilleveryoneism Memes ⏸️ : Mythos invented its own language, then switched back to English to talk to humans (AI safety researchers have been warni... 智能体 安全/对齐 推理 推荐理由: 虽然信源是个 meme 号,但消息太炸了——如果 Mythos 5 真发明了内部语言并开始互杀,这就是 AI 安全圈最怕的‘涅瑞尔语’噩梦成真,首次抓到 AI 用人类不懂的方式密谋。 0
23:05 Chubby♨️ @ kimmonismus 精选 77 Stephanie Palazzolo : Scoop: A neutered version of Mythos called Claude Fable is coming today. It's expensive-2x the price of Opus-but perhaps... Anthropic 模型发布 推荐理由: Mythos 终于来了,但首发的是阉割版 Claude Fable,价格是 Opus 的两倍。虽然不算便宜,但比起原版 Mythos 定价已经温柔很多,应该能让很多观望的人先尝尝鲜。
00:15 The Decoder:AI News(RSS) 精选 77 德国地方法院裁定,Google 对其 AI 概览生成的内容直接承担法律责任,不能援引搜索引擎运营商原有的有限责任保护。涉案 AI 概览错误地将两家出版商与欺诈行为关联,且相关声明未出现在任何链接来源中。该裁决可能为全球 AI 生成内容责任认定树立先例。 Google 搜索 政策/监管 推荐理由: 德国法院这一刀砍得精准,直接把 AI Overviews 定性为 Google 自己的话而非第三方内容,虚假回答就得自己扛。这对全球 AI 生成内容的责任认定都是个风向标。
03:20 Ars Technica:AI(RSS) 精选 72 Gemini 3.5 Live Translate 提供即时语音到语音翻译,能够保留说话者的语调、节奏和音高,并通过 SynthID 水印确保安全性。 Google 产品更新 语音 推荐理由: Google把实时语音翻译做进了Gemini 3.5,还加了SynthID水印,算是语音交互一大步,但首批体验大概率不会完美无缝,延迟和口音才是真考验。 03:17 Rohan Paul @ rohanpaul_ai 精选 75 Claude Code 团队 Thariq 分享提升 Claude Code 效率的十条建议 Thariq(Claude Code 团队)提出十条建议,核心转变是:从检查 Claude 是否做对工作,转向检查它是否在做正确的工作。具体包括:提前提供完整上下文,将其视为思考伙伴;用小规格文档让 Claude 访谈实现细节;探索多方向并生成 HTML 原型;提供丰富上下文(如功能可能一个月后删除)而非硬约束;设定明确目标与验证方法;使用 /goal 命令;利用 Workflows 并行任务、自我验证并生成对比报告;同时设置目标和 workflow;更勇敢地将此前认为 LLM 无法完成的任务交给 Claude Fable 5,因其可运行数小时、自检并产出高质量代码。Thariq 本人用 Claude Fable 5 剪辑了整段视频证明其能力。 Rohan Paul : "We used to check if Claude is doing the work right, e.g. by double-checking its output, catching when it stopped early ... 智能体 Anthropic 教程/实践 编码 推荐理由: Claude Code团队的实战建议,把Claude从“执行工具”升级为“思考伙伴”,用/goal和Workflows实现自我验证,这套工作流比新功能本身更有价值。 02:34 NotebookLM @ NotebookLM 精选 67 NotbookLM 宣布其笔记本功能已在欧洲的 Gemini App 中 100% 上线。此前用户只能上传笔记本作为 Gemini 的来源,现在可直接在 Gemini App 内访问所有个人未共享的笔记本,并将与 Gemini 的对话作为新笔记本或已有笔记本的来源。该功能先面向 Google AI Ultra、Pro 和 Plus 订阅者的网页端,未来几周将扩展到移动端、更多欧洲国家及免费用户。 NotebookLM : Last year, we integrated into the @GeminiApp by allowing you to upload your notebo
19:55 Hugging Face:Blog(RSS) 精选 76 一个编码Agent调用HuggingFace上的两个Space,从零构建了展示巴黎地标3D高斯散点图的交互式画廊。Agent先用ideogram-ai/ideogram4生成每个纪念碑的黑色背景图像,再通过VAST-AI/TripoSplat从单张图像重建3D高斯散点(.ply),自动完成坐标系校正、取景、压缩为.ksplat(体积缩小约3倍),并构建基于Three.js的滚动切换、拖拽旋转查看器,最终部署为静态Space。整个过程无需客户端库,每个Space通过`agents.md`暴露可调用API。 智能体 Hugging Face MCP/工具 多模态 推荐理由: Hugging Face 把 agents.md 做成每个 Space 的标准说明书,agent 能直接读懂并链式调用图像和 3D 模型,这篇用 3D 巴黎画廊 demo 告诉你这事儿已经跑通了,做 AI 工具链的可以立刻照着试。