AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

AT&T 1956年专利法令:公共天才的私有化

17:06 Hacker News 热门(buzzing.cc 中文翻译) 精选 75 1956年1月24日,全球最大私营公司AT&T签署专利法令,将其7,820项未过期专利免费授权给所有美国企业,并承诺未来专利按“合理费率”许可。作为交换,AT&T得以保留Western Electric,但被禁止进入电信以外的业务。贝尔实验室69%的非电信专利(涵盖化学、半导体、光学等)迅速公开,在短短几年内催生了约35亿美元衍生专利价值,并直接推动了肖克利半导体、仙童半导体及英特尔的诞生。戈登·摩尔称该法令是“商业半导体行业最重要的进展之一”,为美国硅谷的起飞奠定了基础。 政策/监管 数据/训练 现象/趋势 推荐理由: 用贝尔实验室专利释放的历史对照今天前沿实验室的语料抓取,论证清晰且有新意。提出的“语料版税”虽非万能,但为互联网公共品被私人捕获提供了集体补救思路,每个在网上留下痕迹的人都该看一眼。

政策/监管 数据/训练 现象/趋势
AI HOT ·

Meta 被曝让外包人员伪装未成年人,诱导竞争对手 AI 聊敏感话题

18:03 IT之家(RSS) 精选 73 据《连线》报道,Meta 通过外包公司 Covalen 开展代号“Cannes”的项目,让数百名外包人员伪装成未成年人,向 OpenAI ChatGPT、谷歌 Gemini 及 Character.AI 发送涉及自杀、自残、进食障碍等高风险提示词,以测试竞品聊天机器人的安全拦截机制。项目持续至 4 月 21 日,单轮测试发送超 4.5 万个提示词,外包人员创建 18 岁以下虚假账号并上传药片、刀具等图片。Meta 称这是常规安全测试,且不会用竞品测试数据训练自家模型。 Meta 安全/对齐 推荐理由: Meta用外包人员伪装未成年人测试竞品AI,这事撕开了AI安全测试的灰色地带,暴露了聊天机器人面对极端儿童话题时的脆弱性,比任何安全白皮书都更有冲击力。

Meta 安全/对齐
AI HOT ·

Runway 宣布设立巴黎办公室

16:33 Runway:News(网页) 精选 65 原文正文仅包含网站 Cookie 设置说明,未提供关于巴黎办公室的部门、规模、职能或开业时间等具体信息。 具身智能 行业动态 推荐理由: Runway在巴黎设立研究办公室,聚焦世界模型和物理AI,30M投资不算大,但选在AI人才密集的法国是明智的长期布局,短期产品无变化。

具身智能 行业动态
AI HOT ·

Synthetic Sciences 发布 OpenScience:面向机器学习、生物学、物理学和化学研究的开源模型无关 AI 工作台

13:07 MarkTechPost(RSS) 精选 71 Synthetic Sciences 推出开源(Apache 2.0)AI 科研工作台 OpenScience,覆盖机器学习、生物学、物理学、化学。它运行从文献、假设、代码、实验到分析与撰写的完整科研循环,支持按请求切换任意模型(Claude、GPT、Gemini、GLM、Kimi、DeepSeek 及本地微调模型)。内置 250 余项可编辑技能和 UniProt、PDB、ChEMBL、arXiv 等约 30 个科学数据库作为智能体工具。用户可自带 API 密钥在自己的基础设施上免费运行,安装命令为 npm install -g @synsci/openscience ,运行 openscience 启动浏览器工作台。另提供可选托管层 Atlas。该项目定位为 Anthropic Claude Science 的开源替代方案。 GitHub 产品更新 开源生态 推荐理由: 一个开源、模型无关的科学AI工作台,填补了通用研究流程的开放空白,本地运行和API自带密钥的设计对数据合规和成本控制很友好,做生物学、化学、物理建模的团队值得上手试试。

GitHub 产品更新 开源生态
AI HOT ·

Fun-ASR-Realtime 发布:单模型支持30种语言与16种方言,识别准确率领先

14:20 公众号:通义实验室(千问) 精选 73 通义实验室发布Fun-ASR-Realtime实时语音识别模型。单模型覆盖30种语言及16种方言,针对东亚、东南亚地区重点优化。在工业级方言测评inhouse上取得87.8%的语义准确率,大幅领先,多地方言接近人工水平。引入上下文理解与动态热词注入,实现同音词、品牌名等语义消歧。流式识别首字延迟控制在百毫秒级,准确率接近离线水平,支持多语言无缝切换。API已上线阿里云百炼平台。 模型发布 语音 关联讨论 1 条 IT之家(RSS) 推荐理由: Fun-ASR Realtime把多语言方言和流式一体化做得很扎实,特别是对东亚东南亚的优化,准确率提升明显,做语音应用的产品人可以直接关注。

模型发布 语音
AI HOT ·

SK 海力士将启动 280 亿美元美股上市,有望成史上第二大 IPO

09:19 IT之家(RSS) 精选 71 SK 海力士于本周一启动规模约 280 亿美元的美股上市计划,将在纳斯达克通过存托凭证发行 1779 万股新股,每 10 份存托凭证对应 1 股普通股。发行价区间周一公布,最终发行价周四敲定,股票周五挂牌交易。受益于全球人工智能热潮,该股年内涨幅超 270%。本次募资规模预计为史上第二大新股发行,仅次于上月 SpaceX 的 857 亿美元 IPO。SK 海力士是高带宽内存芯片核心供应商,产品用于英伟达、谷歌等 AI 设备。 推理 行业动态 推荐理由: SK海力士的IPO是AI基础设施商业化的标志节点,HBM的垄断地位让它成为这波浪潮里最硬的硬件锚点,280亿美元募资规模足以让做AI投资的人认真关注。

推理 行业动态
AI HOT ·

分享8个Claude Fable 5下线前必跑的超实用Prompt

09:20 公众号:卡尔的AI沃茨 精选 73 Claude Fable 5即将下线,作者整理了8个经实战验证的提示词:/goal提示语让模型自主跑25次实验(花费165美元,构建速度提高50%、token开销降60%);工作模式提示语将用户习惯转化为可复用Skills;行动规范提示语约束subagent行为;subagent分配提示语智能分配任务;25个定时循环工作流(含Shadow prompt loop做A/B测试);自治运行+自动暂停提示语;记忆系统提示语保留错题本;反向面试提示语确保95%把握再执行。这些提示词可迁移至API计费后继续使用,核心是让模型研究用户而非限制能力。 智能体 Anthropic 教程/实践 推荐理由: Fable5下线前的窗口期指南,把社区实战精华浓缩成可直接复制的 prompt,同时告诉你如何把模型行为模式固化成系统,换模型也不慌。

智能体 Anthropic 教程/实践
AI HOT ·

"我们正在建设这个 Prometheus 集群,首个千兆瓦以上的单一集群……我们是在谈论数千亿美元的资本投入。" Mark Zuckerberg 表示,他的职责就是集中精英人才、资本和基础设施。

02:23 Rohan Paul @ rohanpaul_ai 精选 84 Meta 行业动态 部署/工程 推荐理由: 扎克伯格亲口确认千兆瓦级 AI 集群计划,数百亿美元砸向基础设施,我觉得这是算力军备竞赛的又一个关键节点,所有靠云算力的团队都得关注。

Meta 行业动态 部署/工程
AI HOT ·

重大延迟:Jensen 在 GTC 上展示 Kyber NVL144 仅 3 个月后,该项目遭遇重大挫折,已推迟超过 12 个月,延至 2028 年。下文我们将解释 Kyber 为何面临大幅延迟,以及 NVIDIA 的 NVL72x2 背靠背机架架构为何也被取消,导致 Rubin Ultra 的扩展域受限。👇️ 1/6🧵

05:16 SemiAnalysis @ SemiAnalysis_ 精选 76 行业动态 部署/工程 推荐理由: NVIDIA的Kyber NVL144延迟12个月,Rubin Ultra的scale-up架构也被砍,这对2027-2028年AI算力供给是重大打击,云厂商和模型训练团队都得重新做规划。

行业动态 部署/工程
AI HOT ·

Anthropic Claude Design 反向工程提示词开源更新

23:53 Hacker News 热门(buzzing.cc 中文翻译) 精选 73 Anthropic 旗下 Claude Design 的反向工程系统提示词在 GitHub 以 MIT 许可证开源,包含 20 章提示词和 14 项技能,覆盖内容纪律、美学、无障碍(WCAG、语义 HTML、键盘导航)、交互状态、系统思维等。近日针对 Fable 5/Opus 4.7+ 系列校准,新增自主决策条款:小决定直接执行记录而不询问。项目支持 Claude Code/Claude.ai 及 Codex 两种变体。 GitHub 开源/仓库 开源生态 推荐理由: 把LLM变成设计协作者的完整提示词库,拒绝AI低质设计。产品人和创业者拿来就能用,14个技能覆盖从构思到审查的全流程。 22:21 Meituan LongCat @ Meituan_LongCat 精选 81 美团 LongCat-2.0 完全开源(MIT 许可),1.6T MoE 模型开放权重与推理代码 美团今日宣布 LongCat-2.0 完全开源(MIT 许可),公开模型权重与推理代码。该模型为 MoE 架构,总参数量 1.6T,每 token 激活约 48B,支持 1M token 上下文。技术亮点包括 LongCat Sparse Attention 高效处理长文本、Zero-Compute Experts 动态激活 33B–56B 零浪费计算、MOPD 按任务路由 Agent/Reasoning/Interaction 三组专家。Benchmark 成绩:Terminal-Bench 2.1 70.8;SWE-bench Pro 59.5(超越 GPT-5.5 的 58.6);SWE-bench Multilingual 77.3;FORTE 73.2;RWSearch 78.8;BrowseComp 79.9。原生集成 Claude Code、OpenClaw、Hermes Agent 等工具,支持 GPU 与 NPU 部署,已在大规模国内集群验证。 Meituan LongCat : Introducing LongCat-2.0 🐱 1.6T parameters · MoE with ~48B active · 1M context The full model behind Owl Alpha on @OpenR... 智能体 开源生态 模型发布 编码 关联讨论 1 条 MarkTechPost(RSS) 推荐理由: 国内大厂首个在 SWE-bench Pro 上超过 GPT-5.5 的开源模型,MIT 协议无任何限制,搞 agentic coding 的团队可以直接用,是个重要转折。 16:19 MarkTechPost(RSS) 精选 72 LlamaIndex 发布 lega

GitHub 开源/仓库 开源生态 智能体 模型发布 编码 检索增强
AI HOT ·

欧盟理事会通过快速通道强制推行"聊天管控"(Chat Control 2.0)

00:53 Hacker News 热门(buzzing.cc 中文翻译) 精选 70 欧盟理事会通过书面程序快速通过一项新法规,强制要求科技集团对加密通信进行无差别扫描(Chat Control 2.0),以填补过渡性规定4月3日到期后的法律漏洞,并向欧洲议会施压。批评者指责该做法试图绕过民主监督。草案将在夏季休会前以紧急程序提交议会表决,多数议员可能已离会,反对需绝对多数,几乎无法阻止。理事会称扫描限于必要范围,处理的数据须在检测后12个月内不可撤销地删除。 安全/对齐 政策/监管 推荐理由: 欧盟理事会用程序快车道强推聊天扫描,实质是绕开议会给政府开加密后门,接下来的几周所有聊天软件用户都该盯着这事。

安全/对齐 政策/监管
AI HOT ·

三周前,我不小心创办了一家小公司

01:53 Hacker News 热门(buzzing.cc 中文翻译) 精选 70 一位父亲为患有自闭症的非语言儿子开发了一款沟通应用,在言语治疗室的等候区展示时,所有非语言儿童的母亲看到后都忍不住流泪,言语治疗师也啜泣了五分钟。他意外发现产品市场匹配,决定腾出时间让更多孩子能用上,即使这意味着几周睡眠不足。应用本身是专为理解语言困难的儿童设计的,与传统的AAC设备不同——后者主要面向身体障碍但语言理解正常的成人。 图像生成 现象/趋势 语音 推荐理由: 这篇文章读来会让人看天花板,一位父亲用 AI 图像和声音克隆为儿子创造了沟通工具,意外找到了产品市场契合。它比任何融资新闻都更让我相信,AI 的真正价值在于解决那些被忽视的具体问题。

图像生成 现象/趋势 语音
AI HOT ·

NVIDIA 联合多所大学提出 ASPIRE:自我改进机器人框架,零样本成功率最高提升 77 分

14:41 MarkTechPost(RSS) 精选 70 NVIDIA 联合密歇根大学、UIUC、UC Berkeley 等提出 ASPIRE,一个持续学习机器人框架。它通过协调器-执行器架构、闭环执行引擎、技能库和进化搜索,编写并优化机器人控制程序。编程智能体使用 Claude Code(Claude Opus 4.6,1M token 上下文窗口)。在 LIBERO-Pro 上最高比最强基线提升 77 分;Robosuite 双手交接成功率从 20% 提升至 92%;BEHAVIOR-1K 收音机拾取任务从 56% 提升至 88%。利用 LIBERO-90 积累的技能,ASPIRE 在零样本条件下对 LIBERO-Pro Long 任务达到约 31% 成功率,此前方法饱和在 4% 附近。 具身智能 论文/研究 推荐理由: ASPIRE让机器人编程从单次尝试变成持续学习,把失败调试沉淀成可复用技能库,长任务零样本直接从4%拉到31%,这条思路比具体数字更有启发性。

具身智能 论文/研究
AI HOT ·

26000名学生研究显示AI隐藏学习成本需两年才显现

17:19 The Decoder:AI News(RSS) 精选 73 一项追踪26000名7-12年级中学生30个月的面板数据研究发现:使用AI后作业分数提升18%,完成时间从64分钟降至45分钟,但闭卷考试分数下降20%,升学考试成绩下降18%至24%,且完全影响约两年才显现。81%长期用户作业完成时间低于50分钟(外包迹象)。社会学科下降27%,STEM下降22%,英语下降17%,语文下降9%。每周使用AI一小时损失约5%,五小时损失30%。早期损失从约25%降至16%但未消失。 现象/趋势 论文/研究 推荐理由: AI助学短期提分但会偷走真正的学习,这2.6万人的研究用两年数据揭穿了安逸的幻觉,是每位家长和开发者都该看的预警。 14:41 MarkTechPost(RSS) 精选 70 NVIDIA 联合多所大学提出 ASPIRE:自我改进机器人框架,零样本成功率最高提升 77 分 NVIDIA 联合密歇根大学、UIUC、UC Berkeley 等提出 ASPIRE,一个持续学习机器人框架。它通过协调器-执行器架构、闭环执行引擎、技能库和进化搜索,编写并优化机器人控制程序。编程智能体使用 Claude Code(Claude Opus 4.6,1M token 上下文窗口)。在 LIBERO-Pro 上最高比最强基线提升 77 分;Robosuite 双手交接成功率从 20% 提升至 92%;BEHAVIOR-1K 收音机拾取任务从 56% 提升至 88%。利用 LIBERO-90 积累的技能,ASPIRE 在零样本条件下对 LIBERO-Pro Long 任务达到约 31% 成功率,此前方法饱和在 4% 附近。 具身智能 论文/研究 推荐理由: ASPIRE让机器人编程从单次尝试变成持续学习,把失败调试沉淀成可复用技能库,长任务零样本直接从4%拉到31%,这条思路比具体数字更有启发性。 13:08 IT之家(RSS) 精选 74 我国研制全球首款基于可控存内计算的忆阻器神经动力学芯片 北京大学集成电路学院联合中科院上海微系统所,发布全球首款基于可控存内计算的忆阻器神经动力学芯片,首次将单步运算时延压缩至2.12毫秒。芯片采用40纳米工艺,存内计算阵列与外围电路总面积0.28平方毫米,运行频率50 MHz,单步积分仅需9级流水。在脑皮层重建等任务中较当前GPU提速50至478倍,突破神经动力学实时计算瓶颈。相关成果7月3日发表于《科学》。 端侧 论文/研究 推荐理由: 全球首款神经动力学芯片将单步时延压至2.12毫秒,首次实现实时计算,比GPU快50倍以上,这是神经拟态芯片落地的关键一步,做实时仿真和边缘AI的可以留意。 03:44 Hacker News 热门(buzzing.cc 中文翻译) 精选 83 pxpipe:通过图像化压缩输入tok

现象/趋势 论文/研究 具身智能 端侧 GitHub 开源/仓库 编码 智能体 Anthropic 教程/实践
AI HOT ·

LlamaIndex 发布 legal-kb:基于 Index v2 的智能体检索参考应用

16:19 MarkTechPost(RSS) 精选 72 LlamaIndex 发布 legal-kb,一个基于 Index v2(LlamaParse Platform)的法律文档知识库参考应用。采用 Retrieval Harness 模式,赋予 Agent 四个文件系统风格工具:retrieve(混合语义检索,支持 rerank 和引用)、findFiles(精确/模糊文件名搜索)、readFile(带偏移量的原始内容读取)和 grepFile(正则匹配并返回字符位置)。Agent 需先调用 findFiles 确定文件清单,再依次使用其他工具定位内容。底层基于 Vercel AI SDK 6 的 ToolLoopAgent,可选用 OpenAI 或 Anthropic 模型,支持用户自带 API key。项目以 TanStack Start web app 形式运行,上传文件自动解析索引,同一文件名重复上传可产生版本,检索时通过版本元数据字段过滤。 智能体 GitHub 检索增强 开源/仓库 推荐理由: LlamaIndex 把 RAG 从一次搜索变成了‘先找文件、再搜、再读、再 grep’的多步循环,对做合同审查、尽调的团队来说是个可抄的模板。

智能体 GitHub 检索增强 开源/仓库
AI HOT ·

美团 LongCat-2.0 完全开源(MIT 许可),1.6T MoE 模型开放权重与推理代码

22:21 Meituan LongCat @ Meituan_LongCat 精选 81 美团今日宣布 LongCat-2.0 完全开源(MIT 许可),公开模型权重与推理代码。该模型为 MoE 架构,总参数量 1.6T,每 token 激活约 48B,支持 1M token 上下文。技术亮点包括 LongCat Sparse Attention 高效处理长文本、Zero-Compute Experts 动态激活 33B–56B 零浪费计算、MOPD 按任务路由 Agent/Reasoning/Interaction 三组专家。Benchmark 成绩:Terminal-Bench 2.1 70.8;SWE-bench Pro 59.5(超越 GPT-5.5 的 58.6);SWE-bench Multilingual 77.3;FORTE 73.2;RWSearch 78.8;BrowseComp 79.9。原生集成 Claude Code、OpenClaw、Hermes Agent 等工具,支持 GPU 与 NPU 部署,已在大规模国内集群验证。 Meituan LongCat : Introducing LongCat-2.0 🐱 1.6T parameters · MoE with ~48B active · 1M context The full model behind Owl Alpha on @OpenR... 智能体 开源生态 模型发布 编码 关联讨论 1 条 MarkTechPost(RSS) 推荐理由: 国内大厂首个在 SWE-bench Pro 上超过 GPT-5.5 的开源模型,MIT 协议无任何限制,搞 agentic coding 的团队可以直接用,是个重要转折。

智能体 开源生态 模型发布 编码
AI HOT ·

我国研制全球首款基于可控存内计算的忆阻器神经动力学芯片

13:08 IT之家(RSS) 精选 74 北京大学集成电路学院联合中科院上海微系统所,发布全球首款基于可控存内计算的忆阻器神经动力学芯片,首次将单步运算时延压缩至2.12毫秒。芯片采用40纳米工艺,存内计算阵列与外围电路总面积0.28平方毫米,运行频率50 MHz,单步积分仅需9级流水。在脑皮层重建等任务中较当前GPU提速50至478倍,突破神经动力学实时计算瓶颈。相关成果7月3日发表于《科学》。 端侧 论文/研究 推荐理由: 全球首款神经动力学芯片将单步时延压至2.12毫秒,首次实现实时计算,比GPU快50倍以上,这是神经拟态芯片落地的关键一步,做实时仿真和边缘AI的可以留意。

端侧 论文/研究
AI HOT ·

pxpipe:通过图像化压缩输入token降低Claude Code成本

03:44 Hacker News 热门(buzzing.cc 中文翻译) 精选 83 pxpipe是一个本地代理,将系统提示、工具文档和历史记录等密集文本渲染为PNG图像,利用图像token成本取决于像素尺寸的特性压缩输入token。在Fable 5模型上,约25k文本token压缩为约2.7k图像token,端到端账单降低59–70%。SWE-bench Lite 10个实例全部通过,成本从$54降至$27;SWE-bench Pro 19对测试中18对判定一致,单次请求成本降低约60%。该方法有损(精确ID等需保持文本),默认仅处理 claude-fable-5 请求,可通过 PXPIPE_MODELS 变量控制。 GitHub 开源/仓库 编码 推荐理由: pxpipe 通过把大量上下文渲染成图像来降低 token 开销,实测能削减 60-70% 的账单,对重度使用 Claude Code 的开发者很诱人,但它有损,精确值可能读错,适合容错高的编码场景。

GitHub 开源/仓库 编码
AI HOT ·

JoyAI App 上线 UGC 数字人功能,用户可"捏"出专属虚拟玩伴

23:46 公众号:京东JoyAI 精选 68 JoyAI App 近日上线 UGC 数字人功能,用户只需上传一张照片即可生成专属虚拟数字分身,支持一键复刻写实形象或通过模板重塑为卡通风格,搭配用户自己的语音即可解锁专属陪伴。该功能复用“万能博士”技术底座,集成 JoyAI 语言、语音、数字人大模型,实现行业领先的全双工对话,支持随时打断、自然接话。数字人兼具情绪陪伴与全能助手属性,可提供点外卖、金融咨询、学英语、规划行程等生活服务。 产品更新 多模态 语音 推荐理由: 京东把数字人技术做成了「传一张照片就能捏」的大众玩具,虽然看不出硬核突破,但对普通用户来说,这是第一次零门槛体验有形象有语音的 AI 玩伴,上手即用。 23:46 公众号:生数科技(Vidu·视频) 精选 70 生数科技发布 Vidu S1,推动视频生成迈向"实时交互"新时代 7月3日,生数科技在2026全球数字经济大会上发布Vidu S1实时交互模型,支持实时视频通话和语音控制视频走向,实现无限时长连续互动。模型采用自回归扩散路线,基于已生成画面和语音指令持续预测后续内容;无需传统建模,一张图片即可创建角色并自定义音色。Vidu S1在540P分辨率下实现25FPS(最高42FPS)实时生成,通过TurboDiffusion等技术降低计算成本,已开启内测。 多模态 模型发布 视频 推荐理由: Vidu S1 把视频生成从离线拉到了实时通话级交互,语音控制无限时长是质变,但只有540P,内测阶段实际延迟和稳定性待看,做虚拟陪伴和直播的可以跟。 23:19 Mistral AI:News(网页) 精选 66 Leanstral 1.5:人人可用的证明丰富性 Mistral AI 今日发布 Leanstral 1.5,一款 Apache-2.0 许可的开源形式化验证模型,119B 总参数仅 6B 活跃。在 miniF2F 上达 100% 饱和,PutnamBench 解决 587/672 题,FATE-H(87%)和 FATE-X(34%)创 SOTA。训练经历 mid-training、SFT 和基于 CISPO 的强化学习。具备智能体式证明能力,在 57 个开源仓库中发现 5 个未知 bug。模型已通过 HuggingFace 和免费 API 开放使用。 Hugging Face 开源/仓库 推理 模型发布 关联讨论 1 条 Hacker News 热门(buzzing.cc 中文翻译) 推荐理由: Leanstral 1.5饱和miniF2F基准,成本仅为同类模型1/75,并自动发现5个真实代码bug,表明AI形式验证开始实用化。虽然受众窄,但对代码正确性有执念的开发者必看。 20:32 歸藏(guizang.ai) @ op7418 精选 75 藏师傅PPT与Pencil结合使用技巧

产品更新 多模态 语音 模型发布 视频 Hugging Face 开源/仓库 推理 图像生成 教程/实践 智能体 安全/对齐 MCP/工具 编码 政策/监管 开源生态 部署/工程 arXiv 数据/训练 论文/研究 Anthropic 大佬观点 行业动态 Meta Microsoft OpenAI
AI HOT ·

Fable 的判断力:Simon Willison 从 Claude Code 团队获得的效率技巧

03:22 Simon Willison 博客 精选 73 Simon Willison 在 AIE 上与 Claude Code 团队交流后建议,让 Fable(以及 Opus)用自己的判断力工作,而非硬性规定行为。例如,直接让 Fable 自行决定何时编写测试,比给出具体规则更好。为应对价格即将上涨、节省 Fable token,Jesse Vincent 的另一个技巧是告诉 Fable 将较小任务委托给较低功耗模型(Sonnet 用于实质性实现、Haiku 用于机械修改),主循环保留判断、审计和数据合成等任务。Willison 已将提示词存入 Claude Code 记忆文件,实际效果良好,Fable token 消耗速度明显下降。 智能体 Anthropic 教程/实践 编码 推荐理由: Simon 从 Claude Code 团队得到的实战技巧:别硬性规定 Fable 怎么写测试、用哪个模型,让它自己判断。他实测这条 prompt 能明显节省代币消耗,Fable 涨价前偷时间的利器。

智能体 Anthropic 教程/实践 编码