来自Code with Claude伦敦现场:我们正在Claude Managed Agents中推出自托管沙箱(公测版)和MCP隧道(研究预览版)。 在您自己的安全边界内运行代理,默认应用您的安全控制。
16:03 Claude @ claudeai 精选 72 Anthropic MCP/工具 产品更新 部署/工程 推荐理由: 把代理的执行环境搬进客户自己的围墙,安全控制默认生效,是企业采用 AI 代理的关键解锁。MCP 隧道则让工具调用更简单。
AI and technology watch
聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。
16:03 Claude @ claudeai 精选 72 Anthropic MCP/工具 产品更新 部署/工程 推荐理由: 把代理的执行环境搬进客户自己的围墙,安全控制默认生效,是企业采用 AI 代理的关键解锁。MCP 隧道则让工具调用更简单。
16:51 IT之家(RSS) 精选 74 地平线机器人实验室发布了其开源的人形机器人全身控制模型 HoloMotion-1。这是一个拥有 4 亿参数的“小脑”大模型,通过 MoE 稀疏激活与 KV-cache 推理机制,在端侧实现了约 300FPS 的实时推理能力。该模型利用互联网视频、光学动捕、VR 遥操作等多种来源的动作数据进行训练,并在真实机器人上成功展示了舞蹈、爬行、健身、搬箱子等复杂动作的零样本迁移能力。相关代码与技术报告已公开。 具身智能 开源生态 模型发布 推荐理由: 地平线开源的这个4亿参数模型,把机器人“小脑”拉到一个小模型级别,300FPS实时跑在端侧,零样本跳舞搬箱子,搞具身智能的该跟进看看了。
17:09 Claude:Blog(网页) 精选 77 Anthropic为其Claude智能体托管平台推出两项更新:自托管沙箱允许用户在自有基础设施或合作云平台上运行工具,确保敏感数据与服务保留在用户控制范围内;MCP隧道则通过轻量网关,使智能体能安全连接企业私有网络内的数据库与API,无需暴露于公网。目前沙箱功能已进入公测,隧道处于研究预览阶段。这两项更新进一步增强了企业用户对智能体执行环境与内部资源访问的安全管控能力。 Anthropic MCP/工具 产品更新 部署/工程 推荐理由: 自托管沙箱把agent执行挪到企业自己的基础设施里,敏感数据不再离开边界,这是让金融医疗等合规行业敢用AI agent的关键能力。MCP隧道补上了内网服务连接,组件已经完整。
12:12 Alibaba Cloud @ alibaba_cloud 精选 70 智能体 产品更新 编码 推荐理由: 阿里云新推的AI设计工具,在无限画布上把自然语言变成React项目,对非技术原型设计师挺友好,但与主流AI编程工具相比壁垒不高。
23:18 Andrej Karpathy @ karpathy 精选 80 Anthropic 行业动态 推荐理由: Karpathy加盟Anthropic,这是继Jonas后又一关键研究员入局,大模型军备竞赛的核心已从算力转向人才密度。
23:27 Yuchen Jin @ Yuchenj_UW 精选 76 Anthropic 行业动态 推荐理由: Karpathy这种级别的人加入Anthropic,相当于举了个牌子说「这地方能做出AGI」,做研究和做产品的都该关注Anthropic接下来的动作。
09:56 Berryxia.AI @ berryxia 精选 76 奥德赛实验室推出Agora-1,这是全球首个实时多agent世界模型,允许多人与AI同时在同一个模拟世界中实时互动并相互影响。该模型以经典游戏GoldenEye死亡竞赛为演示场景,提供可玩研究预览,用户现在即可体验与AI共同参与动态生成的模拟世界。这标志着从单人生成视频向多人共享“活世界”的转变,长期来看可能重塑游戏、模拟、教育、机器人及AI协作等领域,使人类从旁观者变为与AI共同生活的参与者。 智能体 多模态 模型发布 推荐理由: Odyssey把世界模型推进到了多人实时交互,可玩的GoldenEye死亡竞赛预览比任何PPT都有说服力,做游戏和模拟的人得上去打两把。
10:34 Hacker News 热门(buzzing.cc 中文翻译) 精选 77 Anthropic联合创始人将于2026年5月与教皇利奥十四世共同发布首个人工智能通谕“magnifica humanitas”。这是教皇利奥十四世的首次通谕,聚焦人工智能技术与伦理,标志着科技企业与宗教领袖在AI议题上的合作。通谕由梵蒂冈新闻发布,具体探讨人工智能对人类社会的影响,在Hacker News平台获得104点关注,反映了话题的广泛热度。 Anthropic 行业动态 推荐理由: 教皇与Anthropic联合创始人共同发布AI通谕,这是顶尖AI公司首次直接参与最高层级宗教文件,伦理讨论从学术界转向现实权力场,值得关注。
10:45 IT之家(RSS) 精选 73 谷歌与黑石集团宣布合作成立一家新的AI云服务公司,黑石率先投入50亿美元股权资本,结合后续杠杆,总投资规模预计约250亿美元。该公司计划依托谷歌自研的TPU芯片和云基础设施,与CoreWeave等算力服务商展开竞争,并争取在2027年上线容量达500兆瓦的数据中心,相当于一座中等城市的用电规模。此举标志着谷歌迄今最大规模的对外芯片商业化尝试,将加剧与英伟达等公司在AI算力市场的角逐。 Google 行业动态 部署/工程 推荐理由: 谷歌第一次把TPU武装到对外市场,拉黑石砸250亿美元建云公司,要正面抢英伟达的算力饭碗,做AI基础设施生意的人必须盯着这件事。
11:04 Tencent Hy @ TencentHunyuan 精选 72 开源了评估视觉大语言模型(VLLM)对古代汉字视觉感知能力的基准测试Chronicles-OCR。该数据集覆盖了从甲骨文到草书的3000年演变历程,包含7种历史书体与2800张均衡图像。评估涵盖字形定位、细粒度识别、古代文本解析和字体分类四项核心任务,旨在探究视觉分布随时间的变化如何影响模型感知。相关论文与代码已开源。 多模态 开源生态 论文/研究 推荐理由: 腾讯混元开源的视觉感知基准,专攻古汉字识别,覆盖从甲骨文到草书的三千年演变,做 OCR 和视觉模型的可以拿来测测自家模型在历史文本上的感知退化。
11:10 Alibaba Cloud @ alibaba_cloud 精选 60 多模态 模型发布 评测/基准 推荐理由: Qwen3.7 预览版杀进视觉竞技场前五,阿里的多模态追得很快,虽然只是预览但给后续正式版留足了想象空间。
11:51 HuggingFace Daily Papers(社区热门论文) 精选 71 本文提出零专家自蒸馏适应框架,将训练完成的静态混合专家模型转换为高效动态模型。该方法通过在每个混合专家层注入零输出专家,并利用原始模型作为冻结教师进行两阶段自蒸馏适应,以实现稳定的架构转换。在两个大型开源模型及11个基准测试上的实验表明,该方法能消除超过50%的专家计算量,同时仅带来极小的准确率损失,并显著提升端到端推理速度。 推理 论文/研究 部署/工程 推荐理由: 把训练好的MoE直接改成动态的,推理时跳过一半专家,速度提升20%而精度几乎没掉,做模型部署的值得认真看一下这个一行代码不改的蒸馏方案。
08:59 Claude Code:GitHub Releases(RSS) 精选 65 Claude AI助手发布了v2.1.144版本。此次更新主要新增了对后台会话的`/resume`支持,并将“extra usage”更名为“usage credits”。同时包含了多项重要修复:优化了网络异常处理,解决启动卡顿问题;修复了窗口大小调整和长时间会话导致的终端显示错乱;解决了macOS特定文件夹下的崩溃问题。此外,还改进了模型选择持久化、文件读取、工具调用以及MCP服务器分页工具列表的处理,并减少了在VS Code中的渲染故障。本次更新显著提升了工具的稳定性和用户体验。 智能体 Anthropic 产品更新 编码 推荐理由: 如果你被 Claude Code 启动卡住 75 秒折磨过,这次更新终于修了,还支持后台会话 /resume,体验好了一个档次。
09:56 Berryxia.AI @ berryxia 精选 76 Cursor正式推出Composer 2.5模型,宣称其为当前最强大的AI模型。该模型在智能性、长任务持续执行及复杂指令遵循等方面均有显著提升,并声称在同等能力下效率提升10倍。此次升级主要基于扩大训练规模、构建更复杂的强化学习环境以及引入文本反馈机制。值得注意的是,Composer 2.5的底层架构与Moonshot的Kimi K2.5同源。同时,Cursor正与SpaceXAI合作,计划用十倍算力训练下一代更大模型。未来一周内,该模型的包含用量将翻倍。 智能体 产品更新 编码 推荐理由: Cursor把Composer 2.5标榜为最强模型,10倍效率加长任务不崩,底层是训练规模和RL的升级。对编码工具来说专治长上下文忘需求的毛病,下周双倍用量赶紧上手试。
08:56 Berryxia.AI @ berryxia 精选 77 Anthropic宣布Claude Design所有计划的Token限制翻倍。这解决了以往在处理完整UI设计、多页设计稿或复杂Agent工作流时频繁出现的token不足问题。翻倍后的空间显著提升了连续创作的体验,让该工具在vibe coding、原型制作等任务中实用性大增,从“能用”跃升至“真香”。这体现了Anthropic为提升竞争力而对创作工具的持续优化。 智能体 Anthropic 产品更新 编码 推荐理由: Claude Design 的 token 限制翻倍,对做完整 UI 和多页设计稿的开发者是质变,以前撞墙的问题直接消除,vibe coding 体验再上一个台阶。
08:56 meng shao @ shao__meng 精选 79 针对AI协作编码中“规格永难完整”与“决策无法追踪”的核心矛盾,此提示词提出了第三条路径。它要求AI在实现需求时同步维护一份结构化文档,明确记录设计决策、对规格的偏离、考虑过的权衡以及待确认的开放性问题。这种方法的关键在于将AI执行过程中的隐性判断显式化、文档化,从而让Code Review可直接对照决策笔记,而非逆向工程代码。它不仅降低了模型的过度澄清倾向,更通过提供结构化产物,建立了一种可审计、可协作的人机开发新范式。 智能体 Anthropic 教程/实践 编码 推荐理由: 这个提示词解决了AI编码最棘手的问题,spec永远写不全,决策藏在diff里。把判断变成可审计的文件,review时直接对照笔记而非逆向工程,做coding agent的值得随时复制。
07:45 IT之家(RSS) 精选 70 近日,小米在 CVPR 2026 NTIRE 图像恢复与增强赛事中获得三项大奖。小米玄戒多媒体算法团队凭借自研SPANV2方法,以综合得分4.43夺得高效超分辨率赛道冠军,实现了画质与速度的均衡提升。小米大模型应用团队通过双阶段级联框架与单步扩散技术,获得人像修复赛道冠军;并在反光消除赛道通过骨干网络升级与知识蒸馏等策略获得亚军,主观评分达4.31分,多项客观指标位列第一。 arXiv 图像生成 论文/研究 推荐理由: 小米拿了三个 NTIRE 冠军,超分的 SPANV2 思路挺务实,把速度和质量平衡得不错,搞图像增强的可以看看论文,也许能直接用到移动端。
03:50 Claude @ claudeai 精选 75 Anthropic 产品更新 图像生成 多模态 推荐理由: Claude Design 令牌加倍,做图做设计的人现在可以更放肆地挥霍上下文了,Anthropic 这波更新把设计工具的可用性拉高了一个档次。
05:11 xAI:News(网页) 精选 68 xAI于2026年5月18日正式推出Grok的“Skills”功能,旨在提供持久的专业知识支持。该功能允许用户对Grok进行一次性的偏好、格式规则或工作流程设置,即可在所有对话中持续生效,无需重复说明。Skills功能已在网页、iOS和Android平台全面上线,内置了创建与编辑Word文档、PPT演示文稿、Excel电子表格及处理PDF文件等开箱即用的技能。用户可以覆盖内置技能进行自定义,也能够通过对话快速创建新技能,从而实现工作流自动化与专业文档的便捷生成。 智能体 xAI 产品更新 推荐理由: Grok 终于有了自己的「GPTs」式技能系统,文档、表格、PPT 一把抓,对办公场景的覆盖比单纯的对话助手实用多了,值得 Grok 用户上手一试。
03:43 ClaudeDevs @ ClaudeDevs 精选 64 Anthropic MCP/工具 产品更新 编码 推荐理由: Claude Code 把 fast 模式默认切到 Opus 4.7,如果你之前嫌慢,现在可以试试 /fast,不过这个更新更像是体验优化,不是能力跃迁,真正的看点还得等模型本身的大版本。
有任何建议或问题,欢迎告诉我们
感谢您的反馈!