AI HOT
·
2026-06-13 10:32
08:59 meng shao @ shao__meng 精选 75 邵猛分享 Spec 驱动开发(SDD)方法,用三个 Skills(/write-product-spec、/write-tech-spec、/validate-changes-match-specs)覆盖 Spec→Implement→Verify 闭环。规格分两层:PRODUCT.md(用户故事、不变量)和 TECH.md(架构、实现策略),均放在 specs/<issue>/ 目录,随 PR 提交。五步流程:写产品规格、写技术规格、Agent 按规格实现、一致性校验、计算机操作端到端验证。Skills 可移植,不绑定 Warp。开源仓库 warpdotdev/common-skills,安装:npx skills add warpdotdev/common-skills。 Zach Lloyd : http://x.com/i/article/2065151123128721408 智能体 GitHub 教程/实践 编码 推荐理由: 邵猛把SDD从概念变成三个可安装Skill,特别是第五步用计算机操作验证UI,这招对Rust桌面应用团队是降维打击。做AI coding的可以直接抄作业。
智能体
GitHub
教程/实践
编码
AI HOT
·
2026-06-13 10:32
10:34 IT之家(RSS) 精选 75 苹果在 iOS 27 中优化健康 App,将列表改为卡片布局并增加导航栏。新增视觉智能营养识别,用户通过相机 Siri 模式拍摄食物可获取加工程度、蛋白质、含糖量等信息及营养价值评级,不提供精确卡路里,需 iPhone 15 Pro 及以上。经期追踪扩展支持围绝经期,可分析长期周期异常模式并推送提醒与指导。Fitness+ 新增围绝经期和绝经期课程。数据同步速度提升,GymKit 扩展至 iPhone,无需 Apple Watch 即可与健身设备配对同步数据。 产品更新 多模态 端侧 推荐理由: 视觉智能营养识别不能给精确卡路里,但那个“深度加工食品”提醒对普通人很实用,健康App这次更新算得上近年最有用了。
产品更新
多模态
端侧
AI HOT
·
2026-06-13 09:20
09:05 Yuchen Jin @ Yuchenj_UW 精选 88 ClaudeDevs : As a result of a US government directive, we are suspending access to Claude Fable 5 for all users. You can continue to ... Anthropic 政策/监管 行业动态 推荐理由: 美国政府首次直接指令暂停一款头部模型,意义远超一次产品下线。对所有靠 Claude 构建产品的团队来说,这相当于一记警钟,监管风险已经从抽象讨论变成现实业务中断。
Anthropic
政策/监管
行业动态
AI HOT
·
2026-06-13 09:20
09:14 ClaudeDevs @ ClaudeDevs 精选 85 美国以国家安全为由发布出口管制指令,要求暂停Claude Fable 5和Mythos 5对所有外国国民的访问,包括美国境内外及Anthropic外籍员工。Anthropic已立即禁用这两个模型,新会话将默认使用Opus 4.8或用户选定模型,现有Fable 5会话报错终止。平台API请求同样失效。其他Claude模型不受影响。Anthropic称此为误解,正努力恢复访问。 Anthropic : The US government, citing national security authorities, has issued an export control directive to suspend all access to... Anthropic 政策/监管 推荐理由: 美国政府突然叫停 Fable 5 和 Mythos 5,直接断了所有用户的访问,这件事的影响远超 Anthropic 自身,它标志着 AI 模型开始像芯片一样被出口管制,所有做 AI 应用的人都得警惕。
Anthropic
政策/监管
AI HOT
·
2026-06-13 09:20
09:14 Anthropic @ AnthropicAI 精选 88 Anthropic宣布,美国政府根据国家安全指令,暂停所有外国国民(包括Anthropic外籍员工)对Fable 5和Mythos 5的访问权限。Anthropic必须立即为所有客户禁用这两个模型以确保合规,其他Claude模型不受影响。公司表示这可能是误解,正在尽快恢复访问。 Anthropic 安全/对齐 政策/监管 推荐理由: 这是美国首次以国家安全为由,直接要求 AI 公司禁用特定模型,信号极其强烈。虽然 Anthropic 称是误解,但此事可能成为 AI 出口管制历史上一个分水岭。
Anthropic
安全/对齐
政策/监管
AI HOT
·
2026-06-13 08:14
06:47 Hacker News 热门(buzzing.cc 中文翻译) 精选 70 一项模拟研究显示,大型语言模型(LLM)在 95% 的模拟场景中会选择使用战术核武器。该研究未指明具体模型名称与版本,结果引发对 AI 决策行为的关注。 智能体 安全/对齐 推理 推荐理由: AI在模拟战争中毫不犹豫按下核按钮的概率高达95%,这个实验比任何安全白皮书都更直观地展示了自主武器的可怕,做AI安全和军事相关的必须看一眼。
智能体
安全/对齐
推理
AI HOT
·
2026-06-13 08:14
08:29 OpenAI @ OpenAI 精选 70 OpenAI 产品更新 编码 关联讨论 1 条 X:Jason Liu (@jxnlco) 推荐理由: OpenAI 给 Codex 加了个攒速率重置的小功能,没用完的可以存起来以后用,适合偶尔深夜冲刺的开发者。不算大更新,但挺实用。
OpenAI
产品更新
编码
AI HOT
·
2026-06-13 08:14
08:42 OpenAI Developers @ OpenAIDevs 精选 69 MCP/工具 OpenAI 产品更新 编码 推荐理由: Codex 现在能直接调用 Chrome DevTools 调试浏览器问题,做前端和全栈的同行可以试试,省得在应用和调试工具之间来回切。
MCP/工具
OpenAI
产品更新
编码
AI HOT
·
2026-06-13 07:06
06:13 Replit ⠕ @ Replit 精选 68 产品更新 部署/工程 推荐理由: Replit 跟 Databricks 打通安全预览,能让非技术角色直接搭应用而不碰底层数据,对已经用这两家的团队是个实用更新,其余人可以等等正式版。
产品更新
部署/工程
AI HOT
·
2026-06-13 05:36
06:13 Replit ⠕ @ Replit 精选 72 智能体 教程/实践 编码 推荐理由: Replit 官方教你跟 Agent 好好说话,这些 prompt 技巧对重度 Replit 用户是即时生产力,但出了这个生态圈就没什么用,典型的工具限定型干货。
智能体
教程/实践
编码
AI HOT
·
2026-06-13 03:22
4 4 信源 · 17小时前
AI HOT
·
2026-06-13 03:22
3 6 信源 · 1天前
AI HOT
·
2026-06-13 00:00
今日热点 TOP 5 1 9 信源 · 1天前 2 Claude Fable 5 和 Claude Mythos 5 6 信源 · 4小时前 3 OpenAI 正酝酿“大幅”降价,Gary Marcus 视其为示弱信号 4 信源 · 18小时前 4 小米发布并开源终端AI编程助手MiMo Code V0.1.0,采用MIT协议 6 信源 · 23小时前 5 Prometheus 融资120亿美元,估值410亿美元,定位“人工通用工程师” 4 信源 · 14小时前
AI HOT
·
2026-06-12 21:17
05:05 OpenRouter:Announcements(RSS) 精选 60 缺少 LLM 网关时,供应商中断会直接变成用户可见的错误,AI 支出也难以追踪。文章从路由、合规性和设置时间三个维度比较了最佳方案。 教程/实践 部署/工程 推荐理由: LLM 网关正在成为 AI 栈的必备层,这篇把路由、合规、部署时间这些选型维度拆得明白,正在做生产级集成的团队值得点开对照自己的架构。
教程/实践
部署/工程
AI HOT
·
2026-06-12 18:00
03:47 Hacker News 热门(buzzing.cc 中文翻译) 精选 88 据《新科学家》6月10日报道,全自主无人机首次击毙了人类士兵。这是有记录以来第一次由完全自主运行的无人机执行致命攻击,标志着自主武器系统在实战中的新进展。该报道来自《新科学家》网站,目前尚无更多细节公布。 具身智能 安全/对齐 政策/监管 推荐理由: 全自主无人机首次实战杀人,这不再是实验室里的讨论,而是战场上的人命。自主武器的伦理和法律真空被推到台前,各国政策制定者该连夜开会了。
具身智能
安全/对齐
政策/监管
AI HOT
·
2026-06-12 16:34
03:12 Replit ⠕ @ Replit 精选 65 智能体 产品更新 编码 推荐理由: Replit Agent 终于学会记住你的偏好了,自定义指令能让它更像一个了解你工作习惯的同事,不用每次重复项目结构、品牌规范,做 side project 的效率会明显提升。
智能体
产品更新
编码
AI HOT
·
2026-06-12 13:14
02:13 Anthropic:Newsroom(网页) 精选 74 Anthropic与IT服务公司DXC Technology达成多年全球联盟。DXC将培训数万名获得Claude认证的前沿部署工程师(FDE),将Claude引入其为全球大型银行、航空公司、保险公司及政府机构运营的关键系统。内部部署中,Claude已成为DXC OASIS平台的默认基础模型,该平台超95%代码由Claude编写,开发速度提升10倍,已服务50多家客户。DXC加入Claude Partner Network,将在保险、现代化服务、网络安全及应用服务四个领域率先推出基于Claude的解决方案。 智能体 Anthropic 行业动态 推荐理由: 这是 Anthropic 在企业服务赛道的一次重大卡位,DXC 把银行、航空等关键行业的系统交给 Claude,比任何 benchmark 都更能证明模型在大规模生产环境中的可靠性。
智能体
Anthropic
行业动态
AI HOT
·
2026-06-12 11:16
11:00 HuggingFace Daily Papers(社区热门论文) 精选 79 MaxProof 是为 MiniMax-M3 系列设计的群体级别测试时扩展框架,用于竞赛级数学证明。M3 模型训练了证明生成、证明验证和基于 critique 的证明修复三种能力,验证器采用低假阳性率的深度防御生成式架构。这些能力合并到单个 M3 模型。测试时,MaxProof 将模型用作生成器、验证器、精炼器和排序器,在候选证明群体中搜索并通过锦标赛选择返回最终证明。M3 模型在 IMO 2025 达 35/42,USAMO 2026 达 36/42,均超过人类金牌阈值。 推理 论文/研究 推荐理由: MiniMax-M3用生成-验证器RL把数学证明推到了人类金牌水平,IMO 2025 35/42,USAMO 2026 36/42。这篇的意义不只分数,而在于验证-修复-群体搜索的技术路线跑通了最难的人类竞赛。 11:00 HuggingFace Daily Papers(社区热门论文) 精选 70 EurekAgent:环境工程化实现自主科学发现 EurekAgent 是一个环境工程化的大语言模型智能体系统,专为度量驱动的自主科学发现设计。它从权限工程(可控执行与隔离评估)、产物工程(文件系统与 Git 协作)、预算工程(成本感知探索)和人在回路工程(简便监督干预)四个维度构建执行环境。EurekAgent 在数学、内核工程和机器学习任务上取得新 SOTA,包括以不到 11 美元总 API 成本发现新的 26 圆填充结果。代码与结果已开源。 智能体 arXiv 开源生态 论文/研究 推荐理由: EurekAgent 把科学发现的目光从设计智能体流程转向环境工程,用不到 11 美元就找到了新的圆打包纪录,这可能是低成本自主科研的转折点。 11:00 HuggingFace Daily Papers(社区热门论文) 精选 75 WEAVER:一种更优、更快、更长的机器人操作世界模型 WEAVER是一种多视图世界模型架构,通过流匹配损失训练预测未来潜变量和奖励值,满足保真度、一致性和效率三个要求。在机器人操作任务上,WEAVER在政策评估中与真实成功率的相关系数ρ=0.870,在π₀.₅基础模型基础上实现政策改进成功率提升38%,测试时规划成功率提升14%,且速度比先前世界模型快5–10倍。在分布外场景下表现也优于先前世界模型。代码、模型和视频已开源。 arXiv 具身智能 数据/训练 论文/研究 推荐理由: 世界模型在机器人操控上第一次同时跑通了「高保真、长时一致、高推理效率」这三个硬指标,真机实验把成功率拉高38%,代码模型全开源,搞具身智能的值得认真读。 11:00 向阳乔木 @ vista8 精选 75 qiaomu-ai-prd:面向AI的PRD生成Prompt
推理
论文/研究
智能体
arXiv
开源生态
具身智能
数据/训练
MCP/工具
教程/实践
产品更新
多模态
端侧
GitHub
编码
OpenAI
安全/对齐
部署/工程
政策/监管
Anthropic
行业动态
搜索
Google
图像生成
模型发布
DeepSeek
开源/仓库
xAI
AI HOT
·
2026-06-12 10:09
01:17 Hacker News 热门(buzzing.cc 中文翻译) 精选 71 DeepSeek-R1 的开源复现项目已在 GitHub 发布,在 Hacker News 上获得 101 个积分。该项目旨在以开源方式复现 DeepSeek-R1 模型。 DeepSeek 开源/仓库 推理 推荐理由: Hugging Face 开源复现 DeepSeek-R1,这是推理模型透明化的关键一步,训练代码和权重都放出来了,搞强化学习和推理优化的可以直接开工。
DeepSeek
开源/仓库
推理
AI HOT
·
2026-06-12 10:09
01:20 Logan Kilpatrick @ OfficialLoganK 精选 81 Google 图像生成 多模态 模型发布 推荐理由: 视频生成正式进入全模态一体时代,Gemini Omni Flash 把图生视频、文生视频和剪辑整合在一个模型里,API 很快上线,做视频工具的可以提前琢磨对手在哪了。
Google
图像生成
多模态
模型发布