AI HOT
·
22:15 OpenBMB @ OpenBMB 精选 71 社区开发者基于MiniCPM5-1B和MiniCPM-V 4.6构建了本地优先的数学智能体TeXada。该Agent支持自然语言直接转LaTeX、手写/图像公式OCR转可编辑LaTeX、LaTeX补全与错误修复等核心功能。所有推理在本地完成,无需依赖云服务,保障隐私安全,适用于学生、研究人员和开发者随时随地处理数学表达式。已开源至GitHub,并提供HuggingFace模型下载。 智能体 GitHub 开源/仓库 端侧 推荐理由: 社区开发者用 MiniCPM 轻量模型做的本地数学助手,LaTeX 输入变得像聊天一样自然,是个小而美的端侧实用案例。
智能体
GitHub
开源/仓库
端侧
AI HOT
·
07:38 Tomer Tunguz 博客(VC 分析) 精选 57 一种为AI智能体设计的预检工作记忆架构:查询到来时,系统从磁盘上约90个索引化的技能库中检索最相关技能,仅加载到上下文窗口。本地开源模型Ornith 35B(350亿参数,通过Ollama在Apple Silicon上运行)执行任务,约80%常规任务由本地模型完成,困难任务路由至前沿模型。看门狗记录每次预检决策和技能调用,夜间通过异步推理处理全天轨迹,自动决定哪些技能需新增或固化(如日历排期转为确定性Rust代码),实现自我改进循环。昨天,看门狗首次未提出任何改进建议,系统或接近性能平台期。 智能体 大佬观点 部署/工程 推荐理由: Tunguz 把代理的记忆问题拆成预检+看门狗,不是大模型调参,而是软件架构层的优化,做 agent 的开发者可以直接偷师。
智能体
大佬观点
部署/工程
AI HOT
·
5 5 信源 · 2小时前
AI HOT
·
5 5 信源 · 1小时前
AI HOT
·
02:22 Chubby♨️ @ kimmonismus 精选 76 Chubby♨️ : GPT-5.6 is here but also the long awayited Superapp the tl;dr The model side is impressive, but expected: GPT-5.6 Sol is... 智能体 OpenAI 推理 模型发布 推荐理由: GPT-5.6 这次不止是模型分数提升,ChatGPT Work 把文档、Slack、Notion 等整合成输出,这可能是 OpenAI 对应用层的真正押注,产品人得看看。 01:40 Anthropic:Newsroom(网页) 精选 56 Anthropic发起"硬问题"倡议,邀请公众提出AI相关尖锐问题 Anthropic作为公益公司,发起“硬问题”倡议,邀请公众就AI对就业、社会、家庭、科学医学等领域的影响提出最尖锐的问题。此前已通过多种方式收集看法:首轮调查询问5.2万美国人;通过Anthropic Interviewer调查了159个国家70种语言的8.1万Claude用户;开展数十场线下焦点小组;并基于匿名真实数据研究Claude使用情况。公司还设立了Anthropic Institute和Long-Term Benefit Trust以监督公益使命进展。Anthropic承诺将公开追踪并报告针对这些问题的具体行动及成效。 Anthropic 安全/对齐 行业动态 推荐理由: Anthropic 不再只做技术输出,开始系统性收集公众对 AI 的恐惧和期待,并承诺公开回应——这是头部 AI 公司一次认真的公共对话实验,值得关注后续回应。 01:29 Sam Altman @ sama 精选 72 显然是我们有史以来最好的模型,也是我们写得最好的博文之一: https://openai.com/index/gpt-5-6/ OpenAI 模型发布 推荐理由: Altman 很少用「有史以来最好」这种话来形容自己的产品,GPT-5.6 大概率是又一次代际跃迁,真正值得关注的是博客里有没有藏着成本或能力的质变信号。 01:12 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 80 OpenAI 推出 ChatGPT Work:可跨应用自主工作的 AI 智能体 OpenAI 发布 ChatGPT Work,一个能跨应用和文件收集信息、将复杂项目分解为小步骤独立完成并持续工作数小时的 AI 智能体。它内置 Codex 技术,目前每周超 500 万用户使用 Codex,其中超 100 万用于非软件开发场景。ChatGPT Work 由今天同步推出的最新前沿模型 GPT‑5.6 驱动,具备多步骤推理和按模板生成材料的能力。该功能今天起面向 Pro、Enterp
智能体
OpenAI
推理
模型发布
Anthropic
安全/对齐
行业动态
政策/监管
具身智能
AI HOT
·
04:18 Ars Technica:AI(RSS) 精选 72 一男子使用Grok生成7000张继女儿童性虐待材料(CSAM)后自杀。更多年轻女孩起诉X平台,指控其涉及Grok生成CSAM,并包庇儿童性犯罪者。 xAI 安全/对齐 行业动态 推荐理由: 这起诉讼把 Grok 的内容审核问题直接推到了刑事犯罪层面,普通人看到的是猎奇,从业者该读的是'生成式 AI 的滥用边界到底怎么管',这个判例可能影响未来所有模型的安全设计。
xAI
安全/对齐
行业动态
AI HOT
·
04:38 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 58 OpenAI近日公布国家安全原则,阐明在政府及国家安全领域部署前沿AI系统的方针。原则强调在保护公民、防御关键基础设施、提供公共服务及应对新兴威胁(网络防御和生物安全)中发挥AI优势,同时确保民主问责、人类判断和法治。过去一个月,OpenAI通过Daybreak网络防御计划与澳大利亚、加拿大、日本、韩国、法国、德国、波兰、荷兰及欧盟ENISA等机构建立网络安全信任访问合作,并与英国政府开展网络安全测试评估。上月,OpenAI向部分美国政府及盟友合作伙伴开放GPT‑Rosalind模型用于公共卫生和生物防御。原则适用于现有及未来合作,包括与Department of War的协议,明确禁止大规模国内监控、自主武器系统及高风险自动化决策。OpenAI支持立法对高风险军事用途(如国内监控、自主武器)建立保障措施。 OpenAI 安全/对齐 行业动态 部署/工程 推荐理由: OpenAI 首次公开发布国家安全合作原则,同时宣布与多国建立网络和生物防御伙伴关系。我觉得这是头部 AI 公司在军事合作上的一次主动透明化尝试,值得看看他们如何设限。
OpenAI
安全/对齐
行业动态
部署/工程
AI HOT
·
06:22 Runway @ runwayml 精选 69 产品更新 图像生成 多模态 推荐理由: Seedream 5.0 Pro 的集成让 Runway 的图像生成多了一个强力选择,14 种语言的可读文字生成是实用亮点,做多语言海报的设计师可以试试。
产品更新
图像生成
多模态
AI HOT
·
07:16 IT之家(RSS) 精选 73 Anthropic今年第三季度利润预计超10亿美元,已于6月1日秘密提交IPO申请,若成功将成为规模最大AI实验室IPO。其与OpenAI的年度经常性收入合计接近1000亿美元。凭借Claude Code在软件开发领域的快速普及,Anthropic在2026年实现AI模型盈利变现,成为B2B市场领跑者。SemiAnalysis报告认为其商业模式优越,若持续良好执行,市值可能触及6万亿美元。 Anthropic 行业动态 推荐理由: Anthropic抢先提交IPO,利润超10亿美元,在OpenAI推迟上市的档口,这一步会让整个AI赛道的资本竞赛明显提速,投资人该坐不住了。
Anthropic
行业动态
AI HOT
·
07:27 Anthropic:Research(发表成果 · 网页) 精选 68 Anthropic与AE Studio联合提出梯度路由辅助模块(GRAM)方法,通过在Transformer每层添加可移除的神经元模块,使模型在训练时将病毒学、网络安全、核物理、专业编程语言等双重用途知识仅路由到对应模块,而非扩散至全局。训练后删除模块即可消除该能力,保留则供可信部署使用。实验在合成数据、真实数据及50M到5B参数模型上测试,GRAM效果与数据过滤相当,移除模块不降低通用性能,且比事后“遗忘”技术更难恢复。该研究为平衡双重用途知识的安全访问与有益使用提供了更鲁棒的方案。 Anthropic 安全/对齐 数据/训练 推荐理由: 这是Anthropic在模型安全对齐上的一个新尝试,提出可拆卸模块来精细控制有毒知识,同时保留一般性能。方法还未上Claude,但实验结果表明这条路可能比简单的拒绝训练更鲁棒。
Anthropic
安全/对齐
数据/训练
AI HOT
·
01:58 Cursor Blog 精选 80 Cursor 与 SpaceXAI 联合训练了混合专家模型 Grok 4.5,在数万亿 tokens 的 Cursor 用户交互数据上训练,并通过强化学习解决软件工程、数据科学、金融、法律等领域的困难问题。基础版定价 $2/M 输入 tokens、$6/M 输出 tokens,快速版 $4/M 输入 tokens、$18/M 输出 tokens。即日起在 Cursor 桌面、网页、iOS、CLI 及 SDK 中可用,个人和团队计划首周使用量翻倍。Grok 4.5 与 Composer 2.5 为不同权重类别,两者将继续支持。 推理 模型发布 编码 关联讨论 8 条 X:OpenRouter (@OpenRouter) X:Michael Truell (@mntruell) xAI:News(网页) The Decoder:AI News(RSS) IT之家(RSS) MarkTechPost(RSS) X:Berry Xia (@berryxia) X:Elon Musk (@elonmusk, xAI) 推荐理由: Cursor 联合 SpaceXAI 发布 Grok 4.5,这是他们第一款跳出代码场景的通用模型,对于 Cursor 用户意味着日常大部分文字工作都能直接在编辑器里完成,第一周还双倍用量,值得试一下。
推理
模型发布
编码
AI HOT
·
04:08 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 70 OpenAI 对编码评测基准 SWE-Bench Pro 进行详细审计,发现约 30% 的任务存在缺陷。在 731 个任务的公开子集中,前沿模型通过率在八个月内从 23.3% 提升至 80.3%,但数据质量检查显示大量任务存在测试过于严格、提示词描述不足、测试覆盖不全或误导性提示等问题。OpenAI 建议模型开发者仔细审视评测结果,并指出 AI 智能体在规模化数据质量检查中日益增长的实用性。 OpenAI 编码 论文/研究 评测/基准 关联讨论 2 条 X:OpenAI (@OpenAI) The Decoder:AI News(RSS) 推荐理由: OpenAI 自己审计了 SWE-Bench Pro,发现三成任务有缺陷,这个基准给出来的分数可能要打问号,做模型评测和选型的人该认真看看。
OpenAI
编码
论文/研究
评测/基准
AI HOT
·
23:25 OpenRouter @ OpenRouter 精选 65 产品更新 推荐理由: OpenRouter 聊天室新加了一键 ZDR,对比模型时请求数据不存储,注重隐私的开发者会开心,但毕竟只是个开关,算不上大新闻。
产品更新
AI HOT
·
23:25 Replit ⠕ @ Replit 精选 68 智能体 产品更新 编码 推荐理由: Replit 给 vibe coders 加上了个人主页和工作证明,用活动图和排名展示 agent 使用,让 AI 编程社区有了社交层,但实质还是功能小更新,对非重度用户意义有限。 23:25 OpenRouter @ OpenRouter 精选 65 新功能:聊天室一键ZDR(零数据保留) 在完全隐私保护下横向对比模型:https://openrouter.ai/chat 产品更新 推荐理由: OpenRouter 聊天室新加了一键 ZDR,对比模型时请求数据不存储,注重隐私的开发者会开心,但毕竟只是个开关,算不上大新闻。 22:33 Mistral AI:News(网页) 精选 70 Robostral Navigate:Mistral AI 首个具身导航模型 Robostral Navigate 是 Mistral AI 首个具身导航模型(8B 参数),仅用单 RGB 摄像头,在 R2R-CE 验证集上取得 76.6%(unseen)和 79.4%(seen)的成功率,超越最佳单摄像头方法 9.7 个百分点,超越使用深度或多摄像头的系统 4.5 个百分点。模型通过 pointing 预测目标坐标并结合强化学习持续改进,全部在模拟中训练(约 40 万轨迹、6000 场景),采用 prefix-caching 实现高效训练。通用适配轮式、腿式和飞行机器人,能适应真实环境中未训练的障碍。 具身智能 多模态 模型发布 推荐理由: Mistral 首个具身导航模型,只用单 RGB 摄像头就在未见环境中跑赢深度传感器方案,对机器人行业是个真信号,做物流和制造的可以仔细看看。 21:22 字节 Seed:Research Feed(网页内嵌数据) 精选 78 Seedream 5.0 Pro 发布:不止"生成",更懂"设计" 字节 Seed 今日发布多模态图像创作模型 Seedream 5.0 Pro,在图文匹配、结构合理性、文字渲染与画面美感上全面升级。四大核心突破:复杂信息可视化,可生成高密度信息图;交互式精准编辑,支持点选、圈选、草图渲染、色彩与材质替换、图层分离及多图融合,实现像素级编辑;真实的影像与人像质感,还原光影、材质与皮肤肌理;原生多语种输入与生成,支持十余种语言及本地化视觉特征。已陆续在豆包、即梦、火山方舟等平台上线。 图像生成 多模态 模型发布 关联讨论 1 条 IT之家(RSS) 推荐理由: 字节这次发布的 Seedream 5.0 Pro 把图像生成从「画得好看」推进到「能输出信息图、能精准编辑」的实用设计工具,尤其复杂信息图和交互编辑是当前竞品明显短板,做设计的值得立刻试试。 20:14 Berryxia.AI @ berryxia 精选 76
智能体
产品更新
编码
具身智能
多模态
模型发布
图像生成
GitHub
MCP/工具
开源/仓库
OpenAI
安全/对齐
行业动态
论文/研究
Anthropic
部署/工程
政策/监管
arXiv
推理
视频
Hugging Face
开源生态
数据/训练
大佬观点
教程/实践
Meta
Microsoft
现象/趋势
AI HOT
·
00:21 Hugging Face:Blog(RSS) 精选 66 Hugging Face 宣布 transformers vLLM 后端现与手写原生 vLLM 实现速度相当甚至更快。模型作者无需移植代码,即可自动利用 transformers 获得超快推理。测试使用 Qwen3-4B(单 GPU)、Qwen3-32B(张量并行)和 Qwen3-235B-A22B-FP8 MoE(数据+专家并行)三种配置,吞吐量均达到或超过原生。该后端通过 torch.fx 静态分析图、AST 重写代码实现动态层融合,支持张量/管道/专家并行及 torch.compile。用户仅需添加 --model-impl transformers 标志。目前不支持线性注意力模型但即将支持。 Hugging Face 产品更新 推理 部署/工程 推荐理由: 用 transformers 写的模型,现在不用改一行代码就能在 vLLM 里跑到手写实现的水平,模型作者最大的集成痛被抹平了。虽然主要是工程黑魔法,但生态意义不小。
Hugging Face
产品更新
推理
部署/工程
AI HOT
·
21:22 字节 Seed:Research Feed(网页内嵌数据) 精选 78 字节 Seed 今日发布多模态图像创作模型 Seedream 5.0 Pro,在图文匹配、结构合理性、文字渲染与画面美感上全面升级。四大核心突破:复杂信息可视化,可生成高密度信息图;交互式精准编辑,支持点选、圈选、草图渲染、色彩与材质替换、图层分离及多图融合,实现像素级编辑;真实的影像与人像质感,还原光影、材质与皮肤肌理;原生多语种输入与生成,支持十余种语言及本地化视觉特征。已陆续在豆包、即梦、火山方舟等平台上线。 图像生成 多模态 模型发布 关联讨论 1 条 IT之家(RSS) 推荐理由: 字节这次发布的 Seedream 5.0 Pro 把图像生成从「画得好看」推进到「能输出信息图、能精准编辑」的实用设计工具,尤其复杂信息图和交互编辑是当前竞品明显短板,做设计的值得立刻试试。
图像生成
多模态
模型发布
AI HOT
·
22:33 Mistral AI:News(网页) 精选 70 Robostral Navigate 是 Mistral AI 首个具身导航模型(8B 参数),仅用单 RGB 摄像头,在 R2R-CE 验证集上取得 76.6%(unseen)和 79.4%(seen)的成功率,超越最佳单摄像头方法 9.7 个百分点,超越使用深度或多摄像头的系统 4.5 个百分点。模型通过 pointing 预测目标坐标并结合强化学习持续改进,全部在模拟中训练(约 40 万轨迹、6000 场景),采用 prefix-caching 实现高效训练。通用适配轮式、腿式和飞行机器人,能适应真实环境中未训练的障碍。 具身智能 多模态 模型发布 推荐理由: Mistral 首个具身导航模型,只用单 RGB 摄像头就在未见环境中跑赢深度传感器方案,对机器人行业是个真信号,做物流和制造的可以仔细看看。
具身智能
多模态
模型发布
AI HOT
·
20:14 Berryxia.AI @ berryxia 精选 76 在校研究生Kunkun开源了一套管理大量互相调用Skill的方法。核心方案包括:1)搭建HTML后台,按运行模式(手动/自动)、链路位置、专业领域三类标签筛选Skill;2)将连环调用的Skill绘制成Mermaid流程图,根据debug、新功能、合PR、改设计等阶段定位对应技能组;3)仿照Matt的ask Matt技能开发“ask me”技能,将调用决策浓缩成上下文喂给模型。该方法避免将所有调用交给模型自行判断,保持工程复杂场景下的人机对齐与可控性。项目已开源至GitHub。 KunKun折腾手记 : 分享一下我现在随着 skill 越来越多、并且互相之间都有调用关系的情况下,是如何去管理 skill 并且去协调这些 skill 的使用的。 首先,我会建一个 HTML,它主要分为两块: 第一块是类似后台的索引块。在索引块这边,你可以通过标... 智能体 GitHub MCP/工具 开源/仓库 推荐理由: 这套方法把 Skill 管理的索引、流程和决策浓缩打包,是当前最落地的实践之一,尤其适合被 agent 调用链搞晕的开发者。一个在校生能做出这样清晰的开源方案,值得直接拿去用。
智能体
GitHub
MCP/工具
开源/仓库
AI HOT
·
4 3 信源 · 21分钟前
AI HOT
·
16:44 Hacker News 热门(buzzing.cc 中文翻译) 精选 81 Noma Labs 在 GitHub Agentic Workflows 中发现严重提示词注入漏洞 GitLost。未认证攻击者仅需在属于同一组织的公共仓库中创建一个嵌有恶意指令的 Issue,即可诱使基于 Claude 或 GitHub Copilot 的 AI 代理读取并公开该组织内私有仓库的内容。攻击无需编码技能或凭证,根源在于代理将用户可控内容视为可信指令,且 GitHub 的防护措施因 "Additionally" 关键词被绕过。Noma Labs 已公开 PoC 并建议限制跨仓库权限、隔离用户输入。 智能体 GitHub 安全/对齐 推荐理由: GitLost 是第一个有完整复现的 GitHub AI 代理泄露私有仓库漏洞,展示了 AI 代理的上下文窗口即攻击面,做 AI 应用或 CI/CD 的人都该看一下。
智能体
GitHub
安全/对齐