AI HOT
·
04:42 Berkeley RDI:Blog(AI 安全与评测) 精选 78 由伯克利RDI、马克斯·普朗克安全与隐私研究所、Anthropic、OpenAI及谷歌等机构研究人员组成的团队,发布了名为ExploitGym的新基准测试。该测试包含898个真实漏洞,要求AI智能体根据漏洞描述生成完整的漏洞利用程序。结果显示,前沿AI模型已能成功利用相当数量的漏洞,即使在启用ASLR等标准防御措施后,部分攻击仍能成功。这证明AI已具备自主将漏洞转化为实际攻击的能力,该技术具有双重用途:既可帮助防御者评估漏洞严重性,也可能降低攻击者的技术门槛。 智能体 Anthropic OpenAI 安全/对齐 推荐理由: 顶级 AI 模型已能自己把已知软件漏洞变成可运行攻击代码,连 ASLR 等标准防御都挡不住部分攻击,研究更发现模型会主动寻找更危险的意外漏洞。安全行业不能再把这当成假设性问题了。
智能体
Anthropic
OpenAI
安全/对齐
AI HOT
·
09:51 Berryxia.AI @ berryxia 精选 71 杨植麟在视频中拆解Kimi K2模型的训练,仅花费460万美元便在编程大战中击败GPT-5.5等对手。其通过极致优化、线性注意力等架构创新,抹平资源差距,标志AI竞赛规则改变,小团队以聪明设计颠覆大厂传统玩法。 智能体 大佬观点 开源生态 推荐理由: 杨植麟亲自拆解Kimi K2训练内幕,460万美元的训练成本加上实时编程第一的成绩,把堆算力的传统玩法彻底打脸,做AI代理的值得存下来细品。
智能体
大佬观点
开源生态
AI HOT
·
07:55 Claude Code:GitHub Releases(RSS) 精选 67 Claude 工具发布 v2.1.141 版本,带来多项功能新增与优化。主要更新包括:为钩子输出添加 `terminalSequence` 字段以支持无控制终端的桌面通知;新增 `CLAUDE_CODE_PLUGIN_PREFER_HTTPS` 环境变量,便于通过 HTTPS 克隆插件源码;引入 `ANTHROPIC_WORKSPACE_ID` 变量以在多工作区联盟中限定令牌范围。会话管理方面,`claude agents` 命令新增 `--cwd` 参数用于按目录筛选,并优化后台代理的状态归类。用户体验改进包括:在倒带菜单添加“总结至此”选项以压缩早期上下文;长思考超时后旋转指示器变色提供更明确反馈;此外,还修复了 Markdown 表格渲染异常、权限提示逻辑、历史记录管理等超过 30 项问题。 智能体 Anthropic MCP/工具 产品更新 推荐理由: Claude Code 的小版本但修得扎实,MCP 连接、/bg 权限继承、VSCode 语音等一堆边角都补了,Agent 模式稳定性明显提升,强烈建议升级。
智能体
Anthropic
MCP/工具
产品更新
AI HOT
·
04:01 Alibaba Cloud @ alibaba_cloud 精选 63 智能体 模型发布 推荐理由: 阿里云这次发的Qwen-Character,主打长记忆和主动交互,对做游戏NPC和虚拟陪伴的产品经理是个直接可落地的信号,值得看一眼演示视频。
智能体
模型发布
AI HOT
·
03:48 Cursor Blog 精选 67 Cursor发布新工具,用于配置云端智能体开发环境。核心更新包括:支持多仓库环境,使智能体可跨代码库协同工作;提供基于Dockerfile的代码化配置,支持构建密钥并优化缓存,命中缓存后构建速度提升70%;增强由智能体主导的环境设置流程,提供验证与故障回退机制。同时新增环境治理与安全功能,如版本历史、审计日志,以及可在环境级别独立管控的网络出口和密钥权限。这些改进旨在帮助团队在受控环境中更高效地运行能端到端处理任务的并行智能体集群。 智能体 产品更新 部署/工程 推荐理由: Cursor 云代理这次把多仓库、环境即代码和审计控制打包补齐,让开发团队可以真正放养一队 agent 跑端到端任务,企业落地门槛降了一大截。
智能体
产品更新
部署/工程
AI HOT
·
03:29 Claude:Blog(网页) 精选 73 Claude 最新模型在电脑与浏览器使用能力上显著提升,支持构建复杂智能体系统。本文针对Claude 4.6系列和Opus 4.7提供实践指南,重点优化截图分辨率:Claude 4.6系列API限制最大长边1568像素、总像素115万;Opus 4.7提升至最大长边2576像素、总像素375万。发送前将截图缩放到限制内是提升点击准确性的最有效方法。推荐起始分辨率为1280x720,Opus 4.7用户可优先使用1080p,并避免发送未经缩放的原始截图或过低分辨率图像。 智能体 Anthropic 教程/实践 部署/工程 关联讨论 1 条 X:洪明 (@hongming731) 推荐理由: 如果你正在让 Claude 操作桌面或浏览器,这篇官方指南把分辨率、token 压缩和缓存策略一次讲透了,附带代码和踩坑表,是那种"读完就能少写一堆 bug"的硬核文档。
智能体
Anthropic
教程/实践
部署/工程
AI HOT
·
03:32 ClaudeDevs @ ClaudeDevs 精选 60 Anthropic 产品更新 编码 关联讨论 2 条 X:Testing Catalog (@testingcatalog) X:Berry Xia (@berryxia) 推荐理由: 重度 Claude Code 用户月底不用再掐着额度用,50% 的提升虽然离『随便用』还远,但这两个月至少可以放开些手脚了。
Anthropic
产品更新
编码
AI HOT
·
03:18 Tomer Tunguz 博客(VC 分析) 精选 59 知识工作者平均每天收到121封邮件,传统收件箱处理模式难以为继。未来邮件处理将转向高度个性化与自动化:用户能用自然语言定义处理规则,实现收据自动转发、销售线索自动录入CRM等流程。所有历史邮件将构成个人上下文层,为AI处理新邮件提供背景信息,敏感信息则由设备端模型进行私密处理。最终,收件箱本身将消失,真正重要的信息可能浓缩至仅6条。 智能体 大佬观点 端侧 推荐理由: Tunguz 描绘了一个让收件箱消失的未来,关键是那 6 条真正重要的消息如何被 AI 接管,做产品的人可以把这个当成工作流重构的思考起点。
智能体
大佬观点
端侧
AI HOT
·
03:06 Kling AI @ Kling_ai 精选 70 教程/实践 推荐理由: 我觉得 AI 视频圈子里 Gossip Goblin 是能打的,PJaccetturo 挖出的 workflow 每一步都是实操,用 Kling 做动画的朋友直接套就行,少走几个月弯路。
教程/实践
AI HOT
·
02:43 The Decoder:AI News(RSS) 精选 71 根据 Ramp AI 指数数据,Anthropic 在美国企业客户中的采用率达到 34.4%,首次超越 OpenAI 的 32.3%。其业务覆盖范围在一年内增长了四倍。但文章指出,三个因素可能使其领先优势迅速减弱。 Anthropic OpenAI 现象/趋势 行业动态 关联讨论 1 条 X:Kim (@kimmonismus) 推荐理由: Ramp数据第一次把Anthropic压过OpenAI的势头实锤了,这对企业采购决策是个真实信号,不过价格和发布节奏的波动意味着这优势可能很脆弱。
Anthropic
OpenAI
现象/趋势
行业动态
AI HOT
·
02:44 HuggingFace Daily Papers(社区热门论文) 精选 70 吸引子模型解决了循环Transformer训练不稳定、成本高和深度固定的问题。它通过主干模块生成初始输出嵌入,吸引子模块迭代优化固定点,并利用隐式微分计算梯度,使训练内存与有效深度无关,迭代次数自适应收敛。在语言建模中,相比标准Transformer,困惑度最高降低46.6%,下游任务准确率最高提升19.7%,训练成本更低;一个770M参数的模型性能优于1.3B参数Transformer。在推理任务中,仅2700万参数模型在约1000个示例下,于Sudoku-Extreme和Maze-Hard上准确率分别达91.4%和93.1%,优于Claude、GPT o3等前沿模型。模型还展现出均衡内化现象,训练后初始输出嵌入接近均衡态,推理时可移除求解器而性能几乎无损,实现了迭代优化的可扩展性。 推理 数据/训练 论文/研究 推荐理由: 这可能是要改写语言模型训练范式的架构,把迭代推理变成可学习的固定点,770M 性能超 1.3B Transformer,27M 小模型解数独秒杀 Claude、GPT o3。最反直觉的是,训练后模型能内化迭代过程,推理时直接一步到位。
推理
数据/训练
论文/研究
AI HOT
·
01:32 ClaudeDevs @ ClaudeDevs 精选 73 智能体 Anthropic 产品更新 编码 推荐理由: Claude 给付费用户每个月送专项额度跑 Agent SDK 和 Claude Code,把‘编程式使用’从按需付费变成内置预算,靠 Claude 做自动化的开发者该看看这能省多少。
智能体
Anthropic
产品更新
编码
AI HOT
·
02:31 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 62 OpenAI 为 Windows 平台上的 Codex 构建了一个安全沙箱环境。该沙箱通过严格控制文件访问权限和实施网络限制,确保了代码生成与执行过程的安全性。这一举措使得基于 Codex 的编码助手能够以高效且受控的方式运行,在提供强大编程辅助功能的同时,有效隔离了潜在风险,保障了用户系统的安全。 OpenAI 安全/对齐 教程/实践 推荐理由: OpenAI 首度公开 Codex 在 Windows 上的沙箱细节,控制文件访问和网络限制的架构设计讲得很实在,做自主编程代理安全的值得一读。
OpenAI
安全/对齐
教程/实践
AI HOT
·
02:31 Krea @ krea_ai 精选 61 产品更新 图像生成 推荐理由: Krea 2的moodboard分享是个小而实用的功能,对常做视觉创意的团队来说,协作流程能顺畅不少。但别指望它改变创作方式,只是一个方便的补丁。
产品更新
图像生成
AI HOT
·
01:39 阿绎 AYi @ AYi_AInotes 精选 71 Meta首席AI官宣布,Incognito Chat功能正式登陆WhatsApp和Meta AI。与ChatGPT等仅不保存历史记录的“临时聊天”不同,该功能的关键创新在于:对话推理完全在用户手机的硬件安全飞地内进行,Meta工程师无法获取明文,且不产生任何服务器日志,会话结束后数据永久消失。此举将WhatsApp成熟的端到端加密标准应用于AI对话,旨在彻底解决用户对隐私的顾虑,从而鼓励用户与AI讨论健康、财务等敏感话题。作者认为,通过建立深度信任来获取用户更真实的prompt,是推动AI从“玩具”转变为生活基础设施的关键,并预测此类隐私保护模式将成为未来AI产品的标准配置。 Meta 安全/对齐 现象/趋势 推荐理由: Meta 在 20 亿用户的 WhatsApp 上直接把 AI 对话做成了硬件级端到端加密,这不是又一个隐身模式,是直接把隐私顾虑连根拔了,所有做 AI 产品的都得琢磨这个。
Meta
安全/对齐
现象/趋势
AI HOT
·
01:29 Chubby♨️ @ kimmonismus 精选 77 具身智能 现象/趋势 推荐理由: Kim这个反问很扎心,当Figure的机器人跑通8小时轮班时,蓝领这条退路也被封死了,对普通人的就业冲击不再是遥远的事了。
具身智能
现象/趋势
AI HOT
·
01:31 Krea @ krea_ai 精选 73 图像生成 模型发布 推荐理由: Krea 从套壳到自研模型这一步走得关键,专攻美学多样性和风格控制,对设计师来说是个值得立刻上手试的新选择。
图像生成
模型发布
AI HOT
·
01:31 Krea @ krea_ai 精选 61 图像生成 教程/实践 推荐理由: 如果你在用 Krea 2 做视觉参考,这条官方转发的教程一针见血,不用纠结铺满 250 张图,10-20 张好参考就能定调,省时间又有效。
图像生成
教程/实践
AI HOT
·
01:02 Runway:News(网页) 精选 76 Runway正式发布Runway Agent,这是一个能够通过单次对话将创意想法转化为完整、可发布视频的智能创作伙伴。用户只需用自然语言描述需求,Agent便能根据上下文和目标,自主完成概念提案、故事节奏设计、视觉方向规划,并最终生成包含多场景、旁白、对话和音乐的成片。它旨在为品牌团队、营销人员、创意机构和电影制作人快速生产各类视频内容,如品牌宣传、社交媒体素材和短片,将传统需要数天或数周的审核制作周期压缩至几分钟。该产品现已上线,新免费计划用户可获得1500积分用于制作首个视频。 智能体 产品更新 多模态 推荐理由: Runway Agent 把视频生产从“一个团队干一周”变成“一个人聊十分钟”,品牌和内容团队的视频成本结构可能就此改写。
智能体
产品更新
多模态
AI HOT
·
00:28 Anthropic:Newsroom(网页) 精选 80 Anthropic推出“Claude for Small Business”服务包,旨在帮助小型企业弥补在AI应用资源上与大型公司的差距。该产品包含一系列连接器和15个开箱即用的自动化工作流,能将Claude深度集成到QuickBooks、PayPal、HubSpot等企业日常工具中。其核心功能是自动化处理财务、运营、销售等领域的重复性任务,如规划薪资、月末结算、追踪发票和分析营销活动等。用户通过Claude Cowork界面操作并手动批准关键步骤,所有任务均由用户发起和控制,Anthropic承诺保障数据安全。 智能体 Anthropic 产品更新 部署/工程 推荐理由: Anthropic 把 Claude 装进 QuickBooks、PayPal、HubSpot,直接帮小老板跑 payroll、关账、催发票,这是 AI 第一次真正为那些「深夜还在忙杂务」的人减负,小企业主和做 SaaS 的朋友值得细看。
智能体
Anthropic
产品更新
部署/工程