AI HOT
·
00:35 IT之家(RSS) 精选 72 菲尔兹奖得主 Timothy Gowers 测试 ChatGPT 5.5 Pro,AI 在 17 分钟内独立解决了一个加法数论公开难题,产出了博士论文级别的成果。整个过程无需数学指导,仅通过简单提示完成。Gowers 警告,若 AI 数学能力按此速度发展,将很快对数学研究领域构成危机,尤其冲击博士生培养。他呼吁数学系紧急应对,帮助学生寻找新出路。另一位菲尔兹奖得主陶哲轩则指出,人类数学家在 AI 时代的核心价值在于“消化”和深入理解证明。 OpenAI 大佬观点 推理 推荐理由: Gowers用GPT-5.5 Pro独立完成了够博士论文的数学成果,这不是AI辅助而是AI主导。两位菲尔兹奖得主同时拉响警报,对正在读博的你来说,这比任何论文都更有冲击力。
OpenAI
大佬观点
推理
AI HOT
·
01:22 Claude:Blog(网页) 精选 70 Anthropic公司正式在AWS上推出Claude平台,为AWS客户提供了通过其现有身份验证、账单及承诺消费抵扣使用完整Claude功能的新途径。该平台首次将全套Claude API功能引入AWS生态,新功能与原生API同日上线。平台包含Claude托管智能体、代码执行、文件API等多项核心功能,并支持最新模型。与Amazon Bedrock上的服务不同,此平台由Anthropic直接运营,数据在AWS边界外处理,适合需要完整平台体验的企业客户。服务将在多数AWS商业区域提供。 Anthropic 产品更新 部署/工程 关联讨论 5 条 X:Claude (@claudeai) X:Claude Devs (@ClaudeDevs) X:Berry Xia (@berryxia) X:OpenRouter (@OpenRouter) Hacker News 热门(buzzing.cc 中文翻译) 推荐理由: Anthropic 第一次把完整 Claude 平台功能全量搬到 AWS 上,用 AWS 账号就能直接拿原生 API 最新特性,对于 AWS 生态里的开发者是个省心的一站式选择,不用再纠结该走 Bedrock 还是原生。
Anthropic
产品更新
部署/工程
AI HOT
·
01:35 Google Gemini @ GeminiApp 精选 63 Google 产品更新 搜索 推荐理由: Google把AI整合个人数据的战场从Gemini单体能力拉到了跨服务串联,旅行规划只是个演示,关键是「个性化智能」这块拼图开始成型,所有依赖用户数据的应用都该看一眼这个方向。
Google
产品更新
搜索
AI HOT
·
01:53 PixVerse @ PixVerse_ 精选 70 OpenAI 图像生成 教程/实践 推荐理由: PixVerse官方分享的这个 GPT Image 2 prompt 模板,一键生成高级时尚拼贴广告图,排版、色彩、构图都给到位了,做电商和社媒素材的可以直接抄作业。
OpenAI
图像生成
教程/实践
AI HOT
·
01:59 Microsoft Research @ MSFTResearch 精选 69 智能体 Microsoft 安全/对齐 论文/研究 推荐理由: 微软发现智能体存在一个令人不安的模式,能执行任务却不会主动优化用户利益,这对埋头做 Agent 的团队是个警钟,能力不等于利他。
智能体
Microsoft
安全/对齐
论文/研究
AI HOT
·
02:01 Replit ⠕ @ Replit 精选 68 智能体 产品更新 编码 推荐理由: Replit 把并行 agent 做进 IDE,一次跑 10 个各干各的再自动合并,这比 Copilot 那种逐行补全激进得多,开发者可以试试能不能真的提速。
智能体
产品更新
编码
AI HOT
·
02:31 MiniMax (official) @ MiniMax_AI 精选 66 Anthropic 行业动态 推荐理由: MiniMax拉上Anthropic、Kimi搞活动送API额度,本质是个面向开发者的社交推广局,不是技术发布,但湾区朋友值得去面基。
Anthropic
行业动态
AI HOT
·
02:52 Claude Code:GitHub Releases(RSS) 精选 72 本次更新引入了多项新功能与优化。核心新增包括:集中管理会话的Agent视图(研究预览)、可设置目标并持续工作的`/goal`命令、实时调整滚轮速度的`/scroll-speed`命令,以及查看插件详情的`claude plugin details`命令。交互界面导航与控制能力得到增强。底层优化涵盖MCP服务器可获取`CLAUDE_PROJECT_DIR`环境变量、`/context all`的令牌估算会考虑模型分词器并显示舍入值。此外,修复了超过20项问题,如凭证死锁、内存无限制增长、权限规则、UI显示错误及路径处理等缺陷。 智能体 Anthropic MCP/工具 产品更新 关联讨论 8 条 X:Claude (@claudeai) X:Claude Devs (@ClaudeDevs) Claude:Blog(网页) X:宝玉 (@dotey) X:Berry Xia (@berryxia) X:Thariq (@trq212) X:小互 (@xiaohu) X:洪明 (@hongming731) 推荐理由: Claude Code 这波更新给了两个真正改变工作流的杀手功能,agent view 让你一眼看清所有会话,/goal 命令能让 Claude 自己跑完一个任务直到满足条件,做开发的同学可以立刻试试。
智能体
Anthropic
MCP/工具
产品更新
AI HOT
·
03:18 Tomer Tunguz 博客(VC 分析) 精选 67 一项为期五周的实验发现,在总计约1400项日常工作任务中,约50%可由本地35B参数模型(如Qwen 3.6 35B)成功处理,涵盖邮件、日程、总结和行政事务等类别。性能对比显示,本地模型在常规代理任务上的平均响应时间为2.8秒,比云端Claude Opus 4.5快2.1倍,尽管后者在复杂推理上仍领先约20%。本地模型输出更简洁,云端模型则在结构和代码规范性上更优。随着本地模型性能提升,将计算负载转向本地以应对云端成本已成为必然趋势。 大佬观点 推理 端侧 推荐理由: Tunguz用数据告诉你,本地35B模型延迟只有Opus的一半且能完成半数任务,对极致追求响应速度的产品思路冲击很大,本地优先可能会从边缘变成主流。
大佬观点
推理
端侧
AI HOT
·
03:23 Chubby♨️ @ kimmonismus 精选 73 Anthropic 现象/趋势 行业动态 推荐理由: Anthropic 5天估值跳涨2000亿,年化营收从1亿飙到450亿,市场在用真金白银押注它吃掉企业市场,这比任何 benchmark 都更有说服力。
Anthropic
现象/趋势
行业动态
AI HOT
·
03:52 Simon Willison 博客 精选 80 本文介绍了一种创新方法,将LLM工具直接嵌入脚本的shebang行中执行指令。通过LLM的fragments模式,shebang行可执行简单任务,如生成SVG图像;使用-T选项能调用外部工具(如llm_time)创作包含当前时间的俳句;更复杂的是运行YAML模板,其中定义了Python函数作为工具进行数学计算,示例中演示了计算2344乘以5252加134的过程,并通过调试输出展示了分步结果,最终得到12,310,822。这展现了LLM作为脚本解释器的强大扩展性,能够支持从内容生成到数据查询的多样化任务。 MCP/工具 教程/实践 推荐理由: Simon 这个 shebang 技巧让 LLM 直接变成脚本解释器,虽然是极客玩法,但对常写自动化脚本的开发者来说可以直接抄走,创意很妙。
MCP/工具
教程/实践
AI HOT
·
04:01 OpenAI Developers @ OpenAIDevs 精选 69 智能体 OpenAI 产品更新 编码 关联讨论 3 条 X:Berry Xia (@berryxia) X:邵猛 (@shao__meng) X:Greg Brockman (@gdb) 推荐理由: 把 Codex 直接接入 OpenAI API 开发流程,这是在给自家开发者递快刀,做 AI 应用和 Agent 的可以第一时间装上,省掉的不只是时间,还有调试的心力。
智能体
OpenAI
产品更新
编码
AI HOT
·
04:59 Luma @ LumaLabsAI 精选 73 智能体 产品更新 图像生成 视频 推荐理由: Luma这次把情绪板直接变广告,做创意的终于不用在PPT和渲染之间反复横跳了,一键出片的感觉很像去年Midjourney上线V6。
智能体
产品更新
图像生成
视频
AI HOT
·
05:10 OpenAI @ OpenAI 精选 60 OpenAI 产品更新 安全/对齐 关联讨论 1 条 X:Kim (@kimmonismus) 推荐理由: OpenAI 把最强模型和 Codex 打包成安全防御专用工具,虽然目前更像是给安全团队的定向特供,但「AI for defense」这个产品化方向本身值得留意。
OpenAI
产品更新
安全/对齐
AI HOT
·
06:13 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 66 2026年第一季度,ChatGPT的用户采用率大幅上升,其中35岁以上用户群体的增长最为迅速,同时用户性别比例也趋于均衡。这表明以ChatGPT为代表的人工智能技术正加速融入主流社会,其应用范围已突破早期以年轻技术爱好者为主的局限,向更广泛、更多元化的普通用户群体拓展。 OpenAI 现象/趋势 推荐理由: 这是我今年看过最值得留意的用户数据,ChatGPT正跳出早期极客圈,35岁以上用户成为增长主力,所有面向大众的AI产品都得重新思考用户画像。
OpenAI
现象/趋势
AI HOT
·
07:36 IT之家(RSS) 精选 77 微软CEO纳德拉在马斯克诉OpenAI案中作证,反驳了马斯克关于OpenAI背离非营利初衷的指控。他出示了马斯克2016年的感谢邮件,证明其当时完全支持微软与OpenAI的合作,且微软为此承受了1500万美元亏损。纳德拉强调,双方一直保持沟通,但马斯克在合作深化期间从未提出抱怨,直至2024年才提起诉讼。他还将2023年OpenAI董事会解雇CEO奥尔特曼的事件评价为“业余之举”,并透露自己曾介入帮助奥尔特曼复职。 Microsoft OpenAI 行业动态 推荐理由: 纳德拉的证词猛料不少,从2016年马斯克感谢微软到微软为OpenAI承受亏损,直接打脸马斯克的诉讼主张。关注AI权力格局演变的,这篇必读。
Microsoft
OpenAI
行业动态
AI HOT
·
07:43 Hugging Face:Blog(RSS) 精选 58 本文面向使用开源框架的机器学习工程师,阐述了AWS如何为大规模基础模型的全生命周期提供核心基础设施。其核心是三大紧密集成的组件:配备多代NVIDIA GPU(如H100、H200及新一代Blackwell B200/B300)的大显存加速计算实例;用于集体通信的高带宽、低延迟网络(节点内NVLink与节点间EFA);以及可扩展的分布式存储。这些基础设施与Slurm/Kubernetes等资源编排系统、PyTorch/JAX等ML框架协同,共同支撑预训练、后训练和推理工作负载,并可通过Prometheus/Grafana实现全栈可观测性。 开源生态 教程/实践 数据/训练 部署/工程 推荐理由: 这篇把AWS上训大模型的全套基础设施串了一遍,从GPU选型到网络存储再到Slurm/K8s编排,是做云端大规模训练的工程师的必读参考。
开源生态
教程/实践
数据/训练
部署/工程
AI HOT
·
08:35 Epoch AI @ EpochAIResearch 精选 77 数据/训练 评测/基准 推荐理由: FrontierMath 是衡量模型数学推理的核心基准,三分之一题目有致命错误这件事会让之前的所有满分评分变得可疑,做评估的人必须重新审视数据。
数据/训练
评测/基准
AI HOT
·
08:55 Hacker News 热门(buzzing.cc 中文翻译) 精选 73 谷歌披露,犯罪黑客利用人工智能技术发现并利用了一个重大的软件漏洞。该漏洞存在于广泛使用的开源软件中,可能导致大规模数据泄露或系统入侵。谷歌威胁分析小组追踪到此次攻击,并确认黑客借助AI工具显著提升了漏洞挖掘的效率与精准度。目前漏洞细节尚未公开,但相关软件维护方已发布安全更新。这一事件凸显了AI技术被恶意用于网络攻击的现实风险,对全球网络安全防御体系提出了新的挑战。 Google 安全/对齐 关联讨论 1 条 IT之家(RSS) 推荐理由: 这不是演习,谷歌亲口确认黑客用AI挖到了真实漏洞,AI降低攻击门槛不再是理论推演,安全从业者该重新评估威胁模型了。
Google
安全/对齐
AI HOT
·
09:05 meng shao @ shao__meng 精选 71 智能体 产品更新 推荐理由: 虽然只是多了一个 Teams 集成,但对于严重依赖微软生态的团队,Cursor 终于不再是‘只有 Slack 才能用’的工具了。
智能体
产品更新