GPT-5.6 发布,Codex 入驻 ChatGPT
2 6 信源 · 1天前
AI and technology watch
聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。
2 6 信源 · 1天前
15:34 Rohan Paul @ rohanpaul_ai 精选 75 Elon Musk : I was clearly wrong about Anthropic. They are obviously currently the leader in AI. No company has released a model as g... Anthropic xAI 大佬观点 关联讨论 1 条 TechCrunch:AI(RSS) 推荐理由: 马斯克难得公开认错,直接称 Anthropic 是当前 AI 领导者,这个表态可能重塑行业竞争叙事。不过更关键的是他提到 Mythos 2 快来了,这才是真正的信号。
3 5 信源 · 1天前
3 6 信源 · 1天前
今日热点 TOP 3 1 14 信源 · 20小时前 2 苹果起诉OpenAI窃取商业机密开发AI硬件 9 信源 · 10小时前 3 GPT-5.6 成为 Microsoft 365 Copilot 首选模型 6 信源 · 1天前
3 8 信源 · 22小时前
今日热点 TOP 4 1 18 信源 · 19小时前 2 苹果起诉OpenAI窃取商业机密开发AI硬件 9 信源 · 9小时前 3 OpenAI 推出 ChatGPT Work:可跨应用自主工作的 AI 智能体 8 信源 · 22小时前 4 GPT-5.6 成为 Microsoft 365 Copilot 首选模型 6 信源 · 1天前
15:31 Elon Musk @ elonmusk 精选 68 0xFunky : Grok Build is crazy. 先不管GPT-5.6是不是release到底好不好用。 先來大大稱讚一下 @grok 的 Grok Build,目前唯一集大成的 coding agentic workflow。 Grok Buil... 智能体 xAI 图像生成 教程/实践 推荐理由: 这个 Grok Build 加 Agent Sprite Forge 的工作流把做 2D 游戏的时间压到了 30 分钟,之前要 1-2 小时,而且品质更好,独立游戏开发者可以直接抄作业。
5 7 信源 · 17小时前
12:01 公众号:龙猫LongCat(美团) 精选 74 美团万亿参数大模型 LongCat-2.0 正式开源,总参数 1.6T,平均激活约 48B,专为真实 Agentic Coding 任务设计。模型引入 LongCat 稀疏注意力机制与 N-gram Embedding,提升长上下文处理效率与 Token 级表示能力。LongCat-2.0 是业界首个在五万卡国产算力集群上完成推理的万亿参数模型,从模型架构、芯片适配到部署策略进行深度协同优化,支持百万上下文高效推理。开源同步提供 BF16、FP8、INT8 等多精度版本及针对国产算力极致优化的推理代码。 GitHub 开源生态 推理 模型发布 推荐理由: 国产算力跑万亿模型的第一份完整开源答卷,代码、芯片适配细节全公开,做国产大模型落地的直接抄作业。
15:27 IT之家(RSS) 精选 75 Meta CEO 扎克伯格首次正面回应公司筹划云基础设施业务一事,否认“算力过剩”猜测,称内部算力需求依然旺盛、满负荷运转。但他同时表示,当前市场对算力出价极高,将部分 AI 基础设施对外出租在财务上更划算。Meta 正制定代号“Meta Compute”的云计算计划,包括开放模型访问权限和直接出租裸算力两条路线。扎克伯格还提及 SpaceX 以每月 12.5 亿美元将数据中心租给 Anthropic 的模式。Meta 2026 年资本支出指引达 1250 亿至 1450 亿美元,计划 2026 年 9 月量产自研 AI 芯片,目标 2027 年部署算力提升至 14 吉瓦。 Meta 行业动态 部署/工程 推荐理由: 扎克伯格首次确认 Meta 要做云业务,从‘自用’到‘出租’的转变很关键,这可能是 AI 基础设施从军备竞赛转向平台化的信号,做底层算力和云服务的团队有必要盯着。
04:46 TechCrunch:AI(RSS) 精选 80 Apple 于周五向美国加州北区联邦法院提起诉讼,指控 OpenAI 窃取商业机密并违反合同。诉状称,OpenAI 高级领导层(包括首席硬件官 Tang Tan)指使前 Apple 员工在招聘过程中窃取机密,包括使用未发布产品的项目代号、要求应聘者携带硬件组件参加面试。Apple 还指控前高级系统电气工程师 Chang Liu 在 2026 年离职加入 OpenAI 后未归还公司笔记本电脑,并用其下载机密技术文档。Apple 称其机密信息已被 OpenAI 用于开发自有硬件产品,例如一项专有金属精加工技术。Apple 要求法院禁止 OpenAI 使用或披露其商业机密,并归还相关材料。 OpenAI 行业动态 关联讨论 8 条 X:Testing Catalog (@testingcatalog) The Verge:AI(RSS) X:Kim (@kimmonismus) X:宝玉 (@dotey) IT之家(RSS) X:Berry Xia (@berryxia) X:Rohan Paul (@rohanpaul_ai) Hacker News 热门(buzzing.cc 中文翻译) 推荐理由: Apple 正式起诉 OpenAI 窃取商业机密,指控前高管引诱员工偷带原型机和技术文档。这不仅是两家巨头的法律战,更可能打乱 OpenAI 的硬件布局,起诉书细节暴露了 AI 公司挖角的灰色地带。
10:13 Claude Code:GitHub Releases(RSS) 精选 62 Claude Code v2.1.206 发布,主要更新包括:为 /cd 命令添加目录路径建议;新增 /doctor 检查以建议修剪 CLAUDE.md 文件中模型可从代码库推导的内容; /commit-push-pr 现在自动允许 git push 到仓库配置的推送远程仓库; /login 支持 Anthropic 运营的公共网关端点;后台智能体在更新后自动升级。修复了过期登录导致所有模型报错、 claude --resume 和 --continue 在启动时无键盘响应、MCP 服务器忽略 request_timeout_ms 配置、OAuth MCP 服务器需手动重新认证、 /model 选择器价格显示错误、桌面会话卡在“运行中”状态、Windows 上键盘输入被忽略等多项问题。 Anthropic MCP/工具 产品更新 编码 关联讨论 1 条 Claude Code:GitHub Releases(RSS) 推荐理由: Claude Code 这次更新修复了一串体验问题,/doctor 检查能帮团队清理冗余的项目文件,后台静默升级也减少了等待时间,日常使用的开发者更新一下不会亏。
08:20 Google Research:Blog(网页) 精选 70 Google Research 发布 SensorFM,一个在超过 100 万亿分钟多模态传感器数据上预训练的大规模基础模型,数据来自 500 万同意参与者,涵盖 100 多个国家及 20 余款 Fitbit 和 Pixel Watch 设备。SensorFM 学习通用的人体生理表征,可迁移至心血管、代谢、睡眠、心理健康及生活方式等 35 项健康预测任务,支持标签高效适配与数据填充,并可作为个人健康智能体的基础工具。该模型旨在解决传统可穿戴健康模型针对单一终点、难以泛化的问题。 Google 多模态 数据/训练 模型发布 推荐理由: SensorFM 在 500 万人、万亿分钟传感器数据上训练出一个通用生理基础模型,35 项任务全面领先,自动调参的代理教室也很有想法,做健康 AI 的人值得细读。
06:51 Hacker News 热门(buzzing.cc 中文翻译) 精选 70 colibrì v1.0 引擎以纯 C 实现、零运行时依赖,可在约 25 GB RAM 的消费级电脑上运行 744B 参数的 GLM-5.2 MoE 模型。模型经 int4 量化后磁盘占用约 370 GB,常驻内存仅 9.9 GB,通过流式加载磁盘专家实现推理。冷解码速度约 GitHub 产品更新 开源生态 部署/工程 推荐理由: 这个单C文件项目让744B的MoE模型在25GB内存的笔记本上跑了起来,虽然慢,但证明了消费级硬件也能把前沿模型‘盘活’,做本地推理的极客值得看看。
5 6 信源 · 23小时前
06:21 Hacker News 热门(buzzing.cc 中文翻译) 精选 71 Cognition 发布迄今最强模型 SWE-1.7,基于 Kimi K2.7 基座训练,通过强化学习管线改进(基础设施、训练稳定性、数据质量、长程任务技术)实现前沿智能水平并大幅降低成本。在 FrontierCode 1.1 Main 基准上达 42.3%(Kimi K2.7 Code 为 30.1%,GPT-5.5 为 43.0%,Opus 4.8 为 46.5%),Terminal-Bench 2.1 达 81.5%,SWE-Bench Multilingual 达 77.8%。模型针对长周期异步任务优化,现已在 Devin(Web、桌面、CLI)通过 Cerebras 以 1000 TPS 提供。 推理 模型发布 编码 推荐理由: Cognition 把 RL 训练的编码模型推到了和 GPT-5.5 叫板的水平,成本还低得多,做代码 agent 的值得认真看看他们的训练稳定性、多集群等思路。
5 7 信源 · 2小时前
06:21 Hacker News 热门(buzzing.cc 中文翻译) 精选 71 Bun 于 2025 年 12 月被 Anthropic 收购,作者使用预发布版 Claude Fable 5 进行了大量 Rust 重写。Bun 最初用 Zig 在一年内构建,如今 CLI 月下载超 2200 万,被 Claude Code 等采用。广泛功能带来稳定性挑战,v1.3.14 修复了多项 use-after-free、内存泄漏等 bug。团队通过 ASAN、Fuzzilli 模糊测试等系统性预防,并借助 Rust 的内存安全特性减少此类缺陷。 开源生态 教程/实践 编码 推荐理由: Bun 创始人把 54 万行 Zig 用 Claude 11 天重写为 Rust,对抗式审查和动态工作流的细节是近期最值得看的 AI 辅助工程实战复盘,做基础设施的可以认真读。
06:21 Hacker News 热门(buzzing.cc 中文翻译) 精选 75 微软研究院推出Flint,一种可视化中间语言,让AI智能体通过简洁的人类可编辑spec自动生成美观图表。用户只需提供数据、语义类型和图表类型,Flint编译器即可推导坐标轴、配色、布局等底层参数。支持46种图表类型,可渲染到Vega-Lite、ECharts和Chart.js三个后端。项目通过npm安装(TypeScript/JavaScript),并提供MCP服务器用于智能体工作流集成。采用弹性布局模型自动优化图表尺寸与间距,已开源。 智能体 Microsoft 开源/仓库 推荐理由: 微软这个 Flint 用语义类型代替了低层图表参数,是给 AI 代理装上了一双会画图的手,开发者现在就能装 MCP server 跑起来,做数据可视化代理的不用再跟 Vega-Lite 的细节搏斗了。
有任何建议或问题,欢迎告诉我们
感谢您的反馈!