我们正在扩大与新加坡的合作,以帮助安全地大规模部署AI。🇸🇬 与各国专家合作,我们的新项目将重点加速科学发现、加强大流行病防范并改善医疗保健。 了解更多 → https://goo.gle/49jGwjv
08:45 Google DeepMind @ GoogleDeepMind 精选 60 Google 安全/对齐 行业动态 推荐理由: 又一个AI国际合作,谷歌和新加坡在医疗和疫情准备上搞合作,对国内开发者没什么直接可用的,但看看大厂的战略方向有点参考价值。
AI and technology watch
聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。
08:45 Google DeepMind @ GoogleDeepMind 精选 60 Google 安全/对齐 行业动态 推荐理由: 又一个AI国际合作,谷歌和新加坡在医疗和疫情准备上搞合作,对国内开发者没什么直接可用的,但看看大厂的战略方向有点参考价值。
09:57 Hacker News 热门(buzzing.cc 中文翻译) 精选 70 近期发布了开源数据库Models.dev,专门收录人工智能模型的各项规格、定价及功能信息。该项目在GitHub公开,便于开发者查询和比较不同AI模型。其在Hacker News社区获得101点关注度,显示出技术社区对这类集中化、透明化的模型信息资源的较大兴趣。 GitHub 开源/仓库 搜索 推荐理由: 做AI产品选型最烦的就是到处翻定价和规格页,这个开源数据库把常用模型的底细都摊开摆明了,实用,建议存为浏览器首页。
08:16 Hugging Face:Blog(RSS) 精选 68 NVIDIA 在 Hugging Face 发布了关于 Nemotron-Labs 扩散语言模型的技术博客。该研究聚焦于通过扩散语言模型架构大幅提升文本生成速度,目标是逼近“光速级”生成效率。文章可能介绍了该模型在生成速度上的突破,以及相较于传统自回归模型在延迟和吞吐量方面的性能优势。具体技术细节或对比数据需参考原文。 推理 数据/训练 论文/研究 推荐理由: NVIDIA 用扩散模型做文本生成,目标是逼近光速推理,虽然还是实验室阶段,但对实时交互场景可能是个颠覆性思路,做 NLP 的值得追一下。
08:09 IT之家(RSS) 精选 70 奥纬咨询研究发现,AI工具正被广泛用于入门级任务,导致企业招聘重心转向高级岗位,年轻人求职难度加大。科技行业受冲击最严重,74%的CEO已冻结或缩减招聘。计划削减初级岗位的比例从17%跃升至43%,而招聘转向中层岗位的比例则升至30%。尽管超90%的企业在部署AI,但多数仍处试点阶段。报告警告,过快裁员或忽视初级人才储备,可能对人才梯队造成长远风险。 现象/趋势 行业动态 推荐理由: 奥纬咨询的全球CEO调查把AI对就业的冲击从隐约的趋势变成了具体数字,74%的科技CEO冻结招聘,入门岗位两年内砍半,年轻人是最大输家,这份报告该让所有在找工作的应届生有点警惕了。
07:09 IT之家(RSS) 精选 79 英伟达发布2027财年Q1财报,营收816亿美元,同比增长85%,净利润583亿美元,翻两倍多,市值达5.7万亿美元,已超德国2026年GDP预测。黄仁勋预测,超大规模云厂商的AI基建年度开支将从当前的1万亿美元,增长至3-4万亿美元,远超华尔街预期。财报同时显示,数据中心业务营收752亿美元,占比超九成。值得注意的是,AI基建的高能耗正推高居民电费,数据中心用电成本转嫁效应已初步显现。 大佬观点 现象/趋势 行业动态 推荐理由: 黄仁勋的4万亿美元AI基建预测比华尔街共识高四倍,不是吹牛,是给AGI时代的入场券标价,所有云厂商已经用脚投票了。
06:57 Rohan Paul @ rohanpaul_ai 精选 79 Google DeepMind提出了AlphaProof Nexus系统,它将大型语言模型与Lean形式化验证工具相结合。该系统允许LLM在生成证明的过程中,不断读取Lean的编译错误并进行修正,还可调用更强的工具辅助解决子问题。这一机制迫使模型将每一步逻辑都转化为可编译、可验证的代码,从而将其角色从“令人信服的叙述者”转变为“候选方案生成器”。在针对353个Erdős问题和492个开放猜想的测试中,系统成功解决了9个Erdős问题并证明了44个序列猜想。该研究展示了形式化验证在暴露AI逻辑错误、建立“人类提问-模型探索-验证器把关”新分工中的关键作用。 arXiv DeepMind 推理 论文/研究 推荐理由: DeepMind 把 AI 的'数学直觉'塞进 Lean 编译器里,每步都必须编译通过,结果解决 9 个 Erdős 问题,失败也暴露了隐藏错误。这篇论文重新定义了 AI 做数学的范式。
06:39 ViggleAI @ ViggleAI 精选 75 PINOC : A walkthrough of what PINOC does: 🧵 1. Upload a motion video, get clean skeletal animation. Export as .fbx/.glb, ready ... 产品更新 视频 推荐理由: Viggle 把视频转骨骼动画这件事做到了零成本,无动捕设备、直接导出 FBX,对独立动画师和小团队挺友好,值得试试看。
06:37 ClaudeDevs @ ClaudeDevs 精选 69 智能体 Anthropic 产品更新 编码 推荐理由: Claude Code的auto mode从专属功能下放至Pro计划,并且首次支持Sonnet 4.6,这意味着更多开发者能用更低的成本尝试自动代理编程,Sonnet 4.6的编码能力在实战中究竟如何,现在可以直接测试了。
06:30 Claude Code:GitHub Releases(RSS) 精选 64 本次 v2.1.149 更新包含功能增强、企业设置和多项修复。新增 `/usage` 命令的使用量分类显示功能,可区分技能、子代理、插件及每个 MCP 服务器的消耗;`/diff` 详情视图支持键盘滚动;Markdown 输出兼容 GFM 任务列表。企业版新增 `allowAllClaudeAiMcps` 设置以加载云 MCP 连接器。修复了 PowerShell 权限绕过、Git 工作树沙盒写入白名单越界、脚本路径含空格时 `otelHeadersHelper` 静默失败等安全问题。改进了 `/feedback` 报告,包含上下文压缩前的对话内容,便于排查长会话中的早期问题。 Anthropic MCP/工具 产品更新 编码 推荐理由: Claude Code 这次把 /usage 拆到每个技能和子代理的用量,排查成本不再是猜谜,/diff 终于能键盘滚动,修了一堆权限坑,日常靠 Claude Code 写代码的人值得秒升。
04:38 OpenAI Developers @ OpenAIDevs 精选 67 OpenAI 产品更新 编码 推荐理由: OpenAI 悄悄加了个彩蛋,把 diff 标记改回经典的加减号,习惯老派代码审查的开发者眼睛可以少转几圈。算不上大更新,但莫名贴心。
03:57 Anthropic:Newsroom(网页) 精选 90 上月启动的Project Glasswing项目,旨在利用先进AI模型保障关键软件安全。通过约50家合作伙伴使用Claude Mythos Preview模型,已在全球关键系统中发现超过10,000个高危或严重漏洞。多家合作伙伴报告漏洞发现效率提升超过十倍。例如,Cloudflare在关键路径系统发现2,000个漏洞;Mozilla在Firefox 150中发现并修复271个漏洞,数量远超前代模型。项目还扫描了千余个支撑互联网的开源项目,独立验证准确率达90.6%。这标志着AI网络安全能力进入新阶段,漏洞发现速度已远超人工。 Anthropic 安全/对齐 开源生态 关联讨论 5 条 Anthropic:Research(发表成果 · 网页) X:Anthropic (@AnthropicAI) Hacker News 热门(buzzing.cc 中文翻译) IT之家(RSS) The Decoder:AI News(RSS) 推荐理由: Mythos Preview用一个月找到的漏洞比过去一年还多,网络安全从「发现难」变成「修不过来」,这个转折点所有安全从业者都得读。
03:38 ChatGPT @ ChatGPTapp 精选 69 OpenAI 产品更新 多模态 语音 推荐理由: 填表终于不用打字了,上传表格对着说就行,ChatGPT 这个更新把语音和图像真正串起来,以后各种纸质表单直接扔进去就完事。
02:18 Google Blog:AI(RSS) 精选 56 在2026年Google I/O开发者大会上,对话环节聚焦于未来科技趋势。行业领导者围绕人工智能、量子计算、机器人学以及创造力等核心议题展开了深入探讨,旨在勾勒这些前沿领域的技术演进路径与发展蓝图。 Google 行业动态 推荐理由: Google I/O 对话环节的官方摘要,话题覆盖 AI、量子与机器人,但短短几句话没有实质内容,当成新闻简报可以一瞥,不值得细看。
01:44 swyx @ swyx 精选 78 Kakuna是一款AI代理工具,旨在将早期快速原型自动转化为可维护的生产级代码库。它通过内置的检查清单和“计划-目标”工作流,模拟人类开发与运维流程,在保持功能不变的前提下,自动执行代码审查、测试补充、重构等“无聊”工作,并强调子代理并行以提升效率。该工具是为“人类与代理协作”而设计的范例,其核心是“反熵增”与“反代码腐化”。例如,一次约16小时的运行能生成上百次提交,将一个脆弱的MVP转变为一个结构清晰、可长期构建的稳定项目。 swyx : working on a "take this vibecoded slop app and make it a production-ready, e2e tested, maintainable, parallelizable agen... 教程/实践 编码 部署/工程 推荐理由: 如果你还在为 vibe coding 产出的屎山头疼,swyx 这个 skill 刚开源,16 小时自动重构 103 次提交交付一个可维护的代码库,做独立开发的很值得抄一下。
01:38 OpenRouter @ OpenRouter 精选 60 Warp : You can also connect to inference endpoints that follow the OpenAI Chat Completions API. This includes @OpenRouter, @Lit... 产品更新 部署/工程 推荐理由: Warp终端现在能连接OpenRouter了,对于重度使用Warp做开发的,意味着不用跳出终端就能调用各种模型,是个小而美的效率提升。
01:30 Apple Machine Learning Research(RSS) 精选 66 现有视觉语言模型框架主要在离线场景下评估性能,但实时视觉助手所依赖的流式模型还需考量额外指标,如反映响应时效性的“主动性”和捕捉随时间推移响应稳定性的“一致性”。为此,研究团队提出了VSAS-Bench,这是一个新的评估基准,专门针对流式视觉语言模型在实时交互任务中的表现,填补了当前评估方法在动态、持续生成场景下的空白。 多模态 论文/研究 评测/基准 推荐理由: 苹果搞了个实时视觉助手的评估基准,把离线评测拉到了流式场景,多模态 agent 和实时 VLM 方向的研究者值得跟进一下评估方法。
01:15 Perplexity @ perplexity_ai 精选 82 安全/对齐 开源/仓库 关联讨论 1 条 MarkTechPost(RSS) 推荐理由: 这不是另一个华而不实的 AI 玩具,而是实打实的开发环境安全检查工具,开源且只读,接入 Computer 后还能动态响应新威胁,做 AI 工具链的团队应该现在就 fork。
01:15 Google AI @ GoogleAI 精选 70 谷歌在I/O开发者大会宣布,系统性构建面向AI代理(Agent)的开发与部署工具链。核心更新包括:独立桌面应用Antigravity 2.0及其命令行工具、SDK面世;Google AI Studio新增Kotlin支持,可一键开发安卓应用并发布,同时推出移动端App。此外,Gemini API推出托管代理服务,实现一键部署;WebMCP作为开放标准在Chrome 149中推出,允许网页向代理暴露工具;Chrome DevTools也开放给AI代理以自动化调试。企业级客户可直接连接Google Cloud项目,而DeepMind的科学技能包则加速特定领域研究。此举标志着谷歌正全面打造从开发、接口到部署的完整AI代理生态系统。 智能体 Google 产品更新 编码 关联讨论 1 条 X:Gemini (@GeminiApp) 推荐理由: Google把今年I/O的Agent相关更新打包放出,Antigravity 2.0从IDE变桌面应用、AI Studio能直接做Android App,对Google生态开发者是必读速览。
01:05 SemiAnalysis @ SemiAnalysis_ 精选 82 智能体 推理 现象/趋势 编码 推荐理由: SemiAnalysis 用 43 万次真实编码请求数据揭开了 Agent 推理经济学的真面目,中位输入 9.6 万 token 这个数字足够反直觉,所有做推理服务和模型定价的人都得重新算了。
01:04 Cursor Blog 精选 66 Gartner 在 2026 年魔力象限报告中,将 Cursor 评为企业级 AI 编码代理领域的领导者,并在愿景完整性上领先。超过 70% 的财富 500 强企业使用 Cursor 部署和管理编码代理。未来一年,Cursor 将聚焦于三个方向:提升前沿模型智能;自动化软件开发全生命周期的任务(如代码审查、漏洞修复);以及通过新的管理工具和控制面板,增强企业级的控制力、协作性与部署灵活性,以拓展至更多行业和地区。 编码 行业动态 推荐理由: Gartner 的象限向来是企业采购的风向标,Cursor 在 vision 上做到最远,对瞄准 AI coding agent 的团队是个重要信号,但别被 PR 冲昏头,完整报告更值得细读。
有任何建议或问题,欢迎告诉我们
感谢您的反馈!