AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

我们正在扩大与新加坡的合作,以帮助安全地大规模部署AI。🇸🇬 与各国专家合作,我们的新项目将重点加速科学发现、加强大流行病防范并改善医疗保健。 了解更多 → https://goo.gle/49jGwjv

08:45 Google DeepMind @ GoogleDeepMind 精选 60 Google 安全/对齐 行业动态 推荐理由: 又一个AI国际合作,谷歌和新加坡在医疗和疫情准备上搞合作,对国内开发者没什么直接可用的,但看看大厂的战略方向有点参考价值。

Google 安全/对齐 行业动态
AI HOT ·

Models.dev:一个关于人工智能模型规格、定价和功能的开源数据库

09:57 Hacker News 热门(buzzing.cc 中文翻译) 精选 70 近期发布了开源数据库Models.dev,专门收录人工智能模型的各项规格、定价及功能信息。该项目在GitHub公开,便于开发者查询和比较不同AI模型。其在Hacker News社区获得101点关注度,显示出技术社区对这类集中化、透明化的模型信息资源的较大兴趣。 GitHub 开源/仓库 搜索 推荐理由: 做AI产品选型最烦的就是到处翻定价和规格页,这个开源数据库把常用模型的底细都摊开摆明了,实用,建议存为浏览器首页。

GitHub 开源/仓库 搜索
AI HOT ·

Nemotron-Labs 扩散语言模型实现光速级文本生成

08:16 Hugging Face:Blog(RSS) 精选 68 NVIDIA 在 Hugging Face 发布了关于 Nemotron-Labs 扩散语言模型的技术博客。该研究聚焦于通过扩散语言模型架构大幅提升文本生成速度,目标是逼近“光速级”生成效率。文章可能介绍了该模型在生成速度上的突破,以及相较于传统自回归模型在延迟和吞吐量方面的性能优势。具体技术细节或对比数据需参考原文。 推理 数据/训练 论文/研究 推荐理由: NVIDIA 用扩散模型做文本生成,目标是逼近光速推理,虽然还是实验室阶段,但对实时交互场景可能是个颠覆性思路,做 NLP 的值得追一下。

推理 数据/训练 论文/研究
AI HOT ·

AI 替代入门级工作:科技行业受裁员冲击最重,74% CEO 冻结或缩减招聘

08:09 IT之家(RSS) 精选 70 奥纬咨询研究发现,AI工具正被广泛用于入门级任务,导致企业招聘重心转向高级岗位,年轻人求职难度加大。科技行业受冲击最严重,74%的CEO已冻结或缩减招聘。计划削减初级岗位的比例从17%跃升至43%,而招聘转向中层岗位的比例则升至30%。尽管超90%的企业在部署AI,但多数仍处试点阶段。报告警告,过快裁员或忽视初级人才储备,可能对人才梯队造成长远风险。 现象/趋势 行业动态 推荐理由: 奥纬咨询的全球CEO调查把AI对就业的冲击从隐约的趋势变成了具体数字,74%的科技CEO冻结招聘,入门岗位两年内砍半,年轻人是最大输家,这份报告该让所有在找工作的应届生有点警惕了。

现象/趋势 行业动态
AI HOT ·

黄仁勋:AI 基建年度开支要冲到 4 万亿美元!

07:09 IT之家(RSS) 精选 79 英伟达发布2027财年Q1财报,营收816亿美元,同比增长85%,净利润583亿美元,翻两倍多,市值达5.7万亿美元,已超德国2026年GDP预测。黄仁勋预测,超大规模云厂商的AI基建年度开支将从当前的1万亿美元,增长至3-4万亿美元,远超华尔街预期。财报同时显示,数据中心业务营收752亿美元,占比超九成。值得注意的是,AI基建的高能耗正推高居民电费,数据中心用电成本转嫁效应已初步显现。 大佬观点 现象/趋势 行业动态 推荐理由: 黄仁勋的4万亿美元AI基建预测比华尔街共识高四倍,不是吹牛,是给AGI时代的入场券标价,所有云厂商已经用脚投票了。

大佬观点 现象/趋势 行业动态
AI HOT ·

AlphaProof Nexus:用形式化验证驱动AI数学证明搜索

06:57 Rohan Paul @ rohanpaul_ai 精选 79 Google DeepMind提出了AlphaProof Nexus系统,它将大型语言模型与Lean形式化验证工具相结合。该系统允许LLM在生成证明的过程中,不断读取Lean的编译错误并进行修正,还可调用更强的工具辅助解决子问题。这一机制迫使模型将每一步逻辑都转化为可编译、可验证的代码,从而将其角色从“令人信服的叙述者”转变为“候选方案生成器”。在针对353个Erdős问题和492个开放猜想的测试中,系统成功解决了9个Erdős问题并证明了44个序列猜想。该研究展示了形式化验证在暴露AI逻辑错误、建立“人类提问-模型探索-验证器把关”新分工中的关键作用。 arXiv DeepMind 推理 论文/研究 推荐理由: DeepMind 把 AI 的'数学直觉'塞进 Lean 编译器里,每步都必须编译通过,结果解决 9 个 Erdős 问题,失败也暴露了隐藏错误。这篇论文重新定义了 AI 做数学的范式。

arXiv DeepMind 推理 论文/研究
AI HOT ·

动作捕捉和角色动画制作从未如此简单。 持续构建,更多功能即将推出!

06:39 ViggleAI @ ViggleAI 精选 75 PINOC : A walkthrough of what PINOC does: 🧵 1. Upload a motion video, get clean skeletal animation. Export as .fbx/.glb, ready ... 产品更新 视频 推荐理由: Viggle 把视频转骨骼动画这件事做到了零成本,无动捕设备、直接导出 FBX,对独立动画师和小团队挺友好,值得试试看。

产品更新 视频
AI HOT ·

自动模式的两项更新: · 现已在Pro计划中提供 · 现已支持Sonnet 4.6,以及Opus 4.7 按下Shift+tab,让Claude运行。

06:37 ClaudeDevs @ ClaudeDevs 精选 69 智能体 Anthropic 产品更新 编码 推荐理由: Claude Code的auto mode从专属功能下放至Pro计划,并且首次支持Sonnet 4.6,这意味着更多开发者能用更低的成本尝试自动代理编程,Sonnet 4.6的编码能力在实战中究竟如何,现在可以直接测试了。

智能体 Anthropic 产品更新 编码
AI HOT ·

v2.1.149 更新摘要

06:30 Claude Code:GitHub Releases(RSS) 精选 64 本次 v2.1.149 更新包含功能增强、企业设置和多项修复。新增 `/usage` 命令的使用量分类显示功能,可区分技能、子代理、插件及每个 MCP 服务器的消耗;`/diff` 详情视图支持键盘滚动;Markdown 输出兼容 GFM 任务列表。企业版新增 `allowAllClaudeAiMcps` 设置以加载云 MCP 连接器。修复了 PowerShell 权限绕过、Git 工作树沙盒写入白名单越界、脚本路径含空格时 `otelHeadersHelper` 静默失败等安全问题。改进了 `/feedback` 报告,包含上下文压缩前的对话内容,便于排查长会话中的早期问题。 Anthropic MCP/工具 产品更新 编码 推荐理由: Claude Code 这次把 /usage 拆到每个技能和子代理的用量,排查成本不再是猜谜,/diff 终于能键盘滚动,修了一堆权限坑,日常靠 Claude Code 写代码的人值得秒升。

Anthropic MCP/工具 产品更新 编码
AI HOT ·

已发布剪纸功能:外观设置中新增差异标记样式。 在查看差异时更喜欢经典的 + / - 标记?现在你可以选择使用它们,而不仅仅是彩色差异条。 默认设置保持不变,除非你主动选择启用。

04:38 OpenAI Developers @ OpenAIDevs 精选 67 OpenAI 产品更新 编码 推荐理由: OpenAI 悄悄加了个彩蛋,把 diff 标记改回经典的加减号,习惯老派代码审查的开发者眼睛可以少转几圈。算不上大更新,但莫名贴心。

OpenAI 产品更新 编码
AI HOT ·

Project Glasswing:初步更新

03:57 Anthropic:Newsroom(网页) 精选 90 上月启动的Project Glasswing项目,旨在利用先进AI模型保障关键软件安全。通过约50家合作伙伴使用Claude Mythos Preview模型,已在全球关键系统中发现超过10,000个高危或严重漏洞。多家合作伙伴报告漏洞发现效率提升超过十倍。例如,Cloudflare在关键路径系统发现2,000个漏洞;Mozilla在Firefox 150中发现并修复271个漏洞,数量远超前代模型。项目还扫描了千余个支撑互联网的开源项目,独立验证准确率达90.6%。这标志着AI网络安全能力进入新阶段,漏洞发现速度已远超人工。 Anthropic 安全/对齐 开源生态 关联讨论 5 条 Anthropic:Research(发表成果 · 网页) X:Anthropic (@AnthropicAI) Hacker News 热门(buzzing.cc 中文翻译) IT之家(RSS) The Decoder:AI News(RSS) 推荐理由: Mythos Preview用一个月找到的漏洞比过去一年还多,网络安全从「发现难」变成「修不过来」,这个转折点所有安全从业者都得读。

Anthropic 安全/对齐 开源生态
AI HOT ·

回顾Google I/O 2026对话环节

02:18 Google Blog:AI(RSS) 精选 56 在2026年Google I/O开发者大会上,对话环节聚焦于未来科技趋势。行业领导者围绕人工智能、量子计算、机器人学以及创造力等核心议题展开了深入探讨,旨在勾勒这些前沿领域的技术演进路径与发展蓝图。 Google 行业动态 推荐理由: Google I/O 对话环节的官方摘要,话题覆盖 AI、量子与机器人,但短短几句话没有实质内容,当成新闻简报可以一瞥,不值得细看。

Google 行业动态
AI HOT ·

Kakuna:自动化加固代码库的AI代理工具

01:44 swyx @ swyx 精选 78 Kakuna是一款AI代理工具,旨在将早期快速原型自动转化为可维护的生产级代码库。它通过内置的检查清单和“计划-目标”工作流,模拟人类开发与运维流程,在保持功能不变的前提下,自动执行代码审查、测试补充、重构等“无聊”工作,并强调子代理并行以提升效率。该工具是为“人类与代理协作”而设计的范例,其核心是“反熵增”与“反代码腐化”。例如,一次约16小时的运行能生成上百次提交,将一个脆弱的MVP转变为一个结构清晰、可长期构建的稳定项目。 swyx : working on a "take this vibecoded slop app and make it a production-ready, e2e tested, maintainable, parallelizable agen... 教程/实践 编码 部署/工程 推荐理由: 如果你还在为 vibe coding 产出的屎山头疼,swyx 这个 skill 刚开源,16 小时自动重构 103 次提交交付一个可维护的代码库,做独立开发的很值得抄一下。

教程/实践 编码 部署/工程
AI HOT ·

OpenRouter现已在@warpdotdev中得到支持!❤️ 工程师Dagm Assefa展示了如何连接DeepSeek和OpenRouter。 文档:https://docs.warp.dev/agent-platform/inference/custom-inference-endpoint/ 🔖

01:38 OpenRouter @ OpenRouter 精选 60 Warp : You can also connect to inference endpoints that follow the OpenAI Chat Completions API. This includes @OpenRouter, @Lit... 产品更新 部署/工程 推荐理由: Warp终端现在能连接OpenRouter了,对于重度使用Warp做开发的,意味着不用跳出终端就能调用各种模型,是个小而美的效率提升。

产品更新 部署/工程
AI HOT ·

VSAS-Bench:视觉流式辅助模型的实时评估基准

01:30 Apple Machine Learning Research(RSS) 精选 66 现有视觉语言模型框架主要在离线场景下评估性能,但实时视觉助手所依赖的流式模型还需考量额外指标,如反映响应时效性的“主动性”和捕捉随时间推移响应稳定性的“一致性”。为此,研究团队提出了VSAS-Bench,这是一个新的评估基准,专门针对流式视觉语言模型在实时交互任务中的表现,填补了当前评估方法在动态、持续生成场景下的空白。 多模态 论文/研究 评测/基准 推荐理由: 苹果搞了个实时视觉助手的评估基准,把离线评测拉到了流式场景,多模态 agent 和实时 VLM 方向的研究者值得跟进一下评估方法。

多模态 论文/研究 评测/基准
AI HOT ·

今天我们开源了Bumblebee,一个适用于macOS和Linux的只读扫描器。 它检查开发者机器上的高风险软件包、扩展和AI工具配置。 连接到Computer后,每当出现新的供应链风险时,它可以触发更深入的扫描。 https://github.com/perplexityai/bumblebee

01:15 Perplexity @ perplexity_ai 精选 82 安全/对齐 开源/仓库 关联讨论 1 条 MarkTechPost(RSS) 推荐理由: 这不是另一个华而不实的 AI 玩具,而是实打实的开发环境安全检查工具,开源且只读,接入 Computer 后还能动态响应新威胁,做 AI 工具链的团队应该现在就 fork。

安全/对齐 开源/仓库
AI HOT ·

谷歌I/O大会发布AI代理全套开发工具链

01:15 Google AI @ GoogleAI 精选 70 谷歌在I/O开发者大会宣布,系统性构建面向AI代理(Agent)的开发与部署工具链。核心更新包括:独立桌面应用Antigravity 2.0及其命令行工具、SDK面世;Google AI Studio新增Kotlin支持,可一键开发安卓应用并发布,同时推出移动端App。此外,Gemini API推出托管代理服务,实现一键部署;WebMCP作为开放标准在Chrome 149中推出,允许网页向代理暴露工具;Chrome DevTools也开放给AI代理以自动化调试。企业级客户可直接连接Google Cloud项目,而DeepMind的科学技能包则加速特定领域研究。此举标志着谷歌正全面打造从开发、接口到部署的完整AI代理生态系统。 智能体 Google 产品更新 编码 关联讨论 1 条 X:Gemini (@GeminiApp) 推荐理由: Google把今年I/O的Agent相关更新打包放出,Antigravity 2.0从IDE变桌面应用、AI Studio能直接做Android App,对Google生态开发者是必读速览。

智能体 Google 产品更新 编码
AI HOT ·

智能体工作负载正在悄然重塑推理经济学。我们从SemiAnalysis的43.2万个真实编码智能体请求中提取数据,发现中位数并非3.2万或6.4万,而是9.6万输入token。作为参考,这意味着在你输入问题之前,模型已处理了超过《了不起的盖茨比》全文长度的文本。(1/3)🧵

01:05 SemiAnalysis @ SemiAnalysis_ 精选 82 智能体 推理 现象/趋势 编码 推荐理由: SemiAnalysis 用 43 万次真实编码请求数据揭开了 Agent 推理经济学的真面目,中位输入 9.6 万 token 这个数字足够反直觉,所有做推理服务和模型定价的人都得重新算了。

智能体 推理 现象/趋势 编码
AI HOT ·

Cursor 被评为 2026 年 Gartner 企业级 AI 编码代理魔力象限领导者

01:04 Cursor Blog 精选 66 Gartner 在 2026 年魔力象限报告中,将 Cursor 评为企业级 AI 编码代理领域的领导者,并在愿景完整性上领先。超过 70% 的财富 500 强企业使用 Cursor 部署和管理编码代理。未来一年,Cursor 将聚焦于三个方向:提升前沿模型智能;自动化软件开发全生命周期的任务(如代码审查、漏洞修复);以及通过新的管理工具和控制面板,增强企业级的控制力、协作性与部署灵活性,以拓展至更多行业和地区。 编码 行业动态 推荐理由: Gartner 的象限向来是企业采购的风向标,Cursor 在 vision 上做到最远,对瞄准 AI coding agent 的团队是个重要信号,但别被 PR 冲昏头,完整报告更值得细读。

编码 行业动态