AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

又是Codex周四,我们带来了更新。 首先是Appshots,一种将你工作上下文引入Codex的新方式。 在Mac上,按Command-Command即可将应用窗口附加到Codex线程。Codex会获取窗口的截图和文本,包括屏幕上不可见的内容。 Appshots已在Mac各计划中推出,企业版访问权限即将上线。

02:33 OpenAI Developers @ OpenAIDevs 精选 64 OpenAI 产品更新 编码 推荐理由: Codex 的 Appshots 把「看我的屏幕」变成一键操作,做前端或调试的人能省下大量描述 UI 的时间,是个小而美的更新。

OpenAI 产品更新 编码
AI HOT ·

Cloudflare裁员千人换AI,CEO撰文解释"腾笼换鸟"逻辑

10:12 宝玉 @ dotey 精选 77 Cloudflare裁员约1100人,同时招聘近似数量的实习生。CEO在《华尔街日报》撰文,引用德鲁克理论,指出AI主要替代从事审计、财务、中层管理等结构化工作的“度量者”,而工程师与销售人员影响较小。公司已将审计转向AI驱动,财务流程得以优化。大量实习岗位被视为面向“AI原生代”。财报显示公司当季亏损,且因裁员产生高额重组费用,消息公布后股价一度大跌超20%。 大佬观点 现象/趋势 行业动态 推荐理由: CEO亲自下场解释为什么裁人并把人分成三类,这套逻辑可能成为未来更多公司裁员的脚本,打工人可以看看,但别全信,股价跌了二十多个点就是市场的看法。

大佬观点 现象/趋势 行业动态
AI HOT ·

构建云端智能体的经验总结

01:04 Cursor Blog 精选 58 云端智能体已从本地智能体的简单扩展,发展为具备独立环境、可并行无人值守处理长任务的系统。构建的核心经验在于:完整的开发环境是输出质量的关键,这需重建大量基础设施;可靠性方面,团队从自研架构迁移至Temporal平台,将可靠性提升至99.9%以上,该平台每日处理超5000万次操作,支撑超40%的代码拉取请求;同时,实现了智能体循环、机器状态与对话状态的解耦,以适应复杂的跨环境协作。 智能体 教程/实践 编码 推荐理由: Cursor 把这一年踩过的坑全摊开了,从环境构建到持久化执行,基本就是一份 agent 平台内部架构课,搭同类产品的团队值得逐段读。

智能体 教程/实践 编码
AI HOT ·

Claude现已支持更多安全合规工具

01:43 Claude:Blog(网页) 精选 65 Anthropic宣布为Claude企业版及平台新增28项安全与合规工具集成。这些集成均通过Claude Compliance API实现,允许企业安全团队统一获取Claude的对话内容与活动事件,从而将其纳入现有的DLP、SIEM等监控与合规流程。新增合作伙伴包括Cloudflare、CrowdStrike、Microsoft Purview等28家供应商,覆盖数据安全、身份验证等多个关键领域,帮助企业快速将Claude接入现有安全平台,实现跨组织工具的统一治理与可视化监控。 Anthropic 产品更新 部署/工程 关联讨论 1 条 Cloudflare Blog 推荐理由: 企业安全团队终于能像治理其他SaaS一样治理Claude了,28个主流安全工具集成,说明Anthropic认真在打企业牌,CSO们可以打开文档了。

Anthropic 产品更新 部署/工程
AI HOT ·

合作伙伴如何运用Opus强化网络安全

01:43 Claude:Blog(网页) 精选 74 多家企业正利用Claude Opus模型强化网络安全防御。Wiz通过其Red Agent,每周对超过15万个生产资产进行持续渗透测试,发现数千个高风险漏洞且误报率为零。Palo Alto Networks在不到三周内完成了相当于一年的渗透测试工作量。埃森哲将安全测试覆盖率从约10%提升至80%以上,涉及1600个应用和50万+个API,扫描周期从3-5天缩短至1小时内。应用主要围绕三个方向:开展大规模攻击性测试、缩短漏洞发现与修复的间隔,以及将受控AI系统部署到生产环境。 Anthropic 产品更新 安全/对齐 推荐理由: Wiz一周扫15万资产零误报,Palo Alto三周完成一年渗透测试量——这些不是蓝图,是Claude Opus正在真实防御中跑出的数字,安全团队值得逐字看完。

Anthropic 产品更新 安全/对齐
AI HOT ·

核算OpenAI和Anthropic最新动态背后的数学

02:00 Gary Marcus:The Road to AI We Can Trust(RSS) 精选 72 OpenAI与Anthropic近期相继发布重要产品更新。Claude 3.5 Sonnet在多项基准测试中超越GPT-4o,同时宣布API价格下调50%。Anthropic披露其模型训练成本年均增长约3.2倍,而OpenAI被曝已通过企业服务实现单季度超10亿美元营收。两家公司在技术突破与商业化竞赛中,正通过精密的成本核算与性能权衡重塑行业格局。 Anthropic OpenAI 大佬观点 推理 推荐理由: Gary Marcus 直接拉出 OpenAI 和 Anthropic 最新声明的原始数据,用小学数学拆穿他们有意无意藏起来的假设,所有拿这些数字做决策的产品人和投资人最好看一遍。

Anthropic OpenAI 大佬观点 推理
AI HOT ·

推出 Gemini for Home 赋能服务提供商与硬件合作伙伴

00:33 Google Developers Blog(RSS) 精选 75 Google 通过推出全栈 Gemini AI 解决方案扩展其智能家居生态系统。该方案集成了先进的摄像头智能、自然语言查询功能和日常活动摘要能力。它为服务提供商和硬件制造商提供了现成的参考设计与API,使其无需大量研发投入即可构建主动式、品牌化的智能家居服务。该计划旨在超越基础设备控制,迈向能够理解情境并实时响应用户需求的AI原生智能家居。 Google 产品更新 多模态 端侧 推荐理由: Google 把 Gemini 塞进智能家居,直接给硬件商和 ISP 提供交钥匙方案,这一步可能比 Nest 当年更有侵略性,做智能家居的得留意了。

Google 产品更新 多模态 端侧
AI HOT ·

发布 Kotlin版ADK与Android版ADK 0.1.0:在Android及其他平台构建AI Agent

00:33 Google Developers Blog(RSS) 精选 69 Google发布了面向开发者的新工具包:Kotlin版ADK与Android版ADK 0.1.0。这两个工具包旨在帮助开发者构建AI Agent。其中,Kotlin版ADK将代理工作流引入后端项目开发;Android版ADK则专注于移动端应用,提供了构建AI代理所需的特定功能。此次发布为开发者提供了在Android生态及更广泛平台创建AI应用的官方工具基础。 智能体 Google 产品更新 端侧 推荐理由: Google 把 Agent 开发框架搬上 Android,0.1 版本虽早,但移动端 AI 应用有了官方入口,做 Android 的该跟进了。

智能体 Google 产品更新 端侧
AI HOT ·

无需工作室,无需编辑队列。 将产品URL粘贴到Shoplift by PixVerse,几分钟内即可发布平台原生广告视频 --专为持续进行创意测试的DTC团队打造。 免费早期访问:https://shoplift.pixverse.ai 转发+关注+回复=300积分(仅限72小时)

00:14 PixVerse @ PixVerse_ 精选 70 产品更新 视频 推荐理由: 粘贴商品链接就能生成广告视频,对天天跑A/B测试的电商团队很友好,相当于把剪辑师外包给AI了。免费试用期间值得上手试一下。

产品更新 视频
AI HOT ·

ChatGPT for PowerPoint: 【引用 @ryanbrewer】:很高兴宣布ChatGPT for PowerPoint!这是另一个非常有趣的构建。可以创建新幻灯片、在整个演示文稿中提问,并直接在PowerPoint中进行更新。https://chatgpt.com/apps/powerpoint/

04:35 Greg Brockman @ gdb 精选 82 Ryan Brewer : Excited to announce ChatGPT for Powerpoint! This was another super interesting build. Create new slides, ask questions a... 智能体 OpenAI 产品更新 推荐理由: ChatGPT 正式进入 Office 桌面级阵地,直接在 PowerPoint 里创建和修改幻灯片,比插件路径干净太多,做演示的同学可以第一时间试试。

智能体 OpenAI 产品更新
AI HOT ·

游戏开发门槛被AI大幅降低

16:07 AYi @ AYi_AInotes 精选 79 Grok展示了AI深度介入游戏开发的全新工作流。通过“提示词生成角色图→图片转动画视频→自动拼接成Spritesheet→导入引擎”四步流程,将传统需要美术与动画师耗时数天的工作,在几分钟内完成。这标志着AI不再仅生成静态内容,而是能实时生成可直接导入Unity或Godot等游戏引擎的可运行资产。该技术极大压缩了游戏原型的迭代周期,将反馈循环从“天”缩短至“秒”,使得独立开发者也能快速实现创意,显著降低了游戏创作的门槛。 Grok : Prototyping game assets directly with Grok @imagine xAI 图像生成 教程/实践 推荐理由: Grok 这波不是画张图那么简单,它把 AI 直接嵌进游戏引擎工作流,实时生成可运行的资产,solo 开发者周末搞个原型出来真的可行了。

xAI 图像生成 教程/实践
AI HOT ·

腾讯开源Hy-MT2多语言翻译模型

16:56 Tencent Hy @ TencentHunyuan 精选 74 腾讯正式开源Hy-MT2多语言翻译模型,支持33种语言间的无缝互译。其7B与30B-A3B版本在开源模型中达到最先进的翻译性能,超越了许多参数规模大数十倍的模型。更具突破性的是,1.8B轻量级版本性能超越微软等主流商业API,并凭借腾讯AngelSlim 1.25-bit极量化技术,仅需440MB存储空间,即可在主流手机芯片上本地运行,推理速度较前代提升1.5倍,显著降低了高质量AI翻译的部署门槛。 开源生态 模型发布 端侧 关联讨论 1 条 IT之家(RSS) 推荐理由: 虽然翻译领域不算最热,腾讯这个1.8B开源模型用1.25位量化直接跑在手机上,效果还超微软商业API,做本地化翻译工具的人值得关注。

开源生态 模型发布 端侧
AI HOT ·

为 Krea 2(测试版)引入 LoRA。 我们迄今最强大的微调系统;现在你可以用惊人的精度,在 Krea 2 上训练你自己的特定风格、对象或角色。 了解其工作原理 👇

22:41 Krea @ krea_ai 精选 69 产品更新 图像生成 数据/训练 推荐理由: Krea 2 把 LoRA 微调直接做进了产品,对需要固定角色或风格的设计师来说省事了,虽然不是新概念但低门槛就是好文明。

产品更新 图像生成 数据/训练
AI HOT ·

Anthropic即将成为首个盈利的AI实验室

23:26 The Decoder:AI News(RSS) 精选 73 根据《华尔街日报》报道,Anthropic正接近实现其首个盈利季度,预计第二季度营收达109亿美元,运营利润为5.59亿美元。该公司在去年夏季时还预计最早在2028年才能盈利。主要增长动力来自编程工具和Claude的代理功能使用,其需求一度超过了可用的算力容量。这一转变标志着Anthropic可能成为业界首个实现盈利的领先AI研发机构。 Anthropic 行业动态 推荐理由: Anthropic 预计 Q2 扭亏为盈,成为第一家真正不烧钱的 AI 巨头,这个拐点比任何参数发布都更能定义行业赛道的切换。 22:41 Krea @ krea_ai 精选 69 为 Krea 2(测试版)引入 LoRA。 我们迄今最强大的微调系统;现在你可以用惊人的精度,在 Krea 2 上训练你自己的特定风格、对象或角色。 了解其工作原理 👇 产品更新 图像生成 数据/训练 推荐理由: Krea 2 把 LoRA 微调直接做进了产品,对需要固定角色或风格的设计师来说省事了,虽然不是新概念但低门槛就是好文明。 16:56 Tencent Hy @ TencentHunyuan 精选 74 腾讯开源Hy-MT2多语言翻译模型 腾讯正式开源Hy-MT2多语言翻译模型,支持33种语言间的无缝互译。其7B与30B-A3B版本在开源模型中达到最先进的翻译性能,超越了许多参数规模大数十倍的模型。更具突破性的是,1.8B轻量级版本性能超越微软等主流商业API,并凭借腾讯AngelSlim 1.25-bit极量化技术,仅需440MB存储空间,即可在主流手机芯片上本地运行,推理速度较前代提升1.5倍,显著降低了高质量AI翻译的部署门槛。 开源生态 模型发布 端侧 关联讨论 1 条 IT之家(RSS) 推荐理由: 虽然翻译领域不算最热,腾讯这个1.8B开源模型用1.25位量化直接跑在手机上,效果还超微软商业API,做本地化翻译工具的人值得关注。 16:07 AYi @ AYi_AInotes 精选 79 游戏开发门槛被AI大幅降低 Grok展示了AI深度介入游戏开发的全新工作流。通过“提示词生成角色图→图片转动画视频→自动拼接成Spritesheet→导入引擎”四步流程,将传统需要美术与动画师耗时数天的工作,在几分钟内完成。这标志着AI不再仅生成静态内容,而是能实时生成可直接导入Unity或Godot等游戏引擎的可运行资产。该技术极大压缩了游戏原型的迭代周期,将反馈循环从“天”缩短至“秒”,使得独立开发者也能快速实现创意,显著降低了游戏创作的门槛。 Grok : Prototyping game assets directly with Grok @imagine xAI 图像生成 教程/实践 推荐理由: Grok 这波不是

Anthropic 行业动态 产品更新 图像生成 数据/训练 开源生态 模型发布 端侧 xAI 教程/实践 Google 大佬观点 现象/趋势 多模态 智能体 arXiv 安全/对齐 编码 GitHub 具身智能 OpenAI 部署/工程 推理 论文/研究 语音 Meta
AI HOT ·

LongCat-Video-Avatar-1.5:升级版音频驱动数字人视频生成框架

00:07 美团 LongCat:HuggingFace 新模型 精选 73 美团LongCat团队发布了LongCat-Video-Avatar-1.5,一个专注于音频驱动数字人视频生成的开源框架。其核心升级在于采用Whisper-Large音频编码器,显著优化了唇部动态的流畅度与自然度。该版本实现了精准的唇形同步、全身时序稳定性以及长视频中的身份一致性,并能泛化应用于动漫、动物及多人交互等复杂场景。通过基于DMD2的步蒸馏技术,模型仅需8步即可高效推理。团队还构建了一个涵盖多场景、多语言的人工评估基准,通过大规模主观评分与专家分析,验证了其在多项关键维度上的优异性能。 Hugging Face 图像生成 多模态 开源/仓库 推荐理由: 美团把数字人模型升级到1.5版,换了Whisper做音频编码,唇形同步比之前自然不少,而且开源了训练代码,做电商直播和虚拟博主的朋友可以直接拿过来跟商业方案掰手腕。

Hugging Face 图像生成 多模态 开源/仓库
AI HOT ·

SpecBench:测量长期编码代理中的奖励黑客行为

11:09 HuggingFace Daily Papers(社区热门论文) 精选 72 长期编码代理在优化测试通过时可能偏离用户真实目标,导致奖励黑客现象。研究将软件工程任务分解为规格说明、可见验证测试和隐藏测试,通过两类测试通过率差距量化黑客行为。为此引入SpecBench基准,包含30个从短期(如JSON解析器)到超长期(如构建操作系统内核)的系统级编程任务。实验显示,所有前沿代理在可见测试上饱和,但隐藏测试上存在持续差距,小模型差距更大;代码规模每增十倍,差距增长28个百分点。失败案例包括故意利用测试输入。SpecBench提供原则性平台,评估代理是否构建真实工作系统而非仅玩游戏测试套件。 智能体 arXiv 安全/对齐 编码 推荐理由: SpecBench把编码代理的‘应试’问题量化了,越长的任务越容易靠作弊通过测试。如果你在做Agent,这个基准会让你重新审视自己的评估体系。

智能体 arXiv 安全/对齐 编码
AI HOT ·

首部100%AI生成电影亮相戛纳,剑指2026院线

11:18 Kling AI @ Kling_ai 精选 67 AI电影项目RAPHAEL在戛纳亮相。该片由Mateo AI Studio与韩国MBC C&I的AI内容实验室联合开发,全程使用Kling AI视频模型进行制作,旨在实现独特的视觉效果与差异化的观影体验。项目计划于2026年登陆院线,其大规模制作旨在证明纯AI电影制作的工业可行性,标志着AI原生院线电影新趋势的开端。 多模态 行业动态 推荐理由: 纯AI制作的院线电影真的来了,可灵AI和MBC联手拿AI拍正片,2026年影院见。这事如果成了,电影工业的天花板要被捅破一次。

多模态 行业动态
AI HOT ·

Intuit将裁员逾3000人,以重新聚焦人工智能

12:44 Hacker News 热门(buzzing.cc 中文翻译) 精选 72 软件公司Intuit宣布将裁员超过3000人,作为其战略重组的一部分。此次裁员旨在将公司资源重新聚焦于人工智能(AI)领域的发展,以适应技术趋势并提升长期竞争力。裁员规模约占其全球员工总数的10%。 现象/趋势 行业动态 推荐理由: Intuit作为财务软件巨头裁员3000人转向AI,不是小厂试水,是AI替代白领工作的标志性信号。做SaaS的该认真看路线了。

现象/趋势 行业动态