宏利香港宣布与阿里云建立战略合作伙伴关系,旨在构建一个专注于推进负责任的AI创新,并加速AI技术在业务中部署的合作框架。
11:08 Alibaba Cloud @ alibaba_cloud 精选 62 安全/对齐 行业动态 推荐理由: Manulife和阿里云的合作聚焦负责任AI,但看完仍不清楚具体怎么落地,对金融行业的人或许是个信号,其他人可以略过。
AI and technology watch
聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。
11:08 Alibaba Cloud @ alibaba_cloud 精选 62 安全/对齐 行业动态 推荐理由: Manulife和阿里云的合作聚焦负责任AI,但看完仍不清楚具体怎么落地,对金融行业的人或许是个信号,其他人可以略过。
12:02 Satya Nadella @ satyanadella 精选 77 Microsoft 行业动态 推荐理由: 微软 Build 上的战略更新不算意外,但 Nadella 亲自解读的生态整合思路,对依赖 Azure 和 Copilot 的团队来说是半年内的重要路线图。
12:42 HuggingFace Daily Papers(社区热门论文) 精选 70 本研究探讨了世界模型与多模态大语言模型在预测未来状态时的互补性。世界模型可生成具体的视觉未来轨迹,但可能视觉合理却任务错误;多模态大语言模型则擅长抽象推理。为此,研究提出了“受控的具体推理”框架,并构建了VRQABench和OpenWorldQA两个基准。同时,提出了Privileged-Future On-Policy Self-Distillation(PF-OPSD)方法,该方法在训练时利用真实未来视频作为特权上下文评估推理轨迹,但部署时无需真实未来。实验结果显示,PF-OPSD在两个基准上分别比基线高出10.6%和10.9%,并提升了对噪声或冲突轨迹的鲁棒性。 智能体 多模态 开源/仓库 推理 推荐理由: 世界模型靠视觉预测,语言模型靠抽象推理,这篇把两者真正拧在一起了。用未来视频做自我蒸馏提升 10%,还给全开源,做 agent 决策的可以认真看看‘什么时候不信自己的眼睛’是怎么训出来的。
13:09 IT之家(RSS) 精选 70 DeepSeek 计划在首轮融资中从腾讯、宁德时代等投资方处筹集约 500 亿元人民币。融资落地后,其投后估值预计在 3500 亿至 4000 亿元。创始人梁文峰将出资 200 亿元,腾讯和宁德时代分别拟投资 100 亿元和 50 亿元,成为最大外部投资者。DeepSeek 去年凭借 V3 大模型与 R1 推理模型获得广泛认可。此次融资凸显了中国正打造从大模型到算力能源基建的全链条 AI 产业。 DeepSeek 行业动态 推荐理由: DeepSeek 第一轮就 500 亿、估值直奔 4000 亿,腾讯和宁德时代入局,这已经不是一家公司的融资,而是中国 AI 产业链上下游的一次正式组队。
14:06 SiliconFlow @ SiliconFlowAI 精选 71 Nous Research : The next evolution of Hermes Agent is here! Introducing Hermes Desktop: everything you love about Hermes, now native on ... 智能体 产品更新 开源生态 推荐理由: Hermes 的桌面版把 Agent 能力直接装进本地,不用折腾环境,开发者可以立刻体验在 GTC 上演示的体验,公测阶段值得尝鲜。
14:36 SiliconFlow @ SiliconFlowAI 精选 67 开源生态 教程/实践 推荐理由: 把 karpathy 的 llm-wiki 创意拆成了可复制的 recipe,跟着教程用 SiliconFlow + opencode + OMO 就能搭一个自进化的知识库,相当实用。
17:51 Anthropic:Research(发表成果 · 网页) 精选 69 Anthropic 分析 2025 年 3 月至 2026 年 3 月间 832 个被封禁的恶意账户,映射至 MITRE ATT&CK 框架。67.3% 使用 AI 编写恶意软件,6.5% 用于横向移动。六个月间中高风险攻击者占比从 33% 升至 56%。AI 用于账户发现增长 8.9%,AI 辅助钓鱼下降 8.6%。传统基于技术数量或平台(Claude Code、API、聊天界面)的威胁评估失效,而 MITRE ATT&CK 框架尚未收录此类智能体编排行为。 Anthropic 安全/对齐 论文/研究 关联讨论 1 条 Anthropic:Newsroom(网页) 推荐理由: 这份报告用一整年的真实案例揭示了AI攻击正从初始入侵转向深度潜伏,连MITRE ATT&CK框架都开始跟不上。安全从业者值得一读,它告诉你下一波威胁长什么样。
05:55 Anthropic @ AnthropicAI 精选 69 Anthropic 政策/监管 行业动态 关联讨论 5 条 TechCrunch:AI(RSS) The Verge:AI(RSS) Bloomberg:Technology(RSS) IT之家(RSS) X:Rohan Paul (@rohanpaul_ai) 推荐理由: Anthropic 对白宫 AI 行政令的官方表态,信号意义大于实质内容,但头部公司主动拥抱政策制定是趋势,值得留意后续落地细节。
06:00 Microsoft Research @ MSFTResearch 精选 72 Microsoft 多模态 论文/研究 推荐理由: 微软把天气预报推到了推理速度比超算快数千倍,这在气象AI里算是代际提升,虽然离普通人远,但对气候建模和极端天气预警是实实在在的突破。
09:13 meng shao @ shao__meng 精选 75 该内容源自@mvanhorn的分享,介绍了“智能体工程”如何重塑软件开发。其核心是从“人主导编码”转向“人主导方向、智能体执行”,中心从IDE变为终端与计划文件。方法论遵循Research → Plan → Work循环,核心是让plan.md约束智能体行为。分享者总结了22条实战技巧,涵盖规划、并行执行、输入方式、远程控制等方面,并列出了完整的工具栈。 Matt Van Horn : http://x.com/i/article/2061440101411102721 智能体 教程/实践 编码 部署/工程 推荐理由: mvanhorn 三个月从零到 27K stars 的实战手册,22 条 hack 把 agentic 开发从规划到执行到语音全打通,开发者能直接套用。
04:32 NVIDIA @ nvidia 精选 65 产品更新 端侧 部署/工程 推荐理由: 把数据中心算力塞进桌面的 DGX Station 开始发货了,GB300 加持,对需要本地大模型训练的研究员和独立开发者来说是个硬核生产力工具,以前不敢想的本地部署现在可以搞。
05:47 Google AI Developers @ googleaidevs 精选 74 智能体 DeepMind 产品更新 开源生态 推荐理由: DeepMind 把这个科学 agent 工具包开源了,核心是给 agent 工作流加科学基础、提升 token 效率,做 AI for Science 的可以直接 fork 试手,本周最值得上手的工具之一。
03:25 OpenAI Developers @ OpenAIDevs 精选 69 OpenAI 产品更新 编码 关联讨论 1 条 X:OpenAI (@OpenAI) 推荐理由: OpenAI给Codex装了三个团队专用插件,数据分析、创意生产和产品设计直接内置,如果你团队在用Codex,这是能省事的小更新。
03:56 Replit ⠕ @ Replit 精选 70 Microsoft 产品更新 部署/工程 推荐理由: 对同时用 Replit 和 Microsoft Fabric 的企业来说,这个集成省了一步繁琐的部署工作,把内部工具开发到上线的链路压短了一截,但如果你没用过 Fabric 就不会有感知。
03:59 OpenRouter @ OpenRouter 精选 68 Microsoft 产品更新 图像生成 多模态 推荐理由: 微软三个多模态模型一口气上架 OpenRouter,图像、转录、语音全齐了,开发者直接调 API 就能用,做产品的可以试试效果。
04:24 ClaudeDevs @ ClaudeDevs 精选 73 智能体 Anthropic 教程/实践 编码 推荐理由: 如果你用Claude Code写代码,这个官方视频值得立刻打开——它教你把手动检查编码进去,让Claude自己形成反馈循环,能省掉大量反复修改的时间。
03:20 Bloomberg:Technology(RSS) 精选 75 Alphabet宣布拟通过股权融资800亿美元,用于扩展AI基础设施。Anthropic已秘密提交IPO申请,在上市竞赛中领先于竞争对手OpenAI。此外,SpaceX正与华尔街机构协商其IPO的承销费用,HPE则因AI基础设施需求旺盛,年度销售预期超出市场估计。 Anthropic OpenAI 行业动态 部署/工程 关联讨论 1 条 Bloomberg:Technology(RSS) 推荐理由: Alphabet 80B的AI基建赌注说明巨头们在把AI当基础设施砸钱,Anthropic抢在OpenAI前秘密IPO也是重要信号。两件事放在一起看,AI行业的资本逻辑正在从讲故事转向抢位子。
04:06 Runway @ runwayml 精选 73 产品更新 视频 推荐理由: Runway把Aleph 2.0的视频编辑能力放到了API里,做视频工具的同学可以直接拿来用了,1080p 30秒还支持多镜头,以前要写一堆处理逻辑的功能现在一个API调用搞定。
05:16 Claude:Blog(网页) 精选 77 Claude Code 新增动态工作流功能,允许模型在运行时即兴创建和协调多智能体框架来处理复杂任务。该功能通过执行特定的 JavaScript 文件来生成和协调拥有独立上下文窗口的子代理,可解决单一上下文窗口中长时间执行任务可能出现的智能惰性等问题。工作流适用于研究、安全分析、代码审查等场景,通常消耗更多 token,更适合高价值复杂任务,其最佳实践仍在发展中。 智能体 Anthropic MCP/工具 产品更新 关联讨论 3 条 X:Thariq (@trq212) Claude Code:GitHub Releases(RSS) X:Claude Devs (@ClaudeDevs) 推荐理由: Claude Code 现在能自己动态生成多代理协调器,这在调试、审查、研究等复杂任务上是个真正的生产力跃迁,但普通编码工作用它反而是杀鸡用牛刀。
18:18 Rohan Paul @ rohanpaul_ai 精选 75 美国总统特朗普签署行政令,要求领先AI开发者自愿提交其最强大的AI模型进行网络安全测试。政府机构可在模型发布前获得最多30天的测试窗口,以便准备补丁和防护措施。"涵盖的前沿模型"并非所有新模型,而是指通过NSA等机构分类基准测试、达到政府定义的先进网络能力阈值的模型。行政令明确表示不建立强制性的政府许可、预审批或许可制度,并包含保密、网络安全、内幕风险、知识产权等保护条款。 安全/对齐 政策/监管 推荐理由: 特朗普签署行政令,要求顶尖AI开发者在发布前自愿提交具有高级网络能力的模型进行30天安全测试,虽非强制许可,但这标志着联邦政府首次系统性介入AI模型安全审查,所有做大模型的公司都得盯住这条线。 18:10 Alibaba Cloud @ alibaba_cloud 精选 65 首届Qwen Cloud全球AI黑客马拉松现已启动! 参与5大高级赛道,在全球舞台上挑战AI智能体极限。 总奖金池超过70,000美元(赛道冠军1万美元)。 立即在Devpost报名:https://click.qwencloud.com/m/20000000281/ 智能体 行业动态 推荐理由: 阿里云首次搞全球AI黑客马拉松,5赛道、70k美金,对想在真实云环境把agent跑通落地的人是个不错的练手机会,直接报名就行。 17:51 Anthropic:Research(发表成果 · 网页) 精选 69 Anthropic 分析 832 个 AI 恶意账户:中高风险攻击者半年从 33% 跃至 56% Anthropic 分析 2025 年 3 月至 2026 年 3 月间 832 个被封禁的恶意账户,映射至 MITRE ATT&CK 框架。67.3% 使用 AI 编写恶意软件,6.5% 用于横向移动。六个月间中高风险攻击者占比从 33% 升至 56%。AI 用于账户发现增长 8.9%,AI 辅助钓鱼下降 8.6%。传统基于技术数量或平台(Claude Code、API、聊天界面)的威胁评估失效,而 MITRE ATT&CK 框架尚未收录此类智能体编排行为。 Anthropic 安全/对齐 论文/研究 关联讨论 1 条 Anthropic:Newsroom(网页) 推荐理由: 这份报告用一整年的真实案例揭示了AI攻击正从初始入侵转向深度潜伏,连MITRE ATT&CK框架都开始跟不上。安全从业者值得一读,它告诉你下一波威胁长什么样。 14:36 SiliconFlow @ SiliconFlowAI 精选 67 @karpathy 的 llm-wiki 在几周内获得了 5,000+ 颗星。 其理念是:停止在每个会话中重新发现知识。让一个大语言模型构建并维护一个维基,每次使用时它都会变得更智能。 以下是如
有任何建议或问题,欢迎告诉我们
感谢您的反馈!