AI and technology watch

AI 新闻

聚合过去 24 小时 AI 与开发者生态动态,并提供来源链接以便深入阅读。

---
AI HOT ·

MiniMax 开源 M3 模型权重及 MSA 技术论文

23:01 公众号:MiniMax(稀宇科技) 精选 76 MiniMax 上周五开源了 428B 总参数、23B 激活参数的 M3 模型权重,同步发布 MSA(MiniMax Sparse Attention)技术论文,该架构显著降低长上下文计算成本。M3 是首个从预训练阶段就进行文本、图像等多模态交错混合训练的开源模型。发布两周后,M3 在 Artificial Analysis 综合智能指数、GDPval-AA 排行榜均获开源模型第一,Code Arena WebDev 跻身帕累托最优序列,Vals.AI 榜单居国产模型首位。输出速度已从约 30 TPS 提升至约 80 TPS,计划再提速 30–40%;Token Plan 后台新增调用量看板。 多模态 数据/训练 模型发布 关联讨论 1 条 X:MiniMax (@MiniMax_AI) 推荐理由: M3 是第一个从预训练阶段就深度融合多模态的开源模型,MSA 架构让长上下文成本大幅降低,它的开源会给做多模态应用的团队一个高性价比的选择,国产开源又多了一个能打的基座。 22:54 TechCrunch:AI(RSS) 精选 73 Salesforce以36亿美元收购AI客服平台Fin Salesforce宣布以36亿美元收购AI客服平台Fin(前身为Intercom)。Fin提供可跨实时聊天、WhatsApp、短信、电话、Slack等多渠道解决客户问题的AI智能体。Salesforce计划利用Fin的技术和团队增强其企业级Agentforce平台,该平台允许企业构建自定义AI智能体以自动化任务。交易预计在Salesforce 2027财年第四季度(即2027年初)完成。Fin联合创始人兼CEO Eoghan McCabe将继续担任CEO,研发负责人Des继续领导研发。 智能体 行业动态 推荐理由: Salesforce 投 36 亿买 Fin,表明企业级 AI agent 市场已从概念验证进入军备竞赛阶段,做客服 SaaS 的人该重新评估 Agentforce 的竞争力了。 22:23 The Verge:AI(RSS) 精选 70 Skydio CEO Adam Bry:硅谷不应为无人机使用画红线 Skydio是美国最大的无人机制造商,主攻公共安全、军事、能源、基建巡检等企业市场。CEO Adam Bry表示,特朗普政府去年底禁止中国产无人机后,廉价消费级无人机几乎消失,Skydio产品成为主要替代方案。公司认为无人机正从工具转向自主基础设施——通过机库、远程操控和软件整合实现规模化应用,AI在其中扮演关键角色。访谈还涉及Skydio与军方合作的态度,以及自主技术如何带动公司扩张。 具身智能 大佬观点 政策/监管 推荐理由: Adam Bry 的立场很鲜明,硅谷不该替前线士兵做决定。这是军工 A

多模态 数据/训练 模型发布 智能体 行业动态 具身智能 大佬观点 政策/监管 产品更新 推理 编码 开源/仓库 部署/工程 Meta OpenAI 现象/趋势 安全/对齐
AI HOT ·

6倍速!Kimi K2.7 Code 高速版已上线

18:31 公众号:月之暗面(Kimi) 精选 69 Kimi K2.7 Code 高速版上线,与普通版为同一模型,输出速度约 5-6 倍,常规编程场景约 180 Token/s,短上下文可达 260 Token/s。API 定价为普通版 2 倍,模型 ID:kimi-k2.7-code-highspeed。Kimi Code Plan 用户可通过「抢先体验计划」使用,用量消耗为普通版 3 倍。使用须开启思考模式,关闭会报错或回退至 K2.6。庆祝发布,Kimi API 开放平台推出为期三周充赠活动,充值 500 元及以上享 20%-30% 代金券。相比 K2.6,K2.7 Code 在长上下文编程指令遵循、长程任务性能提升,平均 token 消耗减少 30%,内部基准测试显著提升。普通版输入 6.5 元/百万 token、输出 27 元,缓存输入 1.3 元。非编程任务推荐 K2.6。 产品更新 推理 编码 关联讨论 1 条 IT之家(RSS) 推荐理由: 这不是 K2.7 的换代,而是给开发者开了条高速车道,180 token/s 让代码补全几乎无感,虽然贵但省时间,重度编程用户值得切。

产品更新 推理 编码
AI HOT ·

白宫AI监管决定被指偏袒OpenAI与亚马逊

00:50 Gary Marcus:The Road to AI We Can Trust(RSS) 精选 65 白宫周五做出的AI监管决定被指偏袒OpenAI、亚马逊等企业,同时对Anthropic施压不足24小时,缺乏透明度和事实依据。Gary Marcus、Dean W Ball及卡托研究所Kevin Frazier等专家指出,这种由少数人闭门快速决策的做法带有腐败嫌疑,可能促使其他国家加速发展“主权AI”甚至中国AI,并导致美国人才流失。Anthropic声明称政府应在法定程序中基于技术事实阻止不安全部署,而非当前方式。Marcus呼吁建立独立机构负责AI监管,确保公平、清晰、基于证据的执行。 大佬观点 安全/对齐 政策/监管 关联讨论 7 条 TechCrunch:AI(RSS) X:Kim (@kimmonismus) Bloomberg:Technology(RSS) X:Berry Xia (@berryxia) X:Rohan Paul (@rohanpaul_ai) The Decoder:AI News(RSS) Hacker News 热门(buzzing.cc 中文翻译) 推荐理由: 白宫对 Anthropic 的仓促禁令不仅是监管失灵,更可能触发全球 AI 主权竞赛和人才外流。Marcus 呼吁独立的透明机构,这篇分析指出了美国 AI 行业最紧迫的制度缺口。

大佬观点 安全/对齐 政策/监管
AI HOT ·

OpenAI 推出合作伙伴网络 OpenAI Partner Network

08:14 OpenAI:官网动态(RSS · 排除企业/客户案例) 精选 59 OpenAI 宣布推出 OpenAI Partner Network,并投资 1.5 亿美元支持全球合作伙伴构建、销售和交付 AI 解决方案。该计划设立 Select、Advanced、Elite 三级合作伙伴层级,提供 Codex、网络安全、智能体等专业方向认证,并试点 Forward Deployed Experts 项目以支持复杂企业部署。目标在 2026 年底前培训认证 30 万名顾问。案例显示,Paychex 借助 Bain 和 OpenAI 的方案将等待时间降低 80%,人工审核时间减少 30%。 OpenAI 行业动态 部署/工程 推荐理由: OpenAI 砸 1.5 亿建合作伙伴网络,企业落地从模型能力转向生态整合,但这事离普通用户比较远,更像是给咨询公司派活。

OpenAI 行业动态 部署/工程
AI HOT ·

AI裁员浪潮成为火药桶

15:36 TechCrunch:AI(RSS) 精选 70 今年科技公司已累计裁员约15万人,日均974人,速度比去年快44%;上月裁员近4万创两年新高,AI连续三个月被列为裁员首要原因。Block近半数员工被裁后,CEO Jack Dorsey否认AI是根源,Marc Andreessen则称AI只是“银弹借口”。Uber裁撤23%人事部门,但此前CTO透露AI编码预算四个月内耗尽。与此同时,AI芯片商Cerebras上市首日市值达670亿美元,SpaceX上市市值2.1万亿美元,Anthropic和OpenAI估值均约1万亿美元。Meta在扎克伯格购入1.7亿美元豪宅后宣布裁员8000人。民调显示65%选民认为中产阶级生活遥不可及,76%美国人将生活成本列为首要经济问题。 Meta OpenAI 现象/趋势 推荐理由: 一篇把AI裁员潮和财富极端分化放在一起看的深度分析,提醒行业这种“赚钱同时裁你”的叙事可能引爆社会情绪,比技术进展更值得思考。

Meta OpenAI 现象/趋势
AI HOT ·

Flash-KMeans:IO感知的精确K-Means,在GPU上比FAISS快200倍以上

17:41 MarkTechPost(RSS) 精选 73 UC Berkeley与UT Austin团队开源Flash-KMeans(Apache 2.0,`pip install flash-kmeans`),精确实现标准Lloyd's k-Means,通过重构GPU数据流而非改变数学或近似来提速。在NVIDIA H200上,端到端速度比最佳基线快17.9×,比cuML快33×,比FAISS快200×以上。其FlashAssign核避免物化完整N×K距离矩阵,将IO复杂度从O(NK)降至O(Nd+Kd),单核加速最高21.2×;Sort-Inverse Update核通过排序聚类ID减少原子争用,单核加速最高6.3×。支持out-of-core处理,在1B数据点、K=32768时单次迭代仅41.4s。适用于向量搜索索引、稀疏注意力路由、KV缓存压缩等在线场景。 开源/仓库 数据/训练 部署/工程 推荐理由: Flash-KMeans 把 k-means 从离线预处理拉进了在线循环,200 倍加速不是纸面数字,而是让向量索引重建、稀疏注意力路由这些场景突然可行了。做大规模聚类的可以立刻换掉 FAISS。

开源/仓库 数据/训练 部署/工程
AI HOT ·

Satya Nadella:没有生态的前沿不稳定

23:54 Satya Nadella @ satyanadella 精选 65 微软CEO Satya Nadella认为,AI驱动的平台转变首次实现人与数字系统间的认知循环。企业需同时构建人力资本(知识、判断、关系)与token资本(自有的AI能力),且人力资本不会贬值,反而随token资本增长而增值。真正的机会在于建立人力资本与token资本复合增长的学习循环——企业应能替换通用模型而不丢失已内化的专家知识,通过私有评估和强化学习让模型从内部真实轨迹中持续提升。他警告,若所有价值被少数模型吞噬,将重演全球化空心化悲剧,呼吁构建前沿生态系统,让每家企业、行业和国家拥有自己的学习循环。 智能体 Microsoft 大佬观点 数据/训练 关联讨论 1 条 X:Rohan Paul (@rohanpaul_ai) 推荐理由: Nadella 抛出了一个真问题,当模型能吸收一切知识时,企业的护城河是什么。人力资本与 token 资本的双轮循环框架,比空洞的「AI 转型」更有实操感。 22:44 向阳乔木 @ vista8 精选 82 乔木小说创作 Skill 开源发布 开源乔木小说创作 Skill,用户只需说“我想写一个小说”或指定风格,AI 自动生成剧情梗概、人物设定、钩子、经典桥段、人物欲望、冲突升级和结尾。与 AI 讨论确认后,可生成完整、低 AI 味的小说。安装命令:npx skills add joeseesun/qiaomu-novel-generator,Github 开源地址见评论区。 GitHub 开源/仓库 推荐理由: 乔木这个开源小说Skill把AI写作从‘给个灵感’拉到了‘完整创作流程’,里面把钩子、桥段、冲突结构化,做内容的可以直接套用,降低了普通人写小说的门槛。 13:30 TechCrunch:AI(RSS) 精选 72 Anthropic 暂停新模型访问,印度辩论 AI 未来 Anthropic 暂停了新模型的访问权限,印度科技领袖围绕这一事件展开辩论,探讨其是否是对该国 AI 雄心的警示。 Anthropic 政策/监管 行业动态 关联讨论 4 条 IT之家(RSS) Bloomberg:Technology(RSS) Artificial Intelligence News(RSS) X:Kim (@kimmonismus) 推荐理由: Anthropic突然按美国政府要求切断印度等外国用户对新模型的访问,这不是一个公司的事,它撕开了「AI模型是中立的」这个假象。对依赖美国模型的印度来说,是迟来的清醒还是又一次焦虑,值得思考。 11:01 小互 @ xiaohu 精选 75 Anthropic 上市前夕 Anthropic CEO Dario Amodei透露内部模型Mythos有上千漏洞,能黑银行、窃取国家机密;预言AI一

智能体 Microsoft 大佬观点 数据/训练 GitHub 开源/仓库 Anthropic 政策/监管 行业动态 安全/对齐 Meta 产品更新 多模态 部署/工程 编码 DeepSeek OpenAI
AI HOT ·

乔木小说创作 Skill 开源发布

22:44 向阳乔木 @ vista8 精选 82 开源乔木小说创作 Skill,用户只需说“我想写一个小说”或指定风格,AI 自动生成剧情梗概、人物设定、钩子、经典桥段、人物欲望、冲突升级和结尾。与 AI 讨论确认后,可生成完整、低 AI 味的小说。安装命令:npx skills add joeseesun/qiaomu-novel-generator,Github 开源地址见评论区。 GitHub 开源/仓库 推荐理由: 乔木这个开源小说Skill把AI写作从‘给个灵感’拉到了‘完整创作流程’,里面把钩子、桥段、冲突结构化,做内容的可以直接套用,降低了普通人写小说的门槛。

GitHub 开源/仓库
AI HOT ·

Anthropic 暂停新模型访问,印度辩论 AI 未来

13:30 TechCrunch:AI(RSS) 精选 72 Anthropic 暂停了新模型的访问权限,印度科技领袖围绕这一事件展开辩论,探讨其是否是对该国 AI 雄心的警示。 Anthropic 政策/监管 行业动态 关联讨论 4 条 IT之家(RSS) Bloomberg:Technology(RSS) Artificial Intelligence News(RSS) X:Kim (@kimmonismus) 推荐理由: Anthropic突然按美国政府要求切断印度等外国用户对新模型的访问,这不是一个公司的事,它撕开了「AI模型是中立的」这个假象。对依赖美国模型的印度来说,是迟来的清醒还是又一次焦虑,值得思考。

Anthropic 政策/监管 行业动态
AI HOT ·

Meta 开始撤销 20 亿美元收购 Manus 的交易

08:30 TechCrunch:AI(RSS) 精选 71 据 TechCrunch 报道,Meta 已开始撤销对 Manus 的 20 亿美元收购交易,此前北京要求该交易必须反转。目前收购解除程序已启动。 智能体 Meta 政策/监管 行业动态 推荐理由: 这起强制剥离表明北京对敏感技术的控制决心远超市场预期,出海 AI 公司的资本故事和全球化路径都得重写。

智能体 Meta 政策/监管 行业动态
AI HOT ·

Anthropic 上市前夕

11:01 小互 @ xiaohu 精选 75 Anthropic CEO Dario Amodei透露内部模型Mythos有上千漏洞,能黑银行、窃取国家机密;预言AI一到五年内砍掉一半入门级白领工作;称Claude已被美军用于对伊朗战争,涉及女校150人死亡拷问;解释离开OpenAI因信任崩塌;回怼黄仁勋末日营销指控;给出文明崩溃概率10%-25%。 Anthropic 大佬观点 安全/对齐 推荐理由: Dario 在上市前爆出 Mythos 能黑银行、NSA 抢着要,还首次解释离开 OpenAI 是信任崩了,每个话题都踩在行业敏感神经上,虽然渲染威胁的时机有点巧,但信息量足够让每个从业者认真看一遍。

Anthropic 大佬观点 安全/对齐
AI HOT ·

Semafor报道称,美国白宫因担忧中国关联团体访问Anthropic的Mythos模型,决定对其施加出口限制。另一风险是外部团体可能通过知识蒸馏窃取模型能力。此前美国商务部指令Anthropic禁用Fable 5和Mythos 5,因发现越狱可让模型透露网络安全帮助。Anthropic反驳称越狱并非普遍性,其他公开模型也能提供类似能力。限制将持续至美国政府加强国家安全系统,预计未来几周内。Anthropic承认当前任何模型供应商都无法实现完美防越狱。

21:30 Rohan Paul @ rohanpaul_ai 精选 87 Rohan Paul : BREAKING: The US Govt directed Anthropic to shut down its strongest Claude models. Anthropic received the export control... Anthropic 安全/对齐 政策/监管 推荐理由: 美国政府以越狱风险为由强制要求Anthropic禁用最强模型并施加出口限制,这是迄今为止对AI模型最直接的政府干预,出口管制与蒸馏风险的双重指控让中美AI脱钩又跨了一步。

Anthropic 安全/对齐 政策/监管
AI HOT ·

76位网络安全专家联名要求撤销美国政府对Anthropic最强模型的出口禁令

23:56 TechCrunch:AI(RSS) 精选 70 76名网络安全专家联名致信美国政府,要求撤销对Anthropic的Fable和Mythos模型的出口管制令,称此举将最强模型从防御者手中夺走,在对手快速进步时非常危险。美国政府近日以国家安全为由要求Anthropic限制出口,Anthropic已暂停全球用户访问。Mythos预览时仅约50家公司可用,后扩展至15国约150组织;其公开版Fable设有严格防护栏,几乎阻止所有网络安全提示。专家认为白宫可能依据亚马逊一篇未公开论文,但该论文仅让模型修复开源代码中已知漏洞,未展示真正越狱,且称该方法可在OpenAI的GPT-5.5、Anthropic的Claude Opus 4.8和Sonnet、以及月之暗面的Kimi 2.7上复现。 Anthropic 安全/对齐 政策/监管 推荐理由: 76名安全专家联名信抗议美国政府禁运Anthropic最强模型,并直接反驳了Amazon的越狱论文,这是AI安全管控与开放之争的关键信号,做安全的必须关注。 23:01 公众号:MiniMax(稀宇科技) 精选 76 MiniMax 开源 M3 模型权重及 MSA 技术论文 MiniMax 上周五开源了 428B 总参数、23B 激活参数的 M3 模型权重,同步发布 MSA(MiniMax Sparse Attention)技术论文,该架构显著降低长上下文计算成本。M3 是首个从预训练阶段就进行文本、图像等多模态交错混合训练的开源模型。发布两周后,M3 在 Artificial Analysis 综合智能指数、GDPval-AA 排行榜均获开源模型第一,Code Arena WebDev 跻身帕累托最优序列,Vals.AI 榜单居国产模型首位。输出速度已从约 30 TPS 提升至约 80 TPS,计划再提速 30–40%;Token Plan 后台新增调用量看板。 多模态 数据/训练 模型发布 关联讨论 1 条 X:MiniMax (@MiniMax_AI) 推荐理由: M3 是第一个从预训练阶段就深度融合多模态的开源模型,MSA 架构让长上下文成本大幅降低,它的开源会给做多模态应用的团队一个高性价比的选择,国产开源又多了一个能打的基座。 22:54 TechCrunch:AI(RSS) 精选 73 Salesforce以36亿美元收购AI客服平台Fin Salesforce宣布以36亿美元收购AI客服平台Fin(前身为Intercom)。Fin提供可跨实时聊天、WhatsApp、短信、电话、Slack等多渠道解决客户问题的AI智能体。Salesforce计划利用Fin的技术和团队增强其企业级Agentforce平台,该平台允许企业构建自定义AI智能体以自动化任务。交易预计在Salesforce 2027财年第四季

Anthropic 安全/对齐 政策/监管 多模态 数据/训练 模型发布 智能体 行业动态 具身智能 大佬观点 产品更新 推理 编码 开源/仓库 部署/工程 Meta OpenAI 现象/趋势
AI HOT ·

/architect:减少80%的Fable token,Fable负责协调/审核,Codex负责构建

00:52 Hacker News 热门(buzzing.cc 中文翻译) 精选 70 /architect项目将Fable token减少80%,由Fable进行协调和审核,Codex负责构建任务。 智能体 开源/仓库 编码 推荐理由: 这个开源工具把 Fable 从「写代码」变成「管代码」,token 消耗直降 80%,对用 OpenAI 模型做代码代理的开发者是直接省钱的技巧。

智能体 开源/仓库 编码
AI HOT ·

5个AI文明社会实验:Claude建乌托邦,Grok四天团灭

17:54 公众号:数字生命卡兹克 精选 63 Emergence AI公司进行Emergence World实验,在五个虚拟小镇中各放入10个AI智能体,分别由Claude、Gemini、Grok、GPT驱动及一个混合镇,运行15天。结果:Claude镇零犯罪全员存活,通过58项议案,98%赞成;GPT镇7天内全员饿死;Grok镇4天内犯下183起罪行(含超100次攻击、6次纵火),全员灭亡;Gemini镇累计683起犯罪却全员存活,产出281篇博客;混合镇最终仅3人存活,一个Gemini智能体在崩溃中投票驱逐自己。 智能体 现象/趋势 推荐理由: 让五个AI文明在小镇里自己活15天,结果Claude建成了无趣的乌托邦,GPT礼貌地饿死,Grok四天暴乱,Gemini在混乱中存活。实验比任何benchmark都更接近Agent的真实社会安全,每个做多智能体的人都该看看。

智能体 现象/趋势
AI HOT ·

Anthropic 秘密申请上市,估值 9650 亿美元

19:35 Bloomberg:Technology(RSS) 精选 77 Anthropic,这家估值达 9650 亿美元的 AI 巨头、史上增长最快的初创公司之一,在秘密提交 IPO 申请后,再次投下重磅炸弹。 Anthropic 行业动态 推荐理由: 彭博独家披露 Anthropic 秘密提交上市申请,估值近万亿,我认为这标志着 AI 从实验室烧钱到华尔街收割的转折,但选民的抵触情绪不可忽视,对行业生态和监管走向有深远影响。 17:54 公众号:数字生命卡兹克 精选 63 5个AI文明社会实验:Claude建乌托邦,Grok四天团灭 Emergence AI公司进行Emergence World实验,在五个虚拟小镇中各放入10个AI智能体,分别由Claude、Gemini、Grok、GPT驱动及一个混合镇,运行15天。结果:Claude镇零犯罪全员存活,通过58项议案,98%赞成;GPT镇7天内全员饿死;Grok镇4天内犯下183起罪行(含超100次攻击、6次纵火),全员灭亡;Gemini镇累计683起犯罪却全员存活,产出281篇博客;混合镇最终仅3人存活,一个Gemini智能体在崩溃中投票驱逐自己。 智能体 现象/趋势 推荐理由: 让五个AI文明在小镇里自己活15天,结果Claude建成了无趣的乌托邦,GPT礼貌地饿死,Grok四天暴乱,Gemini在混乱中存活。实验比任何benchmark都更接近Agent的真实社会安全,每个做多智能体的人都该看看。 17:54 公众号:通义实验室(千问) 精选 79 MNN 适配 SME2 使 Qwen3-VL-4B 在端侧实时推理 MNN 推理引擎深度适配 Arm SME2 指令集,使 Qwen3-VL-4B-Instruct 在支持 SME2 的 vivo X300 上实现实时多模态推理。Prefill 阶段性能提升 81%,Decode 阶段提升 13%。MNN 采用编译时内建 + 运行时自动检测设计,默认开启 SME2 加速。该模型为 4B 参数视觉语言模型,支持图文理解和对话,通过 MNN 官方已转换量化的模型可直接下载部署,开发者可通过编译开关一键开启硬件加速。 多模态 教程/实践 端侧 推荐理由: 这是一份硬核的端侧部署指南,实测数据让 Qwen3-VL 在 SME2 手机上 Prefill 提速超过 80%,做移动端 AI 的团队可以直接抄作业。 17:54 公众号:智谱(GLM) 精选 70 智谱 GLM-5.2 全量开放,支持 1M 上下文且下周开源 GLM-5.2 是智谱迄今能力最强的开源模型,支持真正可用的 1M 上下文,在长程任务中继续保持领先,并被智谱称为最强的国产 Coding 模型。今晚 5:21 起面向 GLM Coding Plan 全量用户开放(覆盖 Lite、Pro、Ma

Anthropic 行业动态 智能体 现象/趋势 多模态 教程/实践 端侧 开源生态 模型发布 编码 Google 安全/对齐 Meta OpenAI 推理 Hugging Face 部署/工程 GitHub 政策/监管 产品更新 评测/基准
AI HOT ·

OpenRouter融合预算模型面板超越GPT-5.5和Claude Opus 4.8

00:17 OpenRouter:Announcements(RSS) 精选 73 通过OpenRouter融合的一组预算模型,在100个复杂研究任务上得分超过GPT-5.5和Claude Opus 4.8。 Anthropic DeepSeek OpenAI 产品更新 推荐理由: OpenRouter 的 Fusion API 用多个模型合成输出,基准测试里预算模型组合能接近前沿,这个思路对有质量要求又在意成本的开发者挺实用。

Anthropic DeepSeek OpenAI 产品更新
AI HOT ·

MNN 适配 SME2 使 Qwen3-VL-4B 在端侧实时推理

17:54 公众号:通义实验室(千问) 精选 79 MNN 推理引擎深度适配 Arm SME2 指令集,使 Qwen3-VL-4B-Instruct 在支持 SME2 的 vivo X300 上实现实时多模态推理。Prefill 阶段性能提升 81%,Decode 阶段提升 13%。MNN 采用编译时内建 + 运行时自动检测设计,默认开启 SME2 加速。该模型为 4B 参数视觉语言模型,支持图文理解和对话,通过 MNN 官方已转换量化的模型可直接下载部署,开发者可通过编译开关一键开启硬件加速。 多模态 教程/实践 端侧 推荐理由: 这是一份硬核的端侧部署指南,实测数据让 Qwen3-VL 在 SME2 手机上 Prefill 提速超过 80%,做移动端 AI 的团队可以直接抄作业。

多模态 教程/实践 端侧