2026-07-02
来源: tech.meituan.com
38
世界模型正在从“看视频、续视频”走向“理解动作、响应动作、保持世界一致”。美团 LongCat 团队提出并开源的 WBench,把评测目标对准了这个更难的问题:交互式视频世界模型在多轮交互里到底哪里掉链子。它不像只看单段生成质量的打分表,更像一台“CT 扫描仪”,把模型从被动观看到主动交互的能力拆开检查。 普通视频生成评测通常关心一段视频是否清晰、是否...
2026-07-02
来源: tech.meituan.com
40
海报生成看起来像是“输入一句话,出一张图”,但真正落到外卖营销、品牌 IP、活动运营场景里,难点远不止模型会画图。美团智能创作团队围绕海报生成 AIGC 构建了“生成-编辑-评判”的完整技术闭环,并已在美团外卖、品牌 IP 等场景落地和开源。这个方向的价值不只是省几张设计图,而是把创意生产变成可迭代、可审核、可规模化交付的系统。 营销海报通常同时包含商...
2026-07-02
来源: tech.meituan.com
29
LongCat 开源 VitaBench 2.0,把智能体评测的重心从“单轮答得好不好”推向“长期相处中是否真正理解用户”。它面向真实生活场景,关注长期、动态用户建模,系统评测大语言模型在持续互动里的个性化与主动性能力。 很多智能体 demo 看起来很聪明,因为它们只需要处理一次明确请求:写邮件、查日程、总结文档、生成计划。但真实用户不是静态 prom...
2026-07-02
来源: tech.meituan.com
29
ICML 2026 作为机器学习领域的重要顶会,关注的不只是模型榜单,而是机器学习在理论、方法和真实系统中的关键问题。美团技术团队发布论文精选,说明产业团队仍在把业务场景中的难题抽象成可被学术社区检验的问题:模型如何更稳、训练如何更高效、决策如何更可信、算法如何在复杂环境中产生实际影响。 这类论文精选最适合工程团队做两件事:一是快速判断哪些研究方向正在...
2026-07-02
来源: tech.meituan.com
36
美团发布 LongCat-2.0 的关键信息,不只是“参数更大”:它是一个总参数 1.6T、平均激活约 48B、动态激活范围 33B~56B 的万亿参数模型,并且在五万卡国产算力集群上完成了从训练到推理的全流程。更值得开发者关注的是,它的设计目标一开始就对准了真实的 Agentic Coding:让模型在代码理解、生成、执行和多步修复中更高效、更稳定。...
2026-06-12
来源: tech.meituan.com
38
ACL 是自然语言处理领域最具影响力的顶会之一,美团今年有六篇论文被收录,技术方向横跨大模型评测、复杂流程推理、竞赛级数学思维优化、强化学习优化以及生成式推荐。这些工作不是孤立的学术探索——它们共同指向一个现实问题:大模型从「能对话」走向「能可靠地完成复杂任务」,中间还有哪些关键缺口需要补上。 评测论文的核心关切是:现有基准是否真的能区分模型的能力层级...
2026-06-04
来源: tech.meituan.com
33
不少开发者在构建 OpenClaw 自动化工作流时,习惯走"捷径"——通过第三方订阅服务做非官方调用。短期看确实省事,但账号被标记、服务随时中断、数据泄露的风险像定时炸弹。LongCat 团队最近开放了稳定合规的官方免费 API,直接从官方渠道接入 OpenClaw,让自动化工作流在安全底线之上跑起来。 第三方订阅服务通常的做法是:用中间人身份代理 O...
2026-06-04
来源: tech.meituan.com
52
站外页面是用户第一次接触大众点评的入口——从微信分享、搜索引擎到短视频跳转,每一毫秒的加载延迟都在直接流失转化。增长团队面对的现实很骨感:旧 M 站基于传统 SSR + 水合架构,首屏可交互时间被框架自身的 hydration 拖累,维护成本也随着业务膨胀居高不下。引入 Qwik.js 重构后,团队用"可恢复性"替代了水合,配合全链路工程优化,各核心页...
2026-06-04
来源: tech.meituan.com
39
业务越做越大,报表越建越多,数据口径却越来越乱——这是很多公司数据团队的共同痛点。美团数据平台也踩过同样的坑:个性化数据集驱动下,不同团队各自建表、各自定义指标,同一笔 GMV 在三份报表里出现三个数字,查询性能还因为重复计算和宽表膨胀一路下滑。 他们的解法不是再加一层报表治理流程,而是从架构层面重构——以指标平台为核心,建设自动语义和增强计算两种能力...
2026-06-04
来源: tech.meituan.com
40
过去两年,多模态模型的常见做法是让图像和音频先过一道"翻译"——视觉编码器把图片压缩成向量,语音模型把声音转成文本,再喂给语言模型做推理。翻译过程不可避免地丢信息:一张图里的空间关系、一段语音里的情绪起伏,经过压缩后只剩模糊的摘要。 美团团队发布的 LongCat-Next 走了一条不同的路:让视觉和语音直接成为模型的"母语",与文本在同一个词元空间里...