从高拟真到真可用,LongCat-Video-Avatar 1.5 正式开源
LongCat-Video-Avatar 1.5 开源版本在唇形同步、物理合理性、长视频稳定性等方面实现显著提升,支持复杂商业场景下的高质量数字人视频生成。
入选理由:采用 Whisper-large 编码器,提升唇形同步与动作稳定性。
公司
别名:meituan
中国大型互联网公司,发布Agent评测实践方法论
已跟踪 14 条高相关材料
最近变化
2026-08-15 · Agent评测需覆盖结果层、过程层、效率层、风险层四维指标
为什么值得关注
美团 被反复提及时,通常意味着它正在影响产品路线、开发者工作流或 AI 产业判断。这个页面把分散材料合并成一个可持续更新的观察入口。
从高拟真到真可用,LongCat-Video-Avatar 1.5 正式开源
美团技术团队 · 9.2 分
LongCat-Video-Avatar 1.5 开源版本在唇形同步、物理合理性、长视频稳定性等方面实现显著提升,支持复杂商业场景下的高质量数字人视频生成。
Agent评测漫谈 —— 由浅入深讲解Agent评测
美团技术团队 · 8.5 分
Agent评测需覆盖结果、过程、效率、风险四层,美团实践证明人机一致率可通过二元化Rubric提升至92%。
美团正式发布 CatPaw:全场景 AI Agent,从个人提效到企业智能化
美团技术团队 · 8.5 分
美团发布CatPaw平台,基于LongCat 2.0模型实现全场景AI Agent,覆盖个人提效与企业智能化。平台整合本地生活认知,提供多终端协作、专家技能库与企业级安全能力。
已收录 14 条与 美团 相关的内容,按评分排序。
LongCat-Video-Avatar 1.5 开源版本在唇形同步、物理合理性、长视频稳定性等方面实现显著提升,支持复杂商业场景下的高质量数字人视频生成。
入选理由:采用 Whisper-large 编码器,提升唇形同步与动作稳定性。
Agent评测需覆盖结果、过程、效率、风险四层,美团实践证明人机一致率可通过二元化Rubric提升至92%。
入选理由:Agent评测需覆盖结果层、过程层、效率层、风险层四维指标
美团发布CatPaw平台,基于LongCat 2.0模型实现全场景AI Agent,覆盖个人提效与企业智能化。平台整合本地生活认知,提供多终端协作、专家技能库与企业级安全能力。
入选理由:LongCat 2.0模型参数达1.6T,支持1M超长上下文,首次在国产算力卡上完成训练。
美团技术团队2026年32篇顶会论文涵盖大模型、多模态等前沿领域,含ACL杰出论文奖,但内容以直播回放和论文列表为主,技术细节不足。
入选理由:美团技术团队32篇论文被ACL/SIGIR/ICML等顶会收录,含1篇ACL杰出论文。
美团LongCat发布LongCat-2.0,采用1.6T参数MoE架构,SWE-bench Pro得分59.5,接近闭源模型水平。
入选理由:LongCat-2.0采用1.6T参数MoE架构,约48B活跃参数,支持1M上下文窗口
美团发布LongCat-2.0,采用1.6T参数MoE架构,支持1M上下文窗口,训练推理全程依赖国产加速卡。
入选理由:LongCat-2.0使用5-6万张中国国产加速卡训练,实现训推全链路国产化
美团tabbit国际版免费接入GPT-5.5、Claude Opus 4.8等旗舰模型,用户无需订阅即可使用。
入选理由:美团tabbit国际版免费提供GPT-5.5、Claude Opus 4.8等旗舰模型。
美团通过Agent评测思路管理AI Coding,成功重构31万行代码,实现技术债的渐进式消化。
入选理由:用Agent评测思路实现“人人对齐→人机对齐”的规范统一。
美团在ACL 2026发布六篇论文,涵盖代码评测、业务流程评估、数学推理、模型优化等方向,揭示大模型在复杂任务中的能力短板与优化路径。
入选理由:CoreCodeBench评测基准有效率达78.55%,揭示模型在不同任务类型上的能力错配。
美团开源 General 365 基准测试,揭示大模型在通用推理上的真实能力边界。
入选理由:Gemini 3 Pro 在 General 365 上准确率仅 62.8%,多数模型未达及格线
本文为科技新闻速报,包含AI模型商业化、企业动态等信息,但缺乏技术深度和工程实践指导。
入选理由:国行苹果AI将采用通义千问作为底层模型
Mindverse 完成 A 轮融资,美团领投,总融资额达 5000 万美元,致力于构建持续学习的 Agent 模型,但文章内容主要为新闻报道,缺乏技术细节与深度分析。
入选理由:Mindverse 总融资额达 5000 万美元,其中美团领投 A 轮。
作者对一条关于美团裁员的不实消息表示质疑,并认为回应和裁员本身才是关键信息。
入选理由:不实消息通常最准确
该‘文章’仅为一条 Twitter 转推,仅含论文标题《HeavySkill: Heavy Thinking as the Inner Skill in Agentic Harness》及 Hugging Face 论文链接,无实质内容解析。
入选理由:未提供任何技术细节、实验数据或方法论描述