要闻 经济 栏目首页 聚焦 科技 连接 系统 产品 联想专题 资讯 金融 科技 理财 财经 知识 金融 游戏
首页 > > 正文

美团LongCat-Flash-Omni正式发布并开源 开启全模态实时交互时代

2025-11-03 13:08:33来源:新华财经


(资料图片)

新华财经北京11月3日电(记者丁雅雯)3日,美团自研大模型 LongCat-Flash系列再升级。全新家族成员LongCat-Flash-Omni正式发布并开源,LongCat官方App同步上线公测。目前,新App已支持联网搜索、语音通话等功能,视频通话等功能会稍后上线;Web端则增加图片、文件上传和语音通话等功能。

据介绍,LongCat-Flash-Omni以LongCat-Flash系列的高效架构设计为基础,集成了高效多模态感知模块与语音重建模块,在总参数5600亿的庞大参数规模下,仍实现低延迟的实时音视频交互能力,为开发者的多模态应用场景提供了更高效的技术选择。

美团称,新模型也是业界首个实现“全模态覆盖、端到端架构、大参数量高效推理”于一体的开源大语言模型,首次在开源范畴内实现了对标闭源模型的全模态能力,并凭借创新的架构设计与工程优化,让大参数模型在多模态任务中能实现毫秒级响应,解决行业内推理延迟的痛点。

据介绍,全模态模型训练的核心挑战之一是“不同模态的数据分布存在显著异质性”。LongCat-Flash-Omni采用渐进式早期多模融合训练策略,在平衡数据策略与早期融合训练范式下,逐步融入文本、音频、视频等模态,确保全模态性能强劲且无任何单模态性能退化。综合评估结果表明,LongCat-Flash-Omni在综合性的全模态基准测试(如Omni-Bench, WorldSense)上达到了开源最先进水平(SOTA),并在文本、图像、音频、视频等各项模态的能力位居开源模型前列,实现“全模态不降智”的结果。

9月1日,美团正式对外发布并开源了自研大模型LongCat-Flash-Chat。这是美团首次将大模型作为完整产品开放给行业与开发者。

关键词: LongCat 美团 Flash 开源 Omni 正式 交互 实时 发布 模型

热点
39热文一周热点