LongCat-2.5-Preview是一款由美团 LongCat 团队于2026年9月推出的原生多模态长程智能体大模型,主要用于在终端、浏览器与桌面软件中连续执行多步任务,支持原生 100 万 token 上下文与图片理解,适用于需要长时间自主运行的智能体工作流。
| 基础信息 | 内容 |
|---|---|
| 产品定位 | 原生多模态长程智能体大模型 |
| 出品方 | 美团 LongCat 团队 |
| 发布时间 | 2026年9月25日 |
| 模型架构 | 稀疏 MoE,总参数约 1.6 万亿,激活约 480 亿 |
| 上下文窗口 | 100 万 token |
| 最大输出长度 | 128K token |
| 输入模态 | 原生文本与图片理解 |
| 接口兼容 | 同时兼容 OpenAI 与 Anthropic 协议 |
| 调用渠道 | LongCat API 开放平台与网页端 |
| 生态接入 | Codex、OpenCode、OpenClaw、CatPaw |
| 开放情况 | 预览版未公布权重开放计划 |

LongCat-2.5-Preview 的核心能力
LongCat-2.5-Preview 面向的是智能体从代码与工具调用走向界面操作的一段空档。此前的长程任务多集中在代码仓库与命令行内,浏览器、桌面软件与电子表格中的操作仍依赖人工逐步确认。对关注 AI智能体 落地的团队而言,能否把同一套执行能力推进到这些界面,决定自动化能覆盖多少真实工序。
延续 1.6 万亿参数 MoE 与 100 万 token 上下文
模型的规格与 LongCat-2.0 保持一致:稀疏 MoE 架构,总参数约 1.6 万亿,每次推理激活约 480 亿参数,原生支持 100 万 token 上下文窗口。这一规格意味着它可以一次性读入大型代码库、运行日志或成套业务文档,长任务链中的历史记录不必反复裁剪。官方同时把最大输出长度设定为 128K token,便于在一次响应内给出成篇的结果,而不是拆成多轮拼接。
把图片理解并入基座模型
与上一代相比,最直接的变化是原生多模态能力。预览版在基座中并入图片理解,可解析图像内容,并支持跨模态问答、内容摘要与复杂视觉推理。落到实际操作上,界面截图、图表与设计稿都能作为任务输入,模型据此判断下一步应当点击哪里、填写什么内容,不必再依赖外部工具把画面转成文字描述。
面向终端与桌面软件执行长流程任务
官方给出的目标场景从代码与工具调用扩展到终端、浏览器、桌面软件、电子表格与设计工具。这类任务的共同点是步骤多、跨应用、中途需要依据界面反馈调整策略。模型在执行中持续读取当前状态并重排后续步骤,把规划、执行与检查放进一次会话内完成,减少人工在每个环节重新下达指令的次数。
同时兼容 OpenAI 与 Anthropic 接口协议
预览版已接入官方 API,并同时兼容 OpenAI 与 Anthropic 两套接口协议。官方给出了 Codex、OpenCode、OpenClaw 与 CatPaw 等环境的接入方法,现有智能体工具替换端点后即可调用。对已经在既有工具链上运行流程的团队,迁移成本主要落在参数调整上,而不需要重写调用代码。
LongCat-2.5-Preview 与同类大模型的对比
| 对比维度 | LongCat-2.5-Preview | Qwen 3.8-Max | Claude Opus 5.5 |
|---|---|---|---|
| 开发方 | 美团 LongCat 团队 | 阿里巴巴通义千问 | Anthropic |
| 参数与架构 | 约 1.6 万亿总参数 MoE,约 480 亿激活 | 2.4 万亿总参数 MoE,95B 激活 | 官方未公布 |
| 上下文窗口 | 100 万 token | 100 万 token | 100 万 token |
| 最大输出长度 | 128K token | 官方未公布 | 官方未公布 |
| 视觉理解 | 预览版本期新增图片理解,并原生并入基座 | 支持文本与图像输入,并增强视频理解 | 原生多模态,覆盖图像与文档 |
| 接口协议 | 同时兼容 OpenAI 与 Anthropic | 同时兼容 OpenAI 与 Anthropic | Anthropic 协议 |
| 长程任务方向 | 终端、浏览器、桌面软件、电子表格与设计工具 | 多智能体协作、动态工作流与长周期自主任务 | 长程编码智能体与知识工作 |
| 权重开放 | 预览版未公布开放计划 | Max 系列首次计划开放权重 | 未开放 |
| API 价格 | 按 token 套餐计费,并向老用户发放 500 万免费 tokens | 官方未公布具体单价 | 输入 4 美元、输出 20 美元每百万 tokens |
| 官方基准数据 | 预览版未公布 | PaperBench 93.0 分、SWE-bench Pro 67.7 分 | SWE-bench 等评测公开可查 |
上表 LongCat-2.5-Preview 一列取自其官方 API 开放平台的发布信息,Qwen 3.8-Max 一列取自其官方平台资料,Claude Opus 5.5 一列取自 Anthropic 官方定价页。三款模型的规格并不在同一维度上对齐:预览版与 Qwen 3.8-Max 都给出了总参数与激活参数,Claude Opus 5.5 未披露参数规模;视觉理解上,前两者以文本与图像输入为主,Claude Opus 5.5 的原生多模态覆盖图像与文档。接口协议是另一处直接差异,预览版与 Qwen 3.8-Max 同时兼容两套协议,Claude Opus 5.5 走自有协议。需控制成本的团队还应留意预览版未公布评测基准,切换前建议在自有任务集上验证。
如果想了解该团队上一代产品的能力基线,可参考 LongCat-2.0(美团 LongCat 团队于 2026 年 6 月发布的智能体大语言模型,采用与预览版同源的 1.6 万亿参数 MoE 架构与百万 token 上下文)。
LongCat-2.5-Preview 的应用场景与适用人群
该模型面向需要跨应用连续执行多步操作的任务,常见场景包括:
- 浏览器自动化:在网页中完成信息检索、表单填写与结果汇总等连续操作。
- 桌面与终端操作:在本地应用中执行文件整理、批量转换等长流程任务。
- 电子表格处理:在表格中完成数据清洗、公式补全与报表生成等重复工作。
- 设计工具协作:依据界面反馈调整版式与素材,替代逐步手动操作。
适用人群:需要把重复界面操作交给智能体执行的运营与产品团队,正在做长程任务模型选型的开发者,以及在自有算力或云上部署这类模型的企业信息化负责人。预览版未公布评测基准,现阶段更适合作为技术路线与接入方式的评估对象,生产切换建议先在自有任务集上验证。
LongCat-2.5-Preview 的使用方法
预览版提供网页端与 API 两条接入路径,接入流程如下:
- 获取调用凭据:登录 LongCat 官网 并进入 API 开放平台创建密钥。
- 选择接口协议:按现有工具链选用 OpenAI 或 Anthropic 兼容格式,两套协议对应同一个模型。
- 接入既有工具:在 Codex、OpenCode、OpenClaw 等环境中替换模型端点,沿用原有配置。
- 限定输出长度:把单次输出控制在 128K token 以内,长任务按阶段把中间结果写回上下文。
- 切换前实测:先固定一组自有任务对比结果与成本,确认稳定后再替换生产流程。
接入后建议记录两项数据:单个长流程任务的完成步数与人工介入次数。前者反映自主执行深度,后者反映实际节省人力。
LongCat-2.5-Preview 的价格与开源情况
LongCat-2.5-Preview 通过 LongCat API 开放平台按 token 套餐计费,官方为老用户发放 500 万免费 tokens 用于体验,原有套餐额度继续有效。
预览版目前以 API 与网页端方式提供服务,官方尚未公布权重开放计划。同一团队的 LongCat-2.0 已于 2026 年 7 月开放权重并提供国产算力平台的推理代码,本代是否延续该安排需以官方后续公告为准。对希望本地部署的团队,可先用 API 方式验证任务效果,再根据权重开放进度决定部署路径。
LongCat-2.5-Preview 的常见问题
LongCat-2.5-Preview 是什么?
它是美团 LongCat 团队于 2026 年 9 月推出的原生多模态长程智能体大模型,延续约 1.6 万亿参数的 MoE 架构与 100 万 token 上下文,本期新增图片理解,可面向终端、浏览器、桌面软件与电子表格执行长流程任务。
LongCat-2.5-Preview 相比 LongCat-2.0 有哪些变化?
变化集中在多模态与任务范围:预览版把图片理解原生并入基座,可解析图像内容并支持跨模态问答与视觉推理;目标场景从代码与工具调用扩展到终端、浏览器、桌面软件、电子表格与设计工具的长流程任务。参数规模与上下文窗口延续上一代规格。
LongCat-2.5-Preview 怎么收费?
该预览版通过 LongCat API 开放平台按 token 套餐计费,官方为老用户发放 500 万免费 tokens,原有套餐额度继续有效,权重开放计划尚未公布。
浙公网安备33010202004812号