LongCat-2.5-Preview – 美团推出的原生多模态长程智能体大模型

AI模型10分钟前更新 老高
3 0

LongCat-2.5-Preview是一款由美团 LongCat 团队于2026年9月推出的原生多模态长程智能体大模型,主要用于在终端、浏览器与桌面软件中连续执行多步任务,支持原生 100 万 token 上下文与图片理解,适用于需要长时间自主运行的智能体工作流。

基础信息内容
产品定位原生多模态长程智能体大模型
出品方美团 LongCat 团队
发布时间2026年9月25日
模型架构稀疏 MoE,总参数约 1.6 万亿,激活约 480 亿
上下文窗口100 万 token
最大输出长度128K token
输入模态原生文本与图片理解
接口兼容同时兼容 OpenAI 与 Anthropic 协议
调用渠道LongCat API 开放平台与网页端
生态接入Codex、OpenCode、OpenClaw、CatPaw
开放情况预览版未公布权重开放计划
LongCat-2.5-Preview – 美团推出的原生多模态长程智能体大模型

LongCat-2.5-Preview 的核心能力

LongCat-2.5-Preview 面向的是智能体从代码与工具调用走向界面操作的一段空档。此前的长程任务多集中在代码仓库与命令行内,浏览器、桌面软件与电子表格中的操作仍依赖人工逐步确认。对关注 AI智能体 落地的团队而言,能否把同一套执行能力推进到这些界面,决定自动化能覆盖多少真实工序。

延续 1.6 万亿参数 MoE 与 100 万 token 上下文

模型的规格与 LongCat-2.0 保持一致:稀疏 MoE 架构,总参数约 1.6 万亿,每次推理激活约 480 亿参数,原生支持 100 万 token 上下文窗口。这一规格意味着它可以一次性读入大型代码库、运行日志或成套业务文档,长任务链中的历史记录不必反复裁剪。官方同时把最大输出长度设定为 128K token,便于在一次响应内给出成篇的结果,而不是拆成多轮拼接。

把图片理解并入基座模型

与上一代相比,最直接的变化是原生多模态能力。预览版在基座中并入图片理解,可解析图像内容,并支持跨模态问答、内容摘要与复杂视觉推理。落到实际操作上,界面截图、图表与设计稿都能作为任务输入,模型据此判断下一步应当点击哪里、填写什么内容,不必再依赖外部工具把画面转成文字描述。

面向终端与桌面软件执行长流程任务

官方给出的目标场景从代码与工具调用扩展到终端、浏览器、桌面软件、电子表格与设计工具。这类任务的共同点是步骤多、跨应用、中途需要依据界面反馈调整策略。模型在执行中持续读取当前状态并重排后续步骤,把规划、执行与检查放进一次会话内完成,减少人工在每个环节重新下达指令的次数。

同时兼容 OpenAI 与 Anthropic 接口协议

预览版已接入官方 API,并同时兼容 OpenAI 与 Anthropic 两套接口协议。官方给出了 Codex、OpenCode、OpenClaw 与 CatPaw 等环境的接入方法,现有智能体工具替换端点后即可调用。对已经在既有工具链上运行流程的团队,迁移成本主要落在参数调整上,而不需要重写调用代码。

LongCat-2.5-Preview 与同类大模型的对比

对比维度LongCat-2.5-PreviewQwen 3.8-MaxClaude Opus 5.5
开发方美团 LongCat 团队阿里巴巴通义千问Anthropic
参数与架构约 1.6 万亿总参数 MoE,约 480 亿激活2.4 万亿总参数 MoE,95B 激活官方未公布
上下文窗口100 万 token100 万 token100 万 token
最大输出长度128K token官方未公布官方未公布
视觉理解预览版本期新增图片理解,并原生并入基座支持文本与图像输入,并增强视频理解原生多模态,覆盖图像与文档
接口协议同时兼容 OpenAI 与 Anthropic同时兼容 OpenAI 与 AnthropicAnthropic 协议
长程任务方向终端、浏览器、桌面软件、电子表格与设计工具多智能体协作、动态工作流与长周期自主任务长程编码智能体与知识工作
权重开放预览版未公布开放计划Max 系列首次计划开放权重未开放
API 价格按 token 套餐计费,并向老用户发放 500 万免费 tokens官方未公布具体单价输入 4 美元、输出 20 美元每百万 tokens
官方基准数据预览版未公布PaperBench 93.0 分、SWE-bench Pro 67.7 分SWE-bench 等评测公开可查

上表 LongCat-2.5-Preview 一列取自其官方 API 开放平台的发布信息,Qwen 3.8-Max 一列取自其官方平台资料,Claude Opus 5.5 一列取自 Anthropic 官方定价页。三款模型的规格并不在同一维度上对齐:预览版与 Qwen 3.8-Max 都给出了总参数与激活参数,Claude Opus 5.5 未披露参数规模;视觉理解上,前两者以文本与图像输入为主,Claude Opus 5.5 的原生多模态覆盖图像与文档。接口协议是另一处直接差异,预览版与 Qwen 3.8-Max 同时兼容两套协议,Claude Opus 5.5 走自有协议。需控制成本的团队还应留意预览版未公布评测基准,切换前建议在自有任务集上验证。

如果想了解该团队上一代产品的能力基线,可参考 LongCat-2.0(美团 LongCat 团队于 2026 年 6 月发布的智能体大语言模型,采用与预览版同源的 1.6 万亿参数 MoE 架构与百万 token 上下文)。

LongCat-2.5-Preview 的应用场景与适用人群

该模型面向需要跨应用连续执行多步操作的任务,常见场景包括:

  • 浏览器自动化:在网页中完成信息检索、表单填写与结果汇总等连续操作。
  • 桌面与终端操作:在本地应用中执行文件整理、批量转换等长流程任务。
  • 电子表格处理:在表格中完成数据清洗、公式补全与报表生成等重复工作。
  • 设计工具协作:依据界面反馈调整版式与素材,替代逐步手动操作。

适用人群:需要把重复界面操作交给智能体执行的运营与产品团队,正在做长程任务模型选型的开发者,以及在自有算力或云上部署这类模型的企业信息化负责人。预览版未公布评测基准,现阶段更适合作为技术路线与接入方式的评估对象,生产切换建议先在自有任务集上验证。

LongCat-2.5-Preview 的使用方法

预览版提供网页端与 API 两条接入路径,接入流程如下:

  1. 获取调用凭据:登录 LongCat 官网 并进入 API 开放平台创建密钥。
  2. 选择接口协议:按现有工具链选用 OpenAI 或 Anthropic 兼容格式,两套协议对应同一个模型。
  3. 接入既有工具:在 Codex、OpenCode、OpenClaw 等环境中替换模型端点,沿用原有配置。
  4. 限定输出长度:把单次输出控制在 128K token 以内,长任务按阶段把中间结果写回上下文。
  5. 切换前实测:先固定一组自有任务对比结果与成本,确认稳定后再替换生产流程。

接入后建议记录两项数据:单个长流程任务的完成步数与人工介入次数。前者反映自主执行深度,后者反映实际节省人力。

LongCat-2.5-Preview 的价格与开源情况

LongCat-2.5-Preview 通过 LongCat API 开放平台按 token 套餐计费,官方为老用户发放 500 万免费 tokens 用于体验,原有套餐额度继续有效。

预览版目前以 API 与网页端方式提供服务,官方尚未公布权重开放计划。同一团队的 LongCat-2.0 已于 2026 年 7 月开放权重并提供国产算力平台的推理代码,本代是否延续该安排需以官方后续公告为准。对希望本地部署的团队,可先用 API 方式验证任务效果,再根据权重开放进度决定部署路径。

LongCat-2.5-Preview 的常见问题

LongCat-2.5-Preview 是什么?

它是美团 LongCat 团队于 2026 年 9 月推出的原生多模态长程智能体大模型,延续约 1.6 万亿参数的 MoE 架构与 100 万 token 上下文,本期新增图片理解,可面向终端、浏览器、桌面软件与电子表格执行长流程任务。

LongCat-2.5-Preview 相比 LongCat-2.0 有哪些变化?

变化集中在多模态与任务范围:预览版把图片理解原生并入基座,可解析图像内容并支持跨模态问答与视觉推理;目标场景从代码与工具调用扩展到终端、浏览器、桌面软件、电子表格与设计工具的长流程任务。参数规模与上下文窗口延续上一代规格。

LongCat-2.5-Preview 怎么收费?

该预览版通过 LongCat API 开放平台按 token 套餐计费,官方为老用户发放 500 万免费 tokens,原有套餐额度继续有效,权重开放计划尚未公布。

© 版权声明

相关文章