Longcat-2.5-preview – 美团推出的新一代大模型

AI项目 2026-09-27

Longcat-2.5-preview是什么

LongCat-2.5-Preview 是美团推出的新一代大模型,延续 LongCat-2.0 的 1.6T 总参数、约 48B 激活参数和 1M token 上下文,新增原生多模态能力,可面向终端、浏览器、桌面软件等场景执行长流程任务。LongCat-2.5-Preview 已接入官方 API,兼容 OpenAI 和 Anthropic 接口,最大输出 128K tokens,支持 Codex、OpenClaw 等主流 Agent 工具直接调用。

Longcat-2.5-preview

Longcat-2.5-preview的主要功能

  • 多模态理解:新增图片理解能力,可解析图像内容,支持跨模态问答、内容摘要与复杂视觉推理。
  • 长程 Agent 任务:面向终端、浏览器、GUI、电子表格、设计工具等场景执行长流程自主操作。
  • Coding 能力:在代码生成、代码理解与自动化编程任务上表现突出,延续 LongCat-2.0 的 Agentic Coding 定位。
  • 开发环境深度适配:与 Claude Code、Hermes、OpenClaw、OpenCode、Kilo Code 等主流工具高效协同。
  • 双接口开放:API 同时兼容 OpenAI 和 Anthropic 格式,最大输出 128K tokens,现有 Agent 工具可直接接入。

Longcat-2.5-preview的技术原理

  • MoE 稀疏激活架构:延续混合专家路线,总参数 1.6 万亿但每次推理仅激活约 480 亿参数,通过动态路由只调用与当前任务最相关的专家子集,在保证模型容量的同时控制计算成本。
  • 原生多模态并入基座:与 2.0 时代将图像、视频拆分为独立开源仓库不同,2.5 把多模态能力直接融入基座本体,使视觉信息与文本在同一模型内联合建模——这条路线承袭自 LongCat-Next 验证的 DiNA(离散原生自回归)范式,即把模态词法化为离散 token 统一建模。
  • 超长上下文支持:原生 1M token 上下文窗口,可单次容纳超长文档、整个代码库、系统日志与多轮复杂任务,为长程 Agent 的多步骤执行提供记忆基础;这也是在国产算力集群上同时支撑超大参数与百万级上下文的系统工程成果。
  • Agentic 训练定位:模型从设计之初针对 Agent 场景训练,原生支持工具调用与多步推理,并通过 dlp 投机解码等推理加速技术降低长链路任务延迟。

如何使用Longcat-2.5-preview

方式一:API 调用
  • 注册账号:打开 https://longcat.ai/platform/ 注册并登录美团 LongCat 开放平台。
  • 获取 Key:在控制台创建 API Key。
  • 安装 SDK:使用现有的 OpenAI 或 Anthropic 官方 SDK,无需额外安装新客户端。
  • 修改配置:将 base_url 改为 https://api.longcat.ai/openai(OpenAI 格式)或 https://api.longcat.ai/anthropic(Anthropic 格式),填入 Key。
  • 指定模型:模型 ID 填 LongCat-2.5-Preview,按 OpenAI chat.completions 或 Anthropic messages 标准格式发送请求即可。
方式二:接入 Agent 工具(以 Claude Code 为例)
  • 在环境变量中设置 ANTHROPIC_BASE_URL=https://api.longcat.ai/anthropic 和 ANTHROPIC_AUTH_TOKEN=你的Key。
  • 把 ANTHROPIC_MODEL 设为 LongCat-2.5-Preview。
  • 启动 Claude Code 后即可直接调用该模型执行编码任务;OpenClaw、OpenCode、Codex 等工具同理,改 base_url 和模型名即可。
方式三:网页直接体验
  • 访问 LongCat 官网登录后选择 LongCat-2.5-Preview 模型,可在网页端进行对话、传图和简单 Agent 任务体验。

Longcat-2.5-preview的核心优势

  • 超大稀疏模型 + 低成本推理:1.6T 总参数仅激活约 48B,兼顾顶级模型能力与可控的推理成本。
  • 百万级原生上下文:1M token 窗口可一次性吞下整个代码库、长文档或完整日志,为长程任务提供记忆基础。
  • 原生多模态进基座:图片理解与文本在同一模型内联合建模,且不再拆分为独立仓库,交互体验更统一。
  • 长流程 GUI Agent 能力:从代码任务扩展到终端、浏览器、电子表格、设计工具的真实软件操作,覆盖完整工作流场景。
  • 双协议零迁移接入:同时兼容 OpenAI 和 Anthropic 接口,现有 Agent 工具改个 base_url 可直接调用。

Longcat-2.5-preview的同类竞品对比

对比维度 LongCat-2.5-Preview Claude Opus 5.5
上下文窗口 1M tokens 1M tokens
最大输出 128K tokens 128K tokens
多模态 原生多模态并入基座,新增图片理解 原生多模态(图像/文档成熟,生态久经打磨)
GUI Agent 能力 刚起步,主打浏览器/桌面/表格操作,无公开 benchmark Claude Computer Use 已商用迭代多代,有大量实测数据
接口兼容 同时兼容 OpenAI + Anthropic 双协议 仅 Anthropic 协议
API 价格 按 token 套餐计费,赠送 500 万免费 tokens(性价比高) $4 / $20 每百万 tokens(约 ¥29 / ¥143),价格处于旗舰档高位
生态接入 官方教程覆盖 Codex / OpenClaw / Claude Code / OpenCode 等 Claude Code、Cowork 等官方工具链深度绑定,企业生态成熟
数据透明度 无官方 benchmark SWE-bench 等评测公开可查,第三方生态丰富

Longcat-2.5-preview的应用场景

  • 全代码库级编程助手:用 1M 上下文一次性加载整个仓库,完成跨文件重构、缺陷定位和大型 PR 生成,通过 Claude Code / OpenCode 直接驱动。
  • 跨软件长流程办公自动化:让模型操作浏览器 + 电子表格 + 桌面软件,完成”抓取网页数据 → 清洗 → 填入 Excel → 生成报告”这类多步骤无人值守任务。
  • 企业级日志与文档分析:将百万 token 级的系统日志、合同档案或论文语料整体投喂,做一次性深度问答、摘要和异常挖掘,避免 RAG 切片造成的上下文断裂。
  • GUI 界面测试与运维:自动操作终端和桌面软件,执行批量配置、界面回归测试、老旧系统的自动化录入等人工密集型操作。
  • 多模态内容生产辅助:结合新增的图片理解能力,做截图转代码、设计稿还原(对接设计工具)、图文混合资料的结构化整理与再创作。
©️版权声明:若无特殊声明,本站所有文章版权均归AI工具集原创和所有,未经许可,任何个人、媒体、网站、团体不得转载、抄袭或以其他方式复制发表本站内容,或在非我站所属的服务器上建立镜像。否则,我站将依法保留追究相关法律责任的权利。

相关文章