MiniMax/MiniMax-M2.5
MiniMax
智能体世界的SOTA,专为智能体2.0设计,将编码扩展到现实世界包括工作空间、娱乐和个人助理。模型亮点:全球SOTA开源编码与智能体模型;SWE-bench Pro和SWE-bench Verified得分高于Opus 4.6;在Excel、搜索与研究以及文档摘要方面的全球SOTA;未来工作空间的完美主力模型;闪电般快速:优化思维效率,100+ TPS,实现比 Opus 快 3 倍的速度;极致性价比,以支持始终在线的智能体。
Browse the available models, public catalog prices, and capabilities for this site.
MiniMax
智能体世界的SOTA,专为智能体2.0设计,将编码扩展到现实世界包括工作空间、娱乐和个人助理。模型亮点:全球SOTA开源编码与智能体模型;SWE-bench Pro和SWE-bench Verified得分高于Opus 4.6;在Excel、搜索与研究以及文档摘要方面的全球SOTA;未来工作空间的完美主力模型;闪电般快速:优化思维效率,100+ TPS,实现比 Opus 快 3 倍的速度;极致性价比,以支持始终在线的智能体。
DeepSeek
旗舰级 MoE 大模型,总参1.6T、激活 49B,原生支持百万级超长上下文。依托海量高质量训练数据,具备顶尖数学逻辑、复杂推理、专业代码与长文本深度解析能力,适配高阶科研、复杂办公、深度智能代理等高难度场景。
Qwen
Qwen3.5原生视觉语言系列Flash模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步;响应速度快,兼具推理速度和性能。
Applies when: Context length <= 128K
Kimi
Kimi K3 是 Kimi 迄今能力最强的旗舰模型,拥有 2.8 万亿参数,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。
Kimi
K2.7 Code高速版与普通版是同一个模型,但输出速度约为普通版的 5-6 倍,常规编程场景下(取输入长度中位数)输出速度约 180 Token/s,短上下文场景可达 260 Token/s ,带来更极致的编程体验。
Kimi
Kimi K2.7 Code 是月之暗面 Kimi发布并开源的新一代编程专用模型,定位为 Kimi 迄今最智能的 Coding 模型。Kimi K2.7 Code 是一个以编码为中心的智能体模型(coding-focused agentic model),专为长程软件工程任务优化。它擅长跨多文件重构、功能实现、长会话调试等需要可靠指令遵循和端到端完成率的复杂工作流。
MiniMax
MiniMax M3 凭借业界领先的 Coding 与 Agentic 能力、1M 超长上下文窗口以及原生多模态特性,可出色胜任企业级长文档理解、高质量内容生成、代码编写、Bug 修复及原生应用构建等任务;强大的 Agentic 能力端到端贯通工作流,原生多模态更带来流畅自然的图文混合交互体验。
MiniMax
M2.1 的设计初衷在于打破“最顶级的 Agent 能力仅存在于闭源模型”的壁垒。我们在模型层面进行了针对性优化,显著提升了模型在代码生成、工具调用、复杂指令遵循及长程规划任务中的性能。从自动化进行多语言的软件开发,到执行多步骤的复杂办公工作流,MiniMax-M2.1 均表现出卓越的稳定性。我们致力于为开发者提供一个完全透明、可控且高可用的基础模型,以构建下一代自主智能体应用。
DeepSeek
Qwen
2.4万亿参数MoE旗舰,编程与办公能力全面跃升,可自主编程十数天交付完整项目。胜任法律、金融、设计等数百种专业任务,一次对话端到端交付生产级成果。原生视觉理解贯穿规划、执行与验证全流程,支持超长文档与长视频的深度语义解析。长程任务中自主规划与闭环迭代,持续进化。
DeepSeek
高效轻量化MoE模型,总参284B,激活13B,原生支持百万超长上下文能力。推理速度快、延迟低、调用成本低廉,综合能力均衡,主打高并发、轻量化任务,适合日常对话、内容创作、基础 RAG、批量文案处理等普惠刚需场景。
Qwen
Qwen3.7系列中高性价比Plus模型,在强大文本能力的基础上全面升级了视觉-语言能力,同时保持了在编码、工具使用和生产力工作流方面的完整智能体能力。其核心特色为多模态交互混合智能体能力,能够感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用。
Applies when: Context length <= 256K
Qwen
Qwen3.7系列中规模最大、综合能力最强的Max模型,当前开放纯文本模型能力供体验。Qwen3.7是面向智能体时代的新一代旗舰模型,核心优势在于智能体能力的广度与深度:在编程、办公与生产力、长周期自主执行方面均能出色胜任各项任务。
Qwen
Qwen3.6原生视觉语言系列Plus模型,展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果相较3.5系列显著提升。模型在Agentic coding、前端编程、Vibe coding等代码能力、多模态万物识别、OCR、物体定位等能力上显著增强。
Applies when: Context length <= 256K
Qwen
Qwen3.6原生视觉语言系列Flash模型,模型效果相较3.5-Flash显著提升。本模型重点提升agentic coding能力(在多项代码智能体基准上大幅超越前代)、数学推理和代码推理能力;视觉方面在空间智能能力上显著增强,物体定位与目标检测提升尤为突出。
Applies when: Context length <= 256K
GLM
GLM-5.2-Fast-Preview 是智谱 AI 旗舰模型 GLM-5.2 的高速版本,支持 1M 超长上下文,模型能力对齐 GLM-5.2 标准版,具备逻辑推理、长文本理解与代码生成能力。通过推理加速优化,输出 TPS 可达 GLM-5.2 标准版的 1.5~2 倍,显著提升输出速度,适用于实时对话、Agent 多轮调用、流式代码生成等对输出速度敏感的场景。
GLM
智谱最新旗舰,具备更强的编程能力与更稳定的多步骤推理/执行能力。总参数355B,支持长程任务规划、编码、工具协同,问答自然、写作沉浸、创意角色扮演能力强。
Applies when: Context length <= 32K
Qwen
Qwen3.6系列中规模最大、综合能力最强的Max模型Preview版本,当前开放纯文本模型能力供体验。相较于此前发布的Qwen3-Max和Qwen3.6-Plus,本模型在vibe coding能力上进一步提升、coding agent执行更加高效、前端编程开发能力显著提升;长尾知识能力进一步升级。
Applies when: Context length <= 128K
Qwen
Qwen3.5原生视觉语言系列Plus模型,基于混合架构设计,融合了线性注意力机制与稀疏混合专家模型,实现了更高的推理效率。在多项任务评测中,3.5系列均展现出与当前顶尖前沿模型相媲美的卓越性能,模型效果在纯文本与多模态方面相较3系列均实现飞跃式进步
Applies when: Context length <= 128K
GLM
GLM-5.1 是面向智能体工程的下一代旗舰模型,采用混合专家(MoE)架构,拥有 754B 参数。该模型编程能力显著增强,在 SWE-Bench Pro 上取得了领先水平,在 NL2Repo(仓库生成)和 Terminal-Bench 2.0(真实终端任务)等基准上大幅领先前代。GLM-5.1 专为长周期智能体任务设计,能够以更好的判断力处理模糊问题,拆解复杂任务、执行实验、分析结果,并在数百轮迭代和数千次工具调用中持续优化。
Applies when: Context length <= 32K
Kimi
Kimi K2.5 是 Kimi 在2026年最新推出的智能模型,在 Agent、代码、视觉理解及一系列通用智能任务上取得开源 SoTA 表现。同时 Kimi K2.5 也是 Kimi 迄今最全能的模型,原生的多模态架构设计,同时支持视觉与文本输入、思考与非思考模式、对话与 Agent 任务。
MiniMax
M2.7 能够自行构建复杂 Agent Harness,并基于 Agent Teams、复杂 Skills、Tool Search tool 等能力,完成高度复杂的生产力任务。
Xiaomi
MiMo-V2.5-Pro 是小米发布的最新旗舰模型。与前代模型相比,它在通用智能体能力、复杂软件工程以及长程任务等方面都有显著提升,在 ClawEval、GDPVal 和 SWE-bench Pro 等基准测试中均位列前茅。它能够独立且完全自主地完成需要人类专家耗时数天甚至数周的专业任务,涉及上千次工具调用。其高达 100 万 token 的上下文长度,非常适合集成到各种智能体框架中使用。
Applies when: Context length <= 256K
GLM
GLM新一代旗舰模型,核心能力较4.5全面提升。总参数量为3550 亿,激活参数320亿,上下文窗口扩展至200K。
Applies when: Context length <= 32K
Qwen
Qwen3.7原生视觉语言系列Flash模型,相较3.6-Flash全面提升多模态理解与Agent执行能力。重点强化多模态基础能力、万物识别能力更强,真实世界感知与空间智能进一步提升,Search Agent、CI Agent等多模态Agent场景能力显著升级、端到端任务执行更稳定,多模态Coding能力优化、vibe coding 体验更加流畅。
Applies when: Context length <= 32K
GLM
GLM-5是面向Coding与Agent场景的新一代大模型,在复杂系统工程与长程任务中达到开源 SOTA,真实编程体验逼近 Claude Opus 级别;基于 744B 新基座、异步强化学习与稀疏注意力,实现从“写代码”到“写工程”的全面升级。
Applies when: Context length <= 32K
GLM
GLM-5.2 是 Z.ai 最新的旗舰模型,面向长程任务场景,相比 GLM-5.1 在长程任务能力上有显著提升。该 753B 模型支持稳定的 1M-token 上下文,具备更强的编程能力,并支持多种 thinking effort levels,以在性能和延迟之间进行灵活平衡。GLM-5.2 引入 IndexShare 架构优化,在 1M 上下文长度下将 per-token FLOPs 降低 2.9 倍,同时改进 MTP layer 以支持 speculative decoding,使 acceptance length 最高提升 20%。
Kimi
Kimi K2.6 是 Kimi 最新最智能的模型,Kimi K2.6 的通用 Agent、代码、视觉理解等综合能力得到全面提升,其中在博士级难度的完整版人类最后的考试(Humanity’s Last Exam)、在考察模型真实软件工程能力的 SWE-Bench Pro、评估 Agent 深度检索能力的 DeepSearchQA 等基准测试中均取得行业领先的成绩,同时支持文本、图片与视频输入,思考与非思考模式,对话与 Agent 任务。
Anthropic
Gemini
Sharpest Gemini Pro for hardest reasoning, long-document analysis, and cautious deep work
Gemini
Stable Gemini Flash for agentic coding, tool-heavy flows, and everyday production work
Gemini
Top-tier Gemini for advanced reasoning, multimodal understanding, and million-token context
OpenAI
Balanced GPT-5.6 model for capable, cost-efficient everyday work
Applies when: Context length <= 272K
Anthropic
Strongest Claude Opus model for coding, agents, and professional work
Anthropic
Claude workhorse for coding agents, careful analysis, and production cost control
Anthropic
Top Claude Opus tier for the hardest reasoning, coding, and long-horizon agents
Anthropic
Claude model for creative writing, analysis, and controlled agent workflows
OpenAI
Agent-ready GPT for coding and computer-use workflows at a lower cost
Applies when: Context length <= 272K
OpenAI
Cost-efficient GPT-5.6 model for fast, high-volume workloads
Applies when: Context length <= 272K
Gemini
Speedy Gemini for high-frequency tasks, fast multimodal input, and cost-sensitive workloads
Gemini
Efficient Gemini Flash for long-horizon engineering, token-saving agents, and scaled automation
Anthropic
Everyday Claude agent model for coding, planning, browsing, and general work
Anthropic
Stronger Opus tier for advanced software work and high-stakes reasoning
Anthropic
Fast Claude lane for lightweight agents, office tasks, and responsive chat
OpenAI
Default frontier GPT for coding, computer use, research, and knowledge work
Applies when: Context length <= 272K
OpenAI
Frontier GPT-5.6 model for complex professional work, coding, and agentic workflows
Applies when: Context length <= 272K
Catalog prices are for reference. Confirm the current rules and metering in the console before calling a model. Dynamic pricing models provide their full details in the console.