模型列表
以下为当前可用的模型清单及各分组的支持情况。模型的可用性和渠道分布会动态调整,最新状态以控制台 → 模型广场,或 GET /v1/models 为准。
完整模型表
| 模型 | 家族 | 类型 | 上下文 | 支持分组 |
|---|---|---|---|---|
deepseek-v4-pro | DeepSeek | 推理+通用 | 128K | deepseek |
deepseek-v4-flash | DeepSeek | 快速通用 | 128K | deepseek |
claude-opus-4-8 | Anthropic Claude | 顶级通用 | 200K | Claude-Stable / Claude-ESpeed |
claude-opus-4-7 | Anthropic Claude | 顶级通用 | 200K | Claude-Stable / Claude-ESpeed |
claude-opus-4-6 | Anthropic Claude | 顶级通用 | 200K | Claude-Stable / Claude-ESpeed |
claude-sonnet-5 | Anthropic Claude | 高性价比(新一代) | 200K | Claude-Stable / Claude-ESpeed |
claude-sonnet-4-6 | Anthropic Claude | 高性价比 | 200K | Claude-Stable / Claude-ESpeed |
claude-fable-5 | Anthropic Claude | 旗舰 · 代码(Claude Code 专用) | 200K | claude-fable |
gpt-5.5 | OpenAI GPT | 顶级通用 | 400K | GPT |
qwen3.7-max | 阿里 Qwen | 顶级通用 | 以上游为准 | qwen |
qwen3.7-plus | 阿里 Qwen | 通用 | 以上游为准 | qwen |
glm-5.2 | 智谱 GLM | 通用 | 以上游为准 | GLM |
kimi-k2.7-code | 月之暗面 Kimi | 代码专用 | 以上游为准 | kimi |
kimi-k2.6 | 月之暗面 Kimi | 通用 | 以上游为准 | kimi |
上下文长度
Claude / GPT / DeepSeek 的上下文以上表为准;Qwen / GLM / Kimi 系为国内上游,上下文以实际上游为准,可在控制台或 GET /v1/models 查询。
claude-fable-5 为 Claude Code 专用旗舰
claude-fable-5 是 Claude 家族旗舰模型,走独立分组 claude-fable,只支持通过 Claude Code 客户端调用(依赖完整的 Claude Code 请求结构与 prompt 缓存)。用普通 OpenAI SDK / 裸 /v1/messages 极简请求会被上游拒绝。定价与 Claude 家族同档,具体倍率以控制台「模型广场 / 定价」为准。适合大型代码库、长任务 Agent——累进缓存下长会话越用越省。
分组 × 模型矩阵
| 模型 | deepseek | Claude-Stable | Claude-ESpeed | GPT | qwen | GLM | kimi |
|---|---|---|---|---|---|---|---|
deepseek-v4-flash | ✅ | — | — | — | — | — | — |
deepseek-v4-pro | ✅ | — | — | — | — | — | — |
claude-opus-4-6 | — | ✅ | ✅ | — | — | — | — |
claude-opus-4-7 | — | ✅ | ✅ | — | — | — | — |
claude-opus-4-8 | — | ✅ | ✅ | — | — | — | — |
claude-sonnet-5 | — | ✅ | ✅ | — | — | — | — |
claude-sonnet-4-6 | — | ✅ | ✅ | — | — | — | — |
gpt-5.5 | — | — | — | ✅ | — | — | — |
qwen3.7-max | — | — | — | — | ✅ | — | — |
qwen3.7-plus | — | — | — | — | ✅ | — | — |
glm-5.2 | — | — | — | — | — | ✅ | — |
kimi-k2.7-code | — | — | — | — | — | — | ✅ |
kimi-k2.6 | — | — | — | — | — | — | ✅ |
模型能力速览
DeepSeek
deepseek-v4-pro— 推理型,擅长代码、数学、复杂问题拆解;带 reasoning tokens(思考过程),完成质量高但 tokens 消耗大deepseek-v4-flash— 通用快速版,日常问答、简单代码;比 pro 便宜、更快
Claude
claude-opus-4-8— 目前最强 Claude,编程 / 长文档理解 / Agent 任务首选claude-opus-4-7— 略老版本,写作时仍可用(部分场景更擅长),价格与 4-8 相同claude-opus-4-6— 更老,兼容性备用claude-sonnet-5— 新一代 Sonnet,速度与质量平衡,日常 Agent / 编码的默认之选claude-sonnet-4-6— 上一代 Sonnet,性价比之选,简单任务或需要快速响应用它claude-fable-5— 🏴☠️ 旗舰,Claude Code 专用;累进 prompt 缓存命中极佳,大型代码库、长任务 Agent 的首选,长会话越用越省
GPT
gpt-5.5— OpenAI 最新旗舰,超长上下文 (400K),Codex CLI 默认
国内模型(Qwen / GLM / Kimi)
qwen3.7-max— 阿里通义千问旗舰,中文理解与通用能力强qwen3.7-plus— 千问通用档,成本更低glm-5.2— 智谱 GLM,中文与工具调用表现好kimi-k2.7-code— 月之暗面 Kimi,面向代码/Agent 场景优化kimi-k2.6— Kimi 通用档
国内模型走 OpenAI 协议
Qwen / GLM / Kimi 均通过 /v1/chat/completions(OpenAI 兼容协议)调用,换模型名即可,不需要额外适配。
客户端要填的模型名
必须一字不差,包括横杠和小数点:
✅ claude-opus-4-8
✅ claude-sonnet-5
✅ claude-sonnet-4-6
✅ deepseek-v4-flash
✅ gpt-5.5
✅ qwen3.7-max
✅ glm-5.2
✅ kimi-k2.7-code
❌ claude-opus-4.8 ← 用 - 不是 .
❌ Claude-Opus-4-8 ← 全小写
❌ deepseek/v4-flash ← 没有 /
❌ gpt-5-5 ← 版本号是 5.5,一个小数点
❌ qwen-3.7-max ← 是 qwen3.7-max,没有中间那个 -如果你不确定拼写,直接 curl -H "Authorization: Bearer $KEY" https://api.modexflow.cc/v1/models 拿到权威列表。
需要新模型?
不在这个表里但你需要的模型(比如 Gemini、Grok、其他开源模型),联系管理员讨论开通。开通需要:
- 该模型有稳定可用的上游供应商
- 定价模型能算清
- 有实际使用需求
更新记录
只列有分量的变更;模型/渠道的小幅调整以控制台为准。
| 日期 | 更新 |
|---|---|
| 2026-07-06 | 上线实时服务状态页与 SLA:核心分组目标可用率 ≥ 99.9%,每 5 分钟走客户同路径实测,可用率 / 延迟公开可查(状态页) |
| 2026-07-04 | fable 旗舰上线 claude-fable-5(Claude Code 专用,累进 prompt 缓存) |
| 2026-07-04 | 多模型扩容:新增 claude-sonnet-5、通义千问 qwen3.7-max/plus、智谱 glm-5.2、Kimi kimi-k2.7-code/k2.6(7 折) |
| 2026-07-03 | Claude 极速分组(ESpeed)默认优先带 prompt 缓存渠道,长会话省 30–70% input 费用 |
| 2026-07-02 | 新控制台 · 新接入域名:启用 modexflow.cc 控制台与 api.modexflow.cc(Anthropic 原生 + OpenAI 兼容双协议端点),老用户平滑迁移 |
| 2026-06 | 持续跟进各厂商模型新版本;prompt 缓存进一步优化 |
| 2026-05 | 稳定性升级:核心模型多渠道优先级 + 权重路由,自动故障切换 |
| 2026-04 | 渠道扩容:核心模型(Claude / GPT / DeepSeek)多上游冗余 |
| 2026-03 | 服务起步:统一网关对外提供 Claude / GPT / DeepSeek(OpenAI 兼容协议) |