双协议端点,一把 Key
同一个 sk-*** 同时提供 api.modexflow.cc(Anthropic 原生,Claude Code 直连)与 api.modexflow.cc/v1(OpenAI 兼容)两套端点,切换模型只需换模型名,客户端零改造。
同一个 sk-*** 同时提供 api.modexflow.cc(Anthropic 原生,Claude Code 直连)与 api.modexflow.cc/v1(OpenAI 兼容)两套端点,切换模型只需换模型名,客户端零改造。
Claude 家族旗舰 claude-fable-5(Claude Code 专用),累进 prompt 缓存教科书级命中,大型代码库与长会话 Agent 越用越省。
每 2 小时走客户同一条调用路径实测,各模型可用率 / 延迟 / 运行记录实时公开在服务状态页。核心分组目标可用率 ≥ 99.9%。
香港节点直出,核心模型端到端小响应实测约 1-2 秒、首字节更短。多渠道自动负载与故障切换,单点上游抖动不影响业务。
每次调用留存 usage 与扣费明细,分组价格可查。Claude / GPT 系 4 折,国内模型(Qwen / GLM / Kimi)7 折,实际用量与账单可完全对齐。
官方 CLI(Claude Code / Codex / Gemini CLI)、桌面客户端(Cherry Studio / CC Switch)、IDE 插件(Cline)、以及原生 SDK 全部一键接入。
SSE 流式响应原生支持,Claude Sonnet 支持 prompt 缓存的极速分组,长上下文(含 Codex 长时任务)读写超时 30 分钟。
Cloudflare 边缘 + Full (Strict) TLS,源站 IP 对公网无 SNI 兜底,令牌可绑定 IP 白名单、限模型、限额度,每次调用带 request id 便于问题排查。
Client SDK / CLI
│
│ Authorization: Bearer sk-***
▼
┌──────────────────────────────────┐
│ https://api.modexflow.cc/v1/* │ ← OpenAI-Compatible
│ https://api.modexflow.cc/ │ ← 原生 Anthropic / Gemini 路径
└─────────┬────────────────────────┘
│ token → 分组 → 渠道池(按优先级 + 权重路由)
▼
┌────────────┬─────────────┬────────────┬────────────┐
│ DeepSeek │ Claude 系 │ Codex 系 │ Gemini 系 │
└────────────┴─────────────┴────────────┴────────────┘| 用途 | URL |
|---|---|
| 调 API | https://api.modexflow.cc/v1/chat/completions |
| 列模型 | https://api.modexflow.cc/v1/models |
| 控制台 | https://www.modexflow.cc/ |
| 服务状态 | https://docs.modexflow.cc/status/(实时可用率 / 延迟) |
| 状态 JSON | https://www.modexflow.cc/api/status |
export ANTHROPIC_BASE_URL="https://api.modexflow.cc"
export ANTHROPIC_API_KEY="sk-你的-token"
claudeexport OPENAI_BASE_URL="https://api.modexflow.cc/v1"
export OPENAI_API_KEY="sk-你的-token"
codexcurl https://api.modexflow.cc/v1/chat/completions \
-H "Authorization: Bearer sk-你的-token" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash",
"messages": [{"role": "user", "content": "hello"}]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.modexflow.cc/v1",
api_key="sk-你的-token",
)
r = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[{"role": "user", "content": "hello"}],
)
print(r.choices[0].message.content)