01
一份订阅,多家模型。要么用 Token 网关(一把 key 代发各家主流模型),要么复用你已经付费的编码工具订阅 —— 大多数都暴露 OpenAI 兼容端点。
🦾 Fast
- deepseek-v4-flash
- gpt-5.6-luna (OpenCode Zen / Go)
- qwen3.6-flash
🧠 Smart
- gpt-5.6-sol (OpenCode Zen / Go)
- qwen3.8-max
- kimi-k3
可直接复用的订阅:OpenCode Zen(OpenAI 兼容端点)、GitHub Copilot(BYOK —— OpenAI + Anthropic)、Cursor(Pro / Pro+ / Ultra 套餐池)、OpenAI Codex(随 ChatGPT Plus / Pro / Business)。
Best for
零额外设置 —— 一个账单,不用新开账号。
02
Fast 档跑量化本地(q4-k-m / NVFP4 / MXFP4 / AWQ-int4 / 1–2 bit 三元)。64+ GB 显存/统一内存后,Smart 也能本地跑。显存 ≈ 参数 × 0.6(Q4_K_M)。
| Setup | Fast 🦾 | Smart 🧠 |
| ≤ 32 GB | LFM2.5-8B-A1B(8.5B)、granite-4.1-8b(8.8B)、Qwen3.6-27B(dense,q4 ≈ 14 GB)、gemma-4-26b-a4b-it(q4 ≈ 13 GB)、Qwen3.6-35B-A3B(MoE 36B/3B,q4 ≈ 18 GB)、Laguna-XS-2.1(MoE 33B/3B,q4 ≈ 17 GB)、Ternary-Bonsai-27B(1.58-bit ≈ 7 GB,笔记本/手机级) | 云端前沿模型 |
| 32–128 GB | Fable-Fusion-711-NEO-MAX-MTP GGUF(27B,2026-07,最佳后训练)、gemma-4-31B-it(q4 ≈ 16 GB)、Laguna-S-2.1(117.6B,q4 ≈ 59 GB —— 需 64 GB+) | Fable-Fusion-711 基础权重,或云端前沿 |
| ≥ 128 GB | Fable-Fusion-711-NEO-MAX-MTP GGUF(同款 —— 后训练质量胜过原始大小) | DeepSeek-V4-Flash(284 B MoE / 13 B active,UD-Q4_K_XL ≈ 155 GB —— 需 192 GB+ 统一内存;128 GB 级用 1–2 bit 三元) |
大小为量化值(生产环境,不是 fp16)。MoE 型号名里的 AxxB 是每 token 激活参数 —— 影响计算速度,不影响磁盘大小;GGUF/q4 存的是全部专家权重。Qwen3.6-27B 在 SWE-bench Verified 拿 77.2% —— 24 GB 单卡上最强的开源权重模型。约 256 GB 统一内存以下,本地 Smart 在性价比上很少打得过包月套餐;只有隐私或离线场景才值得。
Best for
成本敏感或离线场景;云端只能看到硬活那几轮。
03
一家 provider 两档 —— 最简配置。你已经在某家付费、不想换 key 时用这个。
| Setup | Fast 🦾 | Smart 🧠 |
| Anthropic | sonnet-5 | opus-5 / fable-5 |
| OpenAI | gpt-5.6-luna | gpt-5.6-sol |
| Google | gemini-3.5-flash-lite | gemini-3.6-flash |
| Qwen(阿里) | qwen3.7-plus | qwen3.8-max |
| DeepSeek | deepseek-v4-flash | deepseek-v4-pro |
| Z.AI(GLM) | glm-5 / glm-5-turbo | glm-5.2 |
| xAI(Grok) | grok-4.5-fast | grok-4.5 |
Best for
从零到路由最快 —— 只需两个模型 ID。
04
每档取各家最强。默认:Fast 走 deepseek-v4-flash,Smart 走 claude-opus-5。要加固再加 fallback。
| Setup | Fast 🦾 | Smart 🧠 |
| DeepSeek Harness(DSH) | deepseek-v4-flash | deepseek-v4-pro |
| 最低成本 | deepseek-v4-flash | claude-opus-5 |
| 多 provider 备份 | deepseek-v4-flash + glm-5.2 | claude-opus-5 + gpt-5.6-sol + kimi-k3 |
| 包月 | opencode-go/deepseek-v4-flash | opencode-go/glm-5.2 |
| 1 M 上下文、长仓库 | deepseek-v4-flash | gemini-3.6-pro / kimi-k3 |
| 多模态 | deepseek-v4-flash | claude-opus-5(视觉) / gemini-3.6-pro |
| 多语种 / 中文优先 | deepseek-v4-flash | qwen3.8-max |
| GDPR / 欧洲 | deepseek-v4-flash(经 OpenRouter) | mistral-medium-2604 |
价格与可用模型每月变一次 —— `curl -s https://models.dev/api.json | jq` 可看最新。完整 provider 目录在 models.dev。