模型选择

选出你的模型配对

两条经验在 pi 和 DeepSeek Harness 上都适用:Fast 档 —— 选智价比最好的模型:每块钱买到最强的智能,因为这一档还兼任 Judge(默认首选 deepseek-v4-flash —— 0731 版质量逼近 Opus 5 / GLM-5.2,价格却在表格低端)。Smart 档 —— 留在云端前沿模型。80 GB 以下本地 Smart 不实用,96 GB 仍通常打不过包月套餐。

01

编码订阅套餐

一份订阅,多家模型。要么用 Token 网关(一把 key 代发各家主流模型),要么复用你已经付费的编码工具订阅 —— 大多数都暴露 OpenAI 兼容端点。

Fast
  • deepseek-v4-flash
  • gpt-5.6-luna (OpenCode Zen / Go)
  • qwen3.6-flash
Smart
  • gpt-5.6-sol (OpenCode Zen / Go)
  • qwen3.8-max
  • kimi-k3

可直接复用的订阅:OpenCode Zen(OpenAI 兼容端点)、GitHub Copilot(BYOK —— OpenAI + Anthropic)、Cursor(Pro / Pro+ / Ultra 套餐池)、OpenAI Codex(随 ChatGPT Plus / Pro / Business)。

Best for

零额外设置 —— 一个账单,不用新开账号。

02

本地模型按内存选

Fast 档跑量化本地(q4-k-m / NVFP4 / MXFP4 / AWQ-int4 / 1–2 bit 三元)。64+ GB 显存/统一内存后,Smart 也能本地跑。显存 ≈ 参数 × 0.6(Q4_K_M)。

Setup Fast 🦾 Smart 🧠
≤ 32 GB LFM2.5-8B-A1B(8.5B)、granite-4.1-8b(8.8B)、Qwen3.6-27B(dense,q4 ≈ 14 GB)、gemma-4-26b-a4b-it(q4 ≈ 13 GB)、Qwen3.6-35B-A3B(MoE 36B/3B,q4 ≈ 18 GB)、Laguna-XS-2.1(MoE 33B/3B,q4 ≈ 17 GB)、Ternary-Bonsai-27B(1.58-bit ≈ 7 GB,笔记本/手机级) 云端前沿模型
32–128 GB Fable-Fusion-711-NEO-MAX-MTP GGUF(27B,2026-07,最佳后训练)、gemma-4-31B-it(q4 ≈ 16 GB)、Laguna-S-2.1(117.6B,q4 ≈ 59 GB —— 需 64 GB+) Fable-Fusion-711 基础权重,或云端前沿
≥ 128 GB Fable-Fusion-711-NEO-MAX-MTP GGUF(同款 —— 后训练质量胜过原始大小) DeepSeek-V4-Flash(284 B MoE / 13 B active,UD-Q4_K_XL ≈ 155 GB —— 需 192 GB+ 统一内存;128 GB 级用 1–2 bit 三元)

大小为量化值(生产环境,不是 fp16)。MoE 型号名里的 AxxB 是每 token 激活参数 —— 影响计算速度,不影响磁盘大小;GGUF/q4 存的是全部专家权重。Qwen3.6-27B 在 SWE-bench Verified 拿 77.2% —— 24 GB 单卡上最强的开源权重模型。约 256 GB 统一内存以下,本地 Smart 在性价比上很少打得过包月套餐;只有隐私或离线场景才值得。

Best for

成本敏感或离线场景;云端只能看到硬活那几轮。

03

同 Provider 分层

一家 provider 两档 —— 最简配置。你已经在某家付费、不想换 key 时用这个。

Setup Fast 🦾 Smart 🧠
Anthropic sonnet-5 opus-5 / fable-5
OpenAI gpt-5.6-luna gpt-5.6-sol
Google gemini-3.5-flash-lite gemini-3.6-flash
Qwen(阿里) qwen3.7-plus qwen3.8-max
DeepSeek deepseek-v4-flash deepseek-v4-pro
Z.AI(GLM) glm-5 / glm-5-turbo glm-5.2
xAI(Grok) grok-4.5-fast grok-4.5
Best for

从零到路由最快 —— 只需两个模型 ID。

04

跨 Provider 混合

每档取各家最强。默认:Fast 走 deepseek-v4-flash,Smart 走 claude-opus-5。要加固再加 fallback。

Setup Fast 🦾 Smart 🧠
DeepSeek Harness(DSH) deepseek-v4-flash deepseek-v4-pro
最低成本 deepseek-v4-flash claude-opus-5
多 provider 备份 deepseek-v4-flash + glm-5.2 claude-opus-5 + gpt-5.6-sol + kimi-k3
包月 opencode-go/deepseek-v4-flash opencode-go/glm-5.2
1 M 上下文、长仓库 deepseek-v4-flash gemini-3.6-pro / kimi-k3
多模态 deepseek-v4-flash claude-opus-5(视觉) / gemini-3.6-pro
多语种 / 中文优先 deepseek-v4-flash qwen3.8-max
GDPR / 欧洲 deepseek-v4-flash(经 OpenRouter) mistral-medium-2604
Best for

每档选最强,不管谁卖。

价格与可用模型每月变一次 —— `curl -s https://models.dev/api.json | jq` 可看最新。完整 provider 目录在 models.dev。