12 个主流 AI 模型同台对比 — 每 1M tokens 价格、延迟、上下文窗口与 MMLU 质量。勾选你关心的模型,按任意列排序,将表格导出为 Markdown 或 CSV,或让推荐引擎根据你的任务与预算挑选最佳模型。
勾选要对比的模型 — 下方表格实时更新。
点击任意列标题排序 — 最便宜优先、最快优先、上下文最大或 MMLU 最高。输入/输出价格为每 1M tokens 美元价;TTFT 为 p50 首 token 时间。
| 模型 | 输入 $/1M | 输出 $/1M | 上下文 | p50 TTFT | MMLU | 适合场景 |
|---|
方法论:各提供商公布的价格(2026 年 8 月),p50 首 token 时间来自生产环境采样,MMLU 为 5-shot 基准。上下文窗口以 token 计(K = 1,024;2M = 2,097,152)。详见 模型价格指数 与 模型延迟基准。
不确定该用哪个模型?告诉我们你的任务类型与预算 — 我们将对 12 个模型排序并解释原因。
最常见选择的快速指南。
GPT-5-mini($0.15/$0.60)与 DeepSeek Chat($0.27/$1.10)以旗舰价格的一小部分提供接近前沿的质量 — 是生产环境负载的理想默认选择。
Claude Sonnet 4 与 GPT-5 在代码质量上领先,延迟低于 450ms。预算紧张时,Qwen 3.5($0.30/$1.20)是开源权重中的突出选择。
Gemini 2.5 Pro 是唯一拥有 2M token 上下文的模型 — 一次调用即可喂入整个代码库或整本书。Claude Opus 4(200K)与 Kimi K2.6(256K)是强劲备选。
DeepSeek R1($0.55/$2.19)以极低价格提供 o1 级推理能力 — 处理高难数学与分析问题时,请接受约 900ms 的首 token 延迟。
DrAI 用一个 API Key 接入全部 15+ 模型,按用量计费 — 无需分别注册各家平台,无开通费。查看完整定价,或 30 秒免费开始。