免费工具 · 无需注册

AI 模型对比工具

12 个主流 AI 模型同台对比 — 每 1M tokens 价格、延迟、上下文窗口与 MMLU 质量。勾选你关心的模型,按任意列排序,将表格导出为 Markdown 或 CSV,或让推荐引擎根据你的任务与预算挑选最佳模型。

数据核验于 2026-08-16 · 所有价格为每 1M tokens 美元价

1 · 选择模型

勾选要对比的模型 — 下方表格实时更新。

2 · 对比模型

点击任意列标题排序 — 最便宜优先、最快优先、上下文最大或 MMLU 最高。输入/输出价格为每 1M tokens 美元价;TTFT 为 p50 首 token 时间。

模型 输入 $/1M 输出 $/1M 上下文 p50 TTFT MMLU 适合场景
将当前选择与排序复制到剪贴板

方法论:各提供商公布的价格(2026 年 8 月),p50 首 token 时间来自生产环境采样,MMLU 为 5-shot 基准。上下文窗口以 token 计(K = 1,024;2M = 2,097,152)。详见 模型价格指数模型延迟基准

3 · 获取推荐

不确定该用哪个模型?告诉我们你的任务类型与预算 — 我们将对 12 个模型排序并解释原因。

我该用哪个模型?

最常见选择的快速指南。

综合性价比最高

GPT-5-mini($0.15/$0.60)与 DeepSeek Chat($0.27/$1.10)以旗舰价格的一小部分提供接近前沿的质量 — 是生产环境负载的理想默认选择。

代码能力最强

Claude Sonnet 4GPT-5 在代码质量上领先,延迟低于 450ms。预算紧张时,Qwen 3.5($0.30/$1.20)是开源权重中的突出选择。

长文档 & RAG 最佳

Gemini 2.5 Pro 是唯一拥有 2M token 上下文的模型 — 一次调用即可喂入整个代码库或整本书。Claude Opus 4(200K)与 Kimi K2.6(256K)是强劲备选。

深度推理最佳

DeepSeek R1($0.55/$2.19)以极低价格提供 o1 级推理能力 — 处理高难数学与分析问题时,请接受约 900ms 的首 token 延迟。

准备好用这些模型构建了吗?

DrAI 用一个 API Key 接入全部 15+ 模型,按用量计费 — 无需分别注册各家平台,无开通费。查看完整定价,或 30 秒免费开始。

🌐 English