Every major embedding API's list price per 1M tokens in one table — from OpenAI text-embedding-3-small at $0.02 to free open-source bge models you self-host. Tracked weekly, free forever.
Last verified 2026-08-16 · 12 models · 9 providersList prices in USD per 1M tokens. Open-source models cost $0 in API fees when self-hosted. Prices verified 2026-08-16.
| Model | Provider | Dimensions | Context | Price $/1M | Best for |
|---|---|---|---|---|---|
| text-embedding-3-large | OpenAI | 3072 | 8191 | $0.13 | Maximum retrieval quality; RAG at scale |
| voyage-3 | Voyage AI | 1024 | 32000 | $0.12 | Long documents, code retrieval |
| text-embedding-ada-002 | OpenAI | 1536 | 8191 | $0.10 | Legacy; still the most deployed model |
| cohere-embed-v3 | Cohere | 1024 | 512 | $0.10 | Enterprise search and RAG |
| mistral-embed | Mistral | 1024 | 8000 | $0.10 | EU hosting, RAG pipelines |
| jina-embeddings-v3 | Jina AI | 1024 | 8192 | $0.06 | 89-language multilingual |
| gemini-embedding | 3072 | 2048 | $0.05 | Multimodal + text retrieval | |
| qwen3-embedding | Alibaba | 1024 | 32768 | $0.04 | Long-context, cost-sensitive |
| text-embedding-3-small cheapest API | OpenAI | 1536 | 8191 | $0.02 | Best price-to-quality ratio |
| bge-large | BAAI · open source | 1024 | 512 | $0.00 | self-host Local RAG, privacy-first |
| bge-m3 | BAAI · open source | 1024 | 8192 | $0.00 | self-host Multi-lingual, multi-granularity |
| gte-large | Alibaba · open source | 1024 | 8192 | $0.00 | self-host Strong zh/en retrieval |
Output dimension is the hidden line item of any embedding budget. It does not change the API price, but it multiplies your vector database bill, query latency and memory footprint.
| Dimensions | Storage / 1M vectors (float32) | Storage / 1M vectors (int8) | Typical use |
|---|---|---|---|
| 384 | 1.5 GB | 0.4 GB | Mobile, latency-critical, budget search |
| 768 | 3.0 GB | 0.8 GB | Default RAG balance |
| 1536 | 6.0 GB | 1.5 GB | text-embedding-3-small / ada-002 default |
| 3072 | 12.0 GB | 3.0 GB | text-embedding-3-large / Gemini max |
A typical knowledge-base migration: one million documents averaging 500 tokens each = 500M tokens total. Here is what each model charges for the one-time embedding pass.
| Model | Rate $/1M | 500M tokens | One-time cost |
|---|---|---|---|
| text-embedding-3-small | $0.02 | 500 × $0.02 | $10 |
| qwen3-embedding | $0.04 | 500 × $0.04 | $20 |
| jina-embeddings-v3 | $0.06 | 500 × $0.06 | $30 |
| text-embedding-ada-002 | $0.10 | 500 × $0.10 | $50 |
| cohere-embed-v3 | $0.10 | 500 × $0.10 | $50 |
| voyage-3 | $0.12 | 500 × $0.12 | $60 |
| text-embedding-3-large | $0.13 | 500 × $0.13 | $65 |
| bge-large (self-hosted) | $0.00 | — | $0 + GPU |
The $0.00 rows above are not free — they trade API fees for engineering time and hardware. Here is the honest comparison.
Stop metering tokens. DrAI bundles frontier LLMs, embedding models and image generation into a single subscription with one unified API — no per-token bills, no surprise invoices.
See DrAI pricing Start free — no card needed