【2026年最新】RAG・ベクターDB API料金比較|OpenAI・Cohere・Pinecone・Weaviate

はじめに
RAG・ベクターDB APIとは?
RAG(Retrieval-Augmented Generation)とは、LLMに自社ドキュメントや最新情報を参照させながら回答を生成する手法です。AIエージェント・チャットボット・社内検索など、幅広い用途で活用されています。
RAGの構築には2種類のAPIが必要です:
- Embeddingモデル(埋め込みAPI):テキストをベクター(数値配列)に変換するAPI。検索の精度を左右する
- ベクターDB(VectorDB):変換したベクターを格納・検索するデータベース。格納量とクエリ数に応じた料金体系が多い
RAGのコスト構造
RAGのコストは3段階で発生します:
- インデックス作成時:ドキュメントをEmbeddingモデルでベクター化する費用(1回限り)
- ストレージ:ベクターDBに格納したデータを保持する月額費用
- 検索クエリ:ユーザーのクエリをベクター化して検索するたびに発生する費用
Embeddingモデル API料金比較表(2026年10月時点)
※料金はUSD。2026年10月時点の情報です。
| モデル名 | 提供元 | 入力料金 /1Mトークン | 次元数 | 無料枠 |
|---|---|---|---|---|
| text-embedding-3-small | OpenAI | $0.02(バッチ: $0.01) | 1,536次元(縮小指定可) | なし |
| text-embedding-3-large | $0.13(バッチ: $0.065) | 3,072次元(縮小指定可) | なし | |
| voyage-4-lite | Voyage AI | $0.02 | 1,024次元(256/512/2,048も選択可) | ✓ あり(初回200Mトークン) |
| voyage-4 | $0.06 | 1,024次元(256/512/2,048も選択可) | ✓ あり(初回200Mトークン) | |
| voyage-4-large | $0.12 | 1,024次元(256/512/2,048も選択可) | ✓ あり(初回200Mトークン) | |
| embed-v5.0-fast | Cohere | $0.08(画像: $0.40) | 2,048次元(256/512/768/1,024/1,536も選択可) | トライアルのみ(トライアルキー・月1,000回) |
| embed-v5.0-pro | $0.12(画像: $0.40) | 2,048次元(256/512/768/1,024/1,536も選択可) | トライアルのみ(トライアルキー・月1,000回) | |
| gemini-embedding-2 | $0.20(バッチ: $0.10) | 3,072次元(128〜3,072で可変) | ✓ あり(無料ティア・使用量制限) | |
| gemini-embedding-001 | $0.15(バッチ: $0.075) | 3,072次元(128〜3,072で可変) | ✓ あり(無料ティア・使用量制限) |
※ 1Mトークンあたりの入力費用。OpenAIのバッチは50%割引($0.01・$0.065)。
※ Googleのバッチは$0.10/$0.075、Voyageはバッチ33%割引。Cohereの「画像」は1M画像トークンあたり。
※ Cohereは2026年9月30日公開のembed-v5.0に差し替え(前世代embed-v4.0もAPIで利用可)。料金は公式ブログの記載値です。
※ gemini-embedding-001は2028年5月14日に提供終了予定(後継gemini-embedding-2はマルチモーダル対応)。2026年9月に公式の現行料金表から掲載が外れ、上記の金額は掲載当時の値です。
出典:OpenAI 公式料金ページ
出典:Voyage AI 公式料金ページ
出典:Cohere 公式ブログ(Embed 5の発表・料金)
出典:Google Gemini API 公式料金ページ
ベクターDB(VectorDB)料金比較表(2026年9月時点)
※料金はUSD。2026年9月時点の情報です。
| プラン | 提供元 | 料金体系 | 無料枠 |
|---|---|---|---|
| Starter | Chroma | $0/月+従量課金 Write: $2.50/GiB Storage: $0.33/GiB/月 Query: $0.0075/TiB Network: $0.09/GiB |
トライアルのみ($5クレジット) |
| Team | $250/月+従量課金 | トライアルのみ($100クレジット) | |
| Free Tier | Qdrant | 永久無料 (シングルノード・0.5vCPU / 1GB RAM / 4GB Disk) |
✓ あり(永久無料・0.5vCPU/1GB RAM/4GB Disk) |
| Standard | 従量課金(vCPU・メモリ・ストレージの時間課金) 公式計算機で見積もり(vCPU・メモリ・ストレージの時間課金) (稼働率SLA 99.5%・見積もりは公式計算機) |
なし | |
| Flex | Weaviate | $45/月〜+従量課金 ベクター次元: $0.00465/1M〜 ストレージ: $0.12/GiB〜 (稼働率SLA 99.5%) |
✓ あり(Freeプラン・永久無料・1クラスター/10万オブジェクト) |
| Premium | 要問い合わせ(前払い契約) ベクター次元: $0.002718〜0.003875/1M ストレージ: $0.10〜0.1505/GiB (電話サポート・稼働率SLA 99.9〜99.95%・Shared/Dedicatedで単価とSLAが異なる) |
なし | |
| Builder | Pinecone | $20/月(定額) ストレージ: 10GBまで込み 書込: 500万ユニット/月まで込み 読込: 200万ユニット/月まで込み |
✓ あり(Starterプラン・2GB・書込200万/読込100万ユニット/月) |
| Standard | $50/月〜+従量課金 ストレージ: $0.33/GB/月 書込: $4〜4.50/100万ユニット 読込: $16〜18/100万ユニット |
トライアルのみ(3週間・$300クレジット) | |
| Enterprise | $500/月〜+従量課金 書込: $6〜6.75/100万ユニット 読込: $24〜27/100万ユニット (稼働率SLA 99.95%・BYOC対応) |
なし |
※ Chroma・Qdrant・WeaviateはOSS版があり自前運用ならソフトは無料。Pineconeはマネージドのみ。
※ Weaviateのベクター次元料金はインデックス種別・圧縮・リージョンで変動(表は公式表示額)。
※ Qdrant Standardは定価表がなく公式計算機で見積もり。
※ Pineconeの「ユニット」は課金単位(書込1KB=1ユニット)。単価はリージョンで幅あり。
※ Qdrant FreeとWeaviate Freeは高可用性構成なし。
出典:Pinecone 公式料金ページ
出典:Weaviate 公式料金ページ
出典:Chroma 公式料金ページ
出典:Qdrant 公式料金ページ
用途別おすすめ
コスト最小・個人開発・プロトタイプ向き
OpenAI text-embedding-3-small($0.02/1Mトークン)+Chroma OSS(無料・ローカル)の組み合わせが最もコストを抑えられます。ローカル開発・プロトタイプ・少量データならほぼ無料で構築できます。同じ$0.02のvoyage-4-liteは初回200Mトークンが無料です。
バランス重視・中規模本番向き
OpenAI text-embedding-3-small + Qdrant Cloudが費用対効果の高い組み合わせです。Qdrant Free Tierは永久無料(0.5vCPU/1GB RAM/4GB Disk)で始められ、スケールアップ時はStandardに移行できます。運用を任せたい場合はPinecone Builder($20/月の定額)も選択肢です。ストレージ10GB・書込500万ユニット・読込200万ユニットまで月額に含まれるため、従量課金の請求額が読めない不安を避けたい小〜中規模に向きます。
高精度・エンタープライズ向き
OpenAI text-embedding-3-large($0.13/1Mトークン)+Pinecone Standard($50/月〜)が高精度・高可用性の組み合わせです。Pineconeは完全マネージドで運用の手間がかからず、大規模本番環境に適しています。SLA 99.95%やBYOC(自社クラウド内での稼働)が要件ならPinecone Enterprise($500/月〜)やWeaviate Premium(最低額は要問い合わせ)が候補です。表や図の入った社内資料・PDFまで検索させたいならCohere embed-v5.0-pro($0.12/1Mトークン)も候補です。Cohere公式の評価では、図表を含む文書の検索精度が前世代embed-v4.0の77.0から85.8に上がりました。
Googleエコシステムで統一したい場合
gemini-embedding-2($0.20/1Mトークン)+Vertex AI Vector Searchの組み合わせも可能です(Vertex AI Vector Searchは本表では未掲載)。Gemini APIと統一して管理したい場合に選ばれ、無料ティアで試せます。コスト重視ならgemini-embedding-001($0.15/1Mトークン・テキスト専用)もありますが、2028年5月14日に提供終了予定のため新規構築はgemini-embedding-2が安全です。
セルフホスト(OSS)とマネージドクラウドの選び方
Chroma・Qdrant・Weaviateはソフト自体が無料のOSS版があり、自前サーバーで動かせます。マネージドクラウドは最低月額がかかる代わりに、バックアップ・スケール・監視を任せられます。
| 比較項目 | セルフホスト(OSS) | マネージドクラウド |
|---|---|---|
| 初期コスト | 低(ソフト無料) | 中〜高(最低月額あり) |
| 運用コスト | サーバー・メンテナンス費 | 込み(自動スケール) |
| スケール | 手動構築が必要 | 自動・即時対応 |
| 向いている用途 | 開発・小〜中規模 | 本番・大規模 |
よくある質問
RAGを構築する際のAPIコストはどのくらいですか?
RAGのコストは「Embeddingモデル(ベクター化)」と「ベクターDB(格納・検索)」の2種類です。最安構成(text-embedding-3-small+Chroma OSS)はほぼ無料で始められます。本番運用は小規模でも月$10〜$50程度が目安で、ベクターDBの最低月額が主なコストです。
EmbeddingモデルはOpenAIとCohereどちらがおすすめですか?
コスト重視ならOpenAI text-embedding-3-small($0.02/1Mトークン)が最安クラスです。Cohere embed-v5.0(Fastは$0.08・Proは$0.12/1Mトークン)は画像やPDFも同じ空間に埋め込め、多言語データに強いためエンタープライズ用途に向きます。精度と価格のバランスではtext-embedding-3-smallが最も広く使われています。
無料で使えるベクターDBはありますか?
はい。Chroma・Qdrant・WeaviateはOSS版を自前サーバーで無料で使えます。クラウド版でもQdrant Free Tier(永久無料・0.5vCPU/1GB RAM/4GB Disk)、Weaviate Free(永久無料・10万オブジェクト)、Pinecone Starter(2GBまで無料)があります。いずれも高可用性の保証はないため、本番は有料のマネージドプランが推奨です。
PineconeとQdrantはどちらを選ぶべきですか?
Pinecone(Builder $20/月・Standard $50/月〜)は完全マネージドで運用コストがゼロ、スケールが容易で大規模本番向けです。Qdrant(Free Tier永久無料・Standard従量課金)はセルフホストで始めてクラウドに移行できる柔軟性があり、小〜中規模に向きます。費用を最小化したい初期段階ではQdrant Free Tier、スケールが必要になったらPineconeへ移行するパターンが多いです。
gemini-embedding-001はいつまで使えますか?
Googleの提供終了予定表では2028年5月14日に停止予定で、後継はgemini-embedding-2($0.20/1Mトークン)です。それまでは$0.15で使えますが、モデルを切り替えると既存のベクターは作り直しになるため、新規構築はgemini-embedding-2を前提にすると移行の手間を避けられます。
まとめ
- 最安Embedding:OpenAI text-embedding-3-small・Voyage AI voyage-4-lite(ともに$0.02/1Mトークン)
- 高精度Embedding:OpenAI text-embedding-3-large($0.13)またはgemini-embedding-2($0.20・マルチモーダル)
- 画像・PDFも検索したい:Cohere embed-v5.0(Fastは$0.08・Proは$0.12/1Mトークン・2026年9月30日公開)
- Google系コスト重視:gemini-embedding-001($0.15・テキスト専用)は2028年5月14日に提供終了予定
- 無料のベクターDB:Chroma OSS(ローカル無料)・Qdrant Cloud Free Tier(永久無料・4GB Disk)・Weaviate Free(10万オブジェクト)
- マネージドの定番:Pinecone(定額のBuilderが$20/月・本番向けStandardが$50/月〜)が最も安定した選択肢
- 定番構成:プロトタイプはtext-embedding-3-small+Chroma OSS、本番はtext-embedding-3-small+Qdrant/Pinecone
- 大量インデックス作成:バッチAPIで割引(OpenAIとGoogleは50%・Voyage AIは33%)
料金は変動します。最新情報は各社公式ページで確認し、実際の用途でテストして選定してください。




