この記事でわかること

- 埋め込みモデル(embedding model)とは何か、非エンジニアでも判断できる基本
- 商用API型とオープンソース型の主な選択肢と、それぞれの向き不向き
- 料金、多言語対応、データ利用条件、運用形態の比較軸
- 社内文書検索、社内サポート、営業ナレッジなど用途別の第一候補
- 企業導入で確認すべきセキュリティ・運用チェックリスト
※モデルの料金、提供範囲、機能は変更される場合があります。導入前に各社の公式情報で最新条件を確認してください。
結論サマリー:迷ったら何を選ぶか
用途別に、まず試す第一候補を整理します。

| 用途 |
第一候補 |
理由 |
注意点 |
| 汎用の社内RAG(日本語主体) |
OpenAI text-embedding-3-large |
日本語精度と実装容易性のバランスが良い |
機密データはAPI利用条件を要確認 |
| 多言語ナレッジ・グローバル拠点 |
Cohere embed-multilingual-v3 |
多言語検索と再ランキング(reranker)の連携に強い |
提供リージョンと契約条件を要確認 |
| 高精度が必要な検索・法務・研究 |
Voyage AI(voyage-3系) |
検索精度重視のベンチマークで評価が高い |
提供状況とライセンス条件を要確認 |
| クラウド外に出せない機密文書 |
オープンソース(BGE-M3、multilingual-e5系) |
自社環境で完結、外部APIを使わない |
GPU運用と評価・更新の内製が必要 |
3つの視点で選ぶと迷いにくくなります。
- 外に出せるデータか、出せないデータか
- 日本語主体か、多言語主体か
- 精度をどこまで求めるか、料金・運用負荷とのバランス
埋め込みモデルとは:AIが文章を「近さ」で比較する仕組み
埋め込みモデル(embedding model)は、文章を数値の並び(ベクトル)に変換するAIです。ベクトル同士の距離を測ることで、「意味が近い文書」を検索できます。
社内RAGでは、次の流れで使われます。
- 社内文書を埋め込みモデルでベクトル化して保存する
- ユーザーの質問も同じモデルでベクトル化する
- ベクトル距離が近い文書を取り出し、AIに回答を作らせる
用語が多いので、本文の前半で最小限の意味を揃えます。
| 用語 |
意味 |
| 埋め込みモデル |
文章を数値ベクトルに変換するAI。検索精度の土台になる |
| ベクトル |
文章の意味を数百〜数千の数値で表したもの |
| 次元数 |
ベクトルの数値の個数。多いほど表現力が上がるが保存コストも増える |
| リランカー |
検索候補を精度重視で並べ直すAI。埋め込み検索と組み合わせて使う |
| コンテキスト長 |
一度に埋め込める文章の長さ |
埋め込みモデル単体の性能だけでRAGの精度は決まりません。文書の切り分け方(チャンク設計)、リランカー、検索インフラを合わせて評価する必要があります。
主要な埋め込みモデルの比較
大きく分けて、商用API型とオープンソース型の2種類があります。
商用API型:OpenAI・Cohere・Voyage AI・Google
商用API型は、API呼び出しでベクトルを取得できるサービスです。運用負荷が低く、社内RAGの立ち上げに向きます。
| モデル |
一言でいうと |
得意な用途 |
注意点 |
| OpenAI text-embedding-3(small/large) |
実装事例が最も多い、標準的な選択肢 |
汎用社内RAG、日本語主体のナレッジ検索 |
機密データのAPI送信可否は契約で確認 |
| Cohere embed-v3(multilingual含む) |
多言語検索とリランカー連携に強い |
グローバル拠点、多言語FAQ |
提供リージョンと法人契約条件を要確認 |
| Voyage AI(voyage-3系) |
検索精度重視のベンチマーク評価が高い |
法務・研究・高精度が必要な検索 |
提供状況、価格、契約条件を最新確認 |
| Google(Gemini埋め込み系) |
Google Cloud連携が前提の用途に向く |
Google Workspace中心の企業、Vertex AI基盤 |
対応言語、価格、リージョンを要確認 |
Anthropic(Claude)は、埋め込みモデルは自社提供せず、Voyage AIを推奨しています。RAG構築では別途API選定が必要になります。
オープンソース型:BGE-M3・multilingual-e5など
オープンソース型は、モデルの重みを自社サーバやVPC上で動かします。外部APIを使わずに完結できます。
| モデル |
一言でいうと |
得意な用途 |
注意点 |
| BGE-M3 |
多言語対応で日本語精度も高いOSS埋め込み |
機密文書中心の社内RAG、多言語対応 |
GPU運用と評価・更新の内製が必要 |
| multilingual-e5(large等) |
多言語検索のベースライン |
検証、内製RAGの初期プロトタイプ |
大規模文書では最新モデルと再比較する |
| 日本語特化(cl-nagoya等の派生モデル) |
日本語コーパスに最適化された派生モデル |
日本語ドキュメント特化の社内検索 |
更新頻度とライセンスを確認する |
オープンソース型は「無料」ではありません。GPUサーバ、評価パイプライン、更新運用、モデル入替の判断が発生します。

料金・利用条件の比較軸
API単価だけで比較しないことが重要です。企業導入では、次の観点を分けて確認します。
料金モデル
商用API型は、100万トークン単位の従量課金が主流です。ただし課金単位や上位モデルの追加料金は各社で異なります。単価だけでは総コストが読めません。
- 埋め込み対象の文書量(月あたり総トークン)を試算する
- 初期投入(全社文書のバッチ埋め込み)と、日次差分の両方でコストを見積もる
- 商用APIとOSS(自社GPU)の総所有コストを、3年スパンで比較する
- 最新の単価は必ず各社の公式価格ページで確認する
データ利用条件
社内文書は機密データを含みます。API利用条件で、次を確認します。
- 入力データが学習に使われるか(オプトアウトの可否)
- データ保持期間と削除ポリシー
- リージョン(日本国内/EU/US)を選べるか
- 監査ログの提供有無
- SOC2、ISO27001などの外部認証の有無
提供形態
経路によって契約主体とデータ経路が変わります。APIの直接契約、AWS Bedrock経由、Azure OpenAI経由、Google Vertex AI経由などが代表例です。既存クラウド契約とのすり合わせが必要になります。
| 比較軸 |
確認すること |
実務上の意味 |
| 料金 |
月額換算、初期埋め込みコスト、差分更新コスト |
継続利用時の予算・部門課金に影響 |
| データ利用 |
学習利用の有無、保持期間、リージョン |
機密情報の扱いと社内承認可否 |
| 契約経路 |
直接契約、AWS/Azure/GCP経由、SIer経由 |
既存クラウド予算との整合性 |
| 認証 |
SOC2、ISO27001、業界特有の認証 |
監査対応、社内セキュリティ承認 |
| ライセンス(OSS) |
商用利用可否、再配布条件 |
社内展開・派生モデル利用の可否 |
用途別の選び方

社内文書検索・社内FAQ(日本語主体)
まずはOpenAI text-embedding-3-largeで検証を始めるケースが多くなります。実装事例が多く、周辺ツール(LangChain、LlamaIndex、各社ベクトルDB)との組み合わせも成熟しています。
日本語精度に不足を感じた場合は、Voyage AIやCohere multilingual-v3への切替、またはリランカー追加を検討します。
多言語・グローバル拠点のナレッジ共有
Cohere embed-multilingual-v3は、多言語での検索精度と、同社リランカー(rerank-multilingual)との組み合わせが評価されています。海外拠点との情報共有基盤に向きます。
高精度が必要な法務・研究・調査領域
Voyage AI(voyage-3系)は、検索精度重視のベンチマークで高評価を得ています。判例、契約書、研究論文など、検索ミスがコストに直結する用途で選択肢に入ります。
クラウド外に出せない機密文書中心
BGE-M3などのオープンソース型を、社内サーバまたはVPCに配置します。外部APIに一切データを送らずに完結できるのが最大の利点です。
その分、GPUサイジング、評価データ整備、モデル更新、精度回帰テストは自社(または委託先)で運用する必要があります。
営業・CRM連携での使い方
商談履歴、議事録、提案書を横断検索する用途では、CRM側の権限モデルと組み合わせた設計が重要になります。誰がどの文書を検索できるかを、CRM上の役職や組織で制御する必要があります。
企業導入で注意すべき点
導入前に、次を必ず確認します。
- 社内文書のうち、埋め込み対象にできる文書(機密区分、個人情報の扱い)を分けたか
- 選定モデルの契約経路、データ利用条件、リージョン、認証を法務・情報システムで確認したか
- 精度評価のためのゴールデンデータセット(正解セット)を用意できるか
- 導入初期と半年後・1年後で精度を再評価する運用担当を決めたか
- モデル切替(API変更、OSS入替)のためのベクトルDB再構築コストを見積もったか
- リランカー導入、チャンク設計変更、権限制御の3点で、精度改善余地を残しているか
注意
埋め込みモデルを切り替えると、既存ベクトルは互換性がありません。大量文書を持つ基盤では、全文書の再埋め込みコストと再構築工数が発生します。初回選定は「切り替えづらい」ことを前提に判断してください。
Blackfordの見解:モデル選定は業務設計とセットで決める
Blackford Technologiesでは、埋め込みモデル選定を「単体性能の比較」ではなく、業務課題・扱うデータ・セキュリティ要件・運用体制の4点を同時に整理する仕事として扱います。

現場で意見が分かれやすい論点は次の通りです。
- 商用API型か、OSS型か(コスト・機密・運用体制のトレードオフ)
- 日本語特化型か、多言語型か(拠点構成と将来計画)
- 埋め込みモデル単体で走るか、リランカー併用か(精度・料金・遅延のトレードオフ)
- 既存のクラウド(AWS、Azure、GCP)との契約経路と整合性
これらは、AI開発チーム単独では決まりません。情報システム、法務、業務部門との合意形成が必要です。
Blackfordは、社内RAG・ナレッジ検索の設計、埋め込みモデル選定、評価、運用移行までを一貫して支援します。
社内設置型AIデータ基盤のDataRoid、既存クラウド上に段階導入するDataRoid Cloud、CRM連携が主軸ならSalesRoidを、業務要件に合わせて組み合わせます。
\RAG・ナレッジ検索基盤の選定を相談できます/
Blackfordに相談する
よくある質問
Q. 一番安い埋め込みモデルはどれですか?
A. 用途と規模によります。小規模な検証ならOpenAI text-embedding-3-smallが低単価で始めやすいですが、社内文書量が大きい場合はOSS(BGE-M3など)を自社GPUで運用したほうが総コストが下がるケースもあります。3年スパンで試算することをおすすめします。
Q. 日本語だけを扱う場合、日本語特化モデルを選ぶべきですか?
A. 必ずしも特化モデルが最適とは限りません。OpenAI text-embedding-3-largeやCohere multilingual-v3は多言語でも日本語精度が高く、実装事例も豊富です。日本語特化モデルは、独自のドメイン語彙(医療、法律など)がある場合に評価候補として比較してください。
Q. 社内の機密文書を扱っても大丈夫ですか?
A. モデルと契約経路によります。商用APIでも、法人契約(オプトアウト、リージョン指定)を使えば学習に使われないケースがあります。ただし個別契約で異なるため、必ず契約書と公式のデータ利用条件を確認し、機密区分ごとに送信可否を決めてください。クラウド外に出せない文書はOSS運用が選択肢になります。
Q. モデルを後から切り替えるのは難しいですか?
A. 難易度は高くなります。埋め込みベクトルは異なるモデル間で互換性がないため、切替時は全文書の再埋め込みが必要です。切替を想定するなら、初期からモデル抽象化レイヤを用意し、精度評価用のゴールデンデータセットを整備しておくと影響を抑えられます。
Q. リランカーは必ず導入すべきですか?
A. まずは埋め込みモデル単体で始め、精度が不足したときに追加検討する順序をおすすめします。リランカーは精度向上に有効ですが、遅延と料金が増えます。用途によっては、チャンク設計の見直しや検索件数調整のほうが費用対効果が高い場合もあります。
まとめ
企業のRAG・ナレッジ検索で使う埋め込みモデルは、単体性能の比較では選べません。外に出せるデータか、多言語が必要か、精度をどこまで求めるかの3点を先に整理することが出発点になります。
商用API型は立ち上げが早く、OSS型は機密対応と長期コストに強みがあります。ただし、モデル切替は再埋め込みコストが大きいため、初回選定は「後から切り替えづらい」ことを前提に、業務要件と運用体制まで含めて判断してください。
社内文書の分類、契約経路の確認、評価データの整備、運用担当の設計といった、モデル単体では決まらない論点が多いのがこの領域の特徴です。自社に迷いが残る場合は、業務課題とデータの棚卸しから一緒に整理する相談が有効です。
\RAG・埋め込みモデル選定の壁打ちができます/
Blackfordに相談する