LLM Gateway · OpenAI / Anthropic 互換

Modellix LLM

1 つのゲートウェイで主要な言語モデルへ

1 つの Modellix API Key で Chat Completions、Responses、Messages を呼び出せます。リクエストは同期式で、SSE も選択可能です。画像と動画は引き続きメディア API を使用します。

https://llm.modellix.ai

テキスト用ゲートウェイのホストです。OpenAI 互換クライアントでは https://llm.modellix.ai/v1 を使用してください。

クイックスタート

3 ステップでクライアントを接続

Base URL を設定し、Modellix API Key を指定して、model を provider/name 形式で指定します。

  1. 01 · キー

    API Key を作成

    Console → API Key で作成し、Bearer または x-api-key として送信します。

    Console → API Key
    Authorization: Bearer mdlx-xxxxxxxx
  2. 02 · Base URL

    プロトコルに合うホストを選択

    OpenAI 互換では /v1 を付け、Anthropic / Claude Code では付けません。

    https://llm.modellix.ai/v1
  3. 03 · モデル

    モデル ID を指定

    常に provider/name 形式を使用します。利用可能なモデルは製品ドキュメントを参照してください。

    openai/gpt-5.6-sol

ゲートウェイ機能

一般的なクライアントと AI エージェント向けのゲートウェイ

1 つのキーで Chat Completions、Responses、Anthropic Messages を利用できます。

  • 3 つの主要プロトコル

    Chat Completions、Responses、Messages には、それぞれ独立した URL とリクエスト本文があります。クライアントに合うプロトコルを選び、フィールドを混在させないでください。

  • 主要クライアントに対応

    OpenAI / Anthropic SDK、Codex、Claude Code、Cursor、OpenCode などは、Base URL を上書きするだけで接続できます。Modellix 専用 SDK は不要です。

  • 1 つの Modellix Key

    Bearer と x-api-key の両方に対応します。各モデル提供元が発行したキーではなく、Modellix Console のキーを使用してください。

  • 同期レスポンス、ストリーミングにも対応

    テキスト呼び出しは同期的に応答します。stream: true ではプロトコルに対応する SSE ストリームを使用します。メディア生成は引き続き非同期です。

  • 統一されたモデル ID

    model は provider/name 形式で指定します。例:openai/gpt-5.6-sol、anthropic/claude-sonnet-5。

  • トークン単位の明確な料金

    成功レスポンスは usage に基づいて課金されます。Input Context の段階料金があるモデルは、料金表に全段階を表示します。

プロトコル選択

プロトコルを選んでからリクエスト

URL の変更だけでは不十分です。Chat Completions は messages、Responses は input を使用し、Messages では max_tokens が必須です。

POST /v1/chat/completions · OpenAI SDK、Codex、Cursor、および一般的なチャットクライアント向けです。Base URL には /v1 が必要です。

curl -sS "https://llm.modellix.ai/v1/chat/completions" \
  -H "Authorization: Bearer ${API_KEY}" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-5.6-sol",
    "stream": false,
    "max_tokens": 256,
    "messages": [{"role": "user", "content": "Introduce yourself in one sentence"}]
  }'
Chat CompletionsResponsesMessages
Path/v1/chat/completions/v1/responses/v1/messages
主入力messagesinputmessages + 任意の system
長さフィールドmax_tokens / max_completion_tokensmax_output_tokensmax_tokens (必須)
Base URLhttps://llm.modellix.ai/v1https://llm.modellix.ai/v1https://llm.modellix.ai

モデルカタログ

モデルと料金

単価は USD / 1M tokens です。「コンテキスト」はモデルが対応するウィンドウです。一部のモデルは今回のリクエストの Input Context に応じて段階課金されます。段階数はモデルごとに異なり、ウィンドウサイズとは別の概念です。

料金見積もり

1 回の呼び出し料金を見積もる

入力トークン数から対応する Input Context 段階を自動選択します。取り消し線が公式カタログ価格、その下が Modellix 実売価格です。

openai/gpt-5.6-sol
Input tokens
Output tokens
Cached Read tokens
Cached Write tokens
Input Context ≤ 272K今回のリクエストの Input Context で課金
Input$0.256
Output$0.032
Cached Read$0
Cached Write$0
Modellix 料金の見積もり$0.288

公式カタログでは約 $0.36 、約 20% お得

料金表

プロバイダーで絞り込み
入力モダリティ
モデル入力モダリティ出力モダリティコンテキストInput ContextInputOutputCached ReadCached Write割引
Claude Haiku 4.5
anthropic/claude-haiku-4.5
テキスト画像テキスト200K$1.00$0.97$5.00$4.85$0.1$0.097$1.25$1.213% OFF
Claude Opus 5
anthropic/claude-opus-5
テキスト画像テキスト1M$5.00$4.85$25.00$24.25$0.5$0.485$6.25$6.063% OFF
Claude Sonnet 5
anthropic/claude-sonnet-5
テキスト画像テキスト1M$2.00$1.94$10.00$9.70$0.2$0.194$2.50$2.423% OFF
Deepseek V4 Flash
deepseek/deepseek-v4-flash
テキストテキスト1.05M$0.44$1.32$0.014$0
Deepseek V4 Flash Vision
deepseek/deepseek-v4-flash-vision
テキスト画像テキスト1.05M$0.44$1.32$0.014$0
Deepseek V4 Pro
deepseek/deepseek-v4-pro
テキストテキスト1.05M$1.33$3.96$0.044$0

コンテキストはモデルが対応するウィンドウです。入出力モダリティはテキスト、画像、音声、動画です。成功レスポンスはトークン使用量に基づいて課金されます。

クライアント連携

対応クライアント

既存の OpenAI または Anthropic 設定を Modellix に向けるだけで、アプリケーションのプロトコルを変更する必要はありません。

対応クライアントの一覧は LLM API ガイド をご覧ください。

ヘルプ

よくある質問

開発者向けの接続方法と課金について、簡潔に回答します。

Modellix LLM とは何ですか?

Modellix LLM は https://llm.modellix.ai で提供されるテキストモデルゲートウェイです。1 つの Modellix API Key で、OpenAI 互換の Chat Completions / Responses、または Anthropic 互換の Messages を呼び出せます。リクエストは同期式で、SSE ストリーミングも利用できます。

LLM ゲートウェイと画像 / 動画 API の違いは何ですか?

LLM テキストは https://llm.modellix.ai を使用し、同期的に応答します。画像、動画、音声生成は https://api.modellix.ai のメディア API を使う非同期タスクです。ホストやフィールドを混在させないでください。

認証方法は?

API Key ページでキーを作成し、Authorization: Bearer または x-api-key として送信します。各モデル提供元のプラットフォームキーは使用しません。2 つのヘッダーは同等で、両方送る場合は同じキーである必要があります。

モデル ID はどのように指定しますか?

リクエスト本文に provider/name 形式で指定します。例:openai/gpt-5.6-sol、anthropic/claude-sonnet-5、google/gemini-3.6-flash。利用可能なモデルと料金は製品ドキュメントをご確認ください。

モデルによって料金が段階制なのはなぜですか?

一部のモデルは、今回のリクエストの入力トークン数(Input Context)に応じて段階課金されます。段階数はモデルごとに異なり、コンテキストウィンドウとは別の概念です。料金表の「コンテキスト」はモデルが処理できるウィンドウ、「Input Context」は料金段階です。Claude、多くの Gemini Flash、Qwen、DeepSeek などは固定料金です。見積もりでは入力トークン数に応じて段階を自動選択します。

Chat Completions、Responses、Messages のどれを使うべきですか?

OpenAI SDK、Codex、Cursor などは Chat Completions または Responses を使い、Base URL は https://llm.modellix.ai/v1 です。Anthropic SDK と Claude Code は Messages を使い、Base URL は https://llm.modellix.ai(/v1 なし)です。URL とリクエスト本文が異なるため、フィールドを混在させないでください。

課金方法は?

成功レスポンスはトークン使用量に基づき、USD / 1M tokens の単価で課金されます。取り消し線が公式カタログ価格、その下が Modellix 実売価格です。提供状況と料金は変更される場合があるため、製品ドキュメントをご確認ください。残高不足の場合は 402 を返します。

Modellix LLM

OpenAI と Anthropic のプロトコルに対応

Modellix 専用 SDK は不要です。API Key を作成し、現在利用しているクライアントの Base URL を Modellix に向けるだけで、Cursor、Claude Code、バックエンドから LLM を呼び出せます。