什么是 Modellix LLM?
Modellix LLM 是文本模型网关,主机为 https://llm.modellix.ai。用一把 Modellix API Key,即可调用 OpenAI 兼容的 Chat Completions 与 Responses,或 Anthropic 兼容的 Messages。请求为同步模式,可选 SSE 流式。
Modellix LLM
用一把 Modellix API Key,调用 Chat Completions、Responses 与 Messages。同步请求,可选 SSE。图像与视频仍走媒体 API。
https://llm.modellix.ai文本网关主机。OpenAI 兼容客户端请使用 https://llm.modellix.ai/v1。
快速接入
替换 Base URL,使用 Modellix API Key,并将 model 设置为 provider/name。
在 Console → API Key 页面创建,然后通过 Bearer 或 x-api-key 发送。
Console → API KeyAuthorization: Bearer mdlx-xxxxxxxxOpenAI 兼容带 /v1;Anthropic / Claude Code 不要加 /v1。
https://llm.modellix.ai/v1始终使用 provider/name。可用模型以产品文档为准。
openai/gpt-5.6-sol网关能力
一把密钥即可调用 Chat Completions、Responses 与 Anthropic Messages。
Chat Completions、Responses、Messages 各自独立的 URL 与请求体。按客户端选协议,不要混用字段。
OpenAI / Anthropic SDK,以及 Codex、Claude Code、Cursor、OpenCode 等,只需替换 Base URL 即可接入,无需 Modellix 自有 SDK。
Bearer 或 x-api-key 均可。密钥来自 Console,不是各厂商平台的 Key。
文本调用同步返回;stream: true 时使用相应协议的 SSE 流式响应。媒体生成仍采用异步任务。
model 使用 provider/name,例如 openai/gpt-5.6-sol、anthropic/claude-sonnet-5。
成功响应按 usage 计费。部分模型按 Input Context 分段,价目表会列出该模型的全部档位。
协议选择
只改 URL 不够。Chat Completions 用 messages,Responses 用 input,Messages 还需要必填的 max_tokens。
curl -sS "https://llm.modellix.ai/v1/chat/completions" \
-H "Authorization: Bearer ${API_KEY}" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-5.6-sol",
"stream": false,
"max_tokens": 256,
"messages": [{"role": "user", "content": "Introduce yourself in one sentence"}]
}'| Chat Completions | Responses | Messages | |
|---|---|---|---|
| Path | /v1/chat/completions | /v1/responses | /v1/messages |
| 主输入 | messages | input | messages + 可选 system |
| 长度字段 | max_tokens / max_completion_tokens | max_output_tokens | max_tokens (必填) |
| Base URL | https://llm.modellix.ai/v1 | https://llm.modellix.ai/v1 | https://llm.modellix.ai |
模型目录
单价为 USD / 1M tokens。“上下文”是模型支持的窗口。部分模型按本次请求的 Input Context 分段计价,档位数因模型而异,与窗口大小不是同一件事。
输入 token 数会自动匹配对应的 Input Context。划线为官方目录价,其下为 Modellix 实收价。
openai/gpt-5.6-sol官方目录约 $0.36 ,约省 20%
| 模型 | 输入模态 | 输出模态 | 上下文 | Input Context | Input | Output | Cached Read | Cached Write | 折扣 |
|---|---|---|---|---|---|---|---|---|---|
Claude Haiku 4.5 anthropic/claude-haiku-4.5 | 文本图像 | 文本 | 200K | — | 3% OFF | ||||
Claude Opus 5 anthropic/claude-opus-5 | 文本图像 | 文本 | 1M | — | 3% OFF | ||||
Claude Sonnet 5 anthropic/claude-sonnet-5 | 文本图像 | 文本 | 1M | — | 3% OFF | ||||
Deepseek V4 Flash deepseek/deepseek-v4-flash | 文本 | 文本 | 1.05M | — | $0.44 | $1.32 | $0.014 | $0 | — |
Deepseek V4 Flash Vision deepseek/deepseek-v4-flash-vision | 文本图像 | 文本 | 1.05M | — | $0.44 | $1.32 | $0.014 | $0 | — |
Deepseek V4 Pro deepseek/deepseek-v4-pro | 文本 | 文本 | 1.05M | — | $1.33 | $3.96 | $0.044 | $0 | — |
上下文为模型支持的窗口。输入 / 输出模态包括文本、图像、音频和视频。成功响应按 token 用量计费。
客户端接入
把现有 OpenAI 或 Anthropic 配置指向 Modellix 即可,不必改业务协议。
完整列表见 LLM API 指南 。
帮助
面向开发者接入与计费的直接回答。
Modellix LLM 是文本模型网关,主机为 https://llm.modellix.ai。用一把 Modellix API Key,即可调用 OpenAI 兼容的 Chat Completions 与 Responses,或 Anthropic 兼容的 Messages。请求为同步模式,可选 SSE 流式。
LLM 文本走 https://llm.modellix.ai,同步返回。图像、视频与语音生成走媒体 API https://api.modellix.ai,采用异步任务。不要把两套主机或字段混用。
到 API Key 页面创建密钥,使用 Authorization: Bearer 或 x-api-key。不要使用各模型厂商平台的密钥。两个请求头等价;若同时发送,必须是同一把钥匙。
在请求体中传 provider/name,例如 openai/gpt-5.6-sol、anthropic/claude-sonnet-5、google/gemini-3.6-flash。可用模型与价格以产品文档为准。
部分模型按本次请求的输入 token 数(Input Context)分段计价,档位数因模型而异,与模型上下文窗口不是同一件事。价目表中的“上下文”是模型能处理的窗口,“Input Context”才是计价分段。Claude、多数 Gemini Flash、Qwen、DeepSeek 等为一口价。估算器会按你填写的输入 token 自动匹配对应档位。
OpenAI SDK、Codex、Cursor 等走 Chat Completions 或 Responses,Base URL 为 https://llm.modellix.ai/v1。Anthropic SDK 与 Claude Code 走 Messages,Base URL 为 https://llm.modellix.ai(不要加 /v1)。三套协议的 URL 与请求体不同,不要混用字段。
成功响应按 token 用量计费,单价为 USD / 1M tokens。价目表中划线金额为官方目录价,其下为 Modellix 实收价。可用性与价格可能变化,请以产品文档为准。余额不足返回 402。
Modellix LLM
Modellix 不另提供 SDK。创建 API Key,把你正在用的客户端 Base URL 指过来,即可在 Cursor、Claude Code 或后端里调用 LLM。