Личный кабинет

ЕДИНЫЙ LLM API

Один ключ.
Лучшие языковые модели.

Подключайте GPT, Claude, Gemini, Codex и Grok через единый защищённый шлюз. Поддерживаются потоковые ответы, изображения, файлы, поиск и function calling.

request.sh
curl https://llm.msofter.com/codex/v1/responses \
  -H "Authorization: Bearer proxy_live_••••" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5-6-luna",
    "input": "Объясни квантовые вычисления",
    "stream": false
  }'
● 200 OK · application/json
OpenAI-compatibleStreaming SSEFunction callingMultimodalUsage tracking

Базовый URL

Во всех примерах заменяйте адрес поставщика модели на адрес MSofter LLM. Путь метода и структура JSON сохраняются.

BASE URLhttps://llm.msofter.com

Авторизация

Передавайте выданный администратором ключ в каждом запросе. Полный ключ показывается только один раз при создании.

Authorization: Bearer proxy_live_your_api_key
Content-Type: application/json
Безопасность

Вызывайте API только с backend-сервера. Не размещайте ключ в браузере, мобильном приложении или публичном репозитории.

POST/gpt-5-2/v1/chat/completionsChat Completions

Сообщения в OpenAI-совместимом формате. Поддерживает текст, изображения, web search и управление reasoning effort.

{
  "messages": [{"role": "user", "content": "Напиши краткое резюме"}],
  "reasoning_effort": "high"
}
POST/codex/v1/responsesResponses

Основной Responses API для GPT 5.4–5.6. Поле input принимает строку или массив сообщений.

{
  "model": "gpt-5-6-terra",
  "input": "Составь план запуска продукта",
  "reasoning": {"effort": "medium"},
  "stream": true
}
POST/api/v1/responsesCodex

Responses API для задач программирования. Доступны текст, изображения, файлы, web search и пользовательские функции.

{
  "model": "gpt-5.4-codex",
  "input": [{"role": "user", "content": [
    {"type": "input_text", "text": "Найди ошибку в этом коде"}
  ]}],
  "reasoning": {"effort": "high"}
}
POST/claude/v1/messagesMessages

Нативный формат Claude Messages с историей диалога, лимитом ответа и function calling.

{
  "model": "claude-sonnet-4-6",
  "max_tokens": 4096,
  "messages": [{"role": "user", "content": "Проанализируй договор"}],
  "stream": false
}
POST/grok/v1/responsesResponses

Responses-совместимый интерфейс Grok с reasoning, мультимодальным вводом и инструментами.

{
  "model": "grok-4-5",
  "input": "Что изменилось в отрасли за неделю?",
  "tools": [{"type": "web_search"}],
  "stream": false
}
POST/gemini-3-7-flash-openai/v1/chat/completionsOpenAI-compatible

Gemini в формате Chat Completions. Версии модели используют собственный префикс endpoint.

/gemini-2.5-pro/v1/chat/completions/gemini-3-pro/v1/chat/completions/gemini-3.1-pro/v1/chat/completions/gemini-2.5-flash/v1/chat/completions/gemini-3-flash/v1/chat/completions/gemini-3-5-flash-openai/v1/chat/completions/gemini-3-6-flash-openai/v1/chat/completions/gemini-3-7-flash-openai/v1/chat/completions
{
  "messages": [{"role": "user", "content": "Извлеки факты из документа"}],
  "stream": true
}
POST/gemini/v1/models/gemini-3-7-flash:streamGenerateContentGemini Native

Нативный Gemini API с contents, Google Search, function declarations и thinking configuration.

/gemini/v1/models/gemini-3-flash:streamGenerateContent/gemini/v1/models/gemini-3-5-flash:streamGenerateContent/gemini/v1/models/gemini-3-6-flash:streamGenerateContent/gemini/v1/models/gemini-3-7-flash:streamGenerateContent
{
  "contents": [{"role": "user", "parts": [{"text": "Привет!"}]}],
  "generationConfig": {
    "thinkingConfig": {"includeThoughts": true, "thinkingLevel": "high"}
  }
}
Chat Completions / Responses

GPT

gpt-5-2 · gpt-5-4 · gpt-5-5 · gpt-5-6-luna · gpt-5-6-terra · gpt-5-6-sol

Messages API

Claude

Haiku 4.5 · Sonnet 4.5/4.6/5 · Opus 4.5/4.6/4.7/4.8/5 · Fable 5

Responses API

Codex

gpt-5-codex · gpt-5.1-codex · gpt-5.2-codex · gpt-5.3-codex · gpt-5.4-codex

OpenAI-compatible / Native

Gemini

2.5 Pro/Flash · 3 Pro · 3.1 Pro · 3/3.5/3.6/3.7 Flash

Responses API

Grok

grok-4-3 · grok-4-5 · grok-4-6

Доступ

Все перечисленные модели доступны с одним API-ключом. Для общих Responses и Messages endpoints обязательно передавайте точный идентификатор в поле model.

Установите stream: true, чтобы получать ответ по мере генерации. Поток передаётся через Server-Sent Events без промежуточной буферизации.

const response = await fetch("https://llm.msofter.com/codex/v1/responses", {
  method: "POST",
  headers: {
    "Authorization": "Bearer " + process.env.LLM_API_KEY,
    "Content-Type": "application/json"
  },
  body: JSON.stringify({ model: "gpt-5-6-luna", input: "Привет", stream: true })
});

for await (const chunk of response.body) {
  process.stdout.write(new TextDecoder().decode(chunk));
}
400Некорректный запрос или модель
401Неверный либо отсутствующий API-ключ
402Исчерпан месячный бюджет кредитов
413Тело запроса превышает 10 МБ
429Превышен минутный или суточный лимит
502Модель временно недоступна
{
  "error": {
    "message": "Request limit exceeded",
    "type": "rate_limit_error",
    "code": "rpm_limit_exceeded"
  }
}

Максимальный размер запроса — 10 МБ, ответа — 20 МБ. Тайм-аут обычного запроса — 10 минут, потокового — 60 минут. Автоматические повторы POST-запросов не выполняются.