qadesk.ru / Платформы и стек / OpenAI-совместимый LLM
ИИ и LLM

OpenAI-совместимый API — провайдера выбираете вы

Требование к провайдеру ровно одно — ручка /chat/completions в формате OpenAI. Дальше это ваш выбор и ваш договор: адрес, модель и ключ задаются на пространство, счёт идёт мимо нас.

Одно требование вместо списка партнёров

QA Деск не привязан к конкретному поставщику модели. Подойдёт любой сервис с OpenAI-совместимым /chat/completions: облачный провайдер, шлюз внутри компании, локальный сервер. Адрес API, модель и ключ задаются на пространство — у каждого заказчика они свои.

Такая развязка сделана намеренно. Список «партнёрских» моделей устаревает за квартал, а совместимость по формату запроса держится годами и не требует от нас релиза каждый раз, когда вы решили сменить поставщика.

Настройка

Настройки → ИИ-помощник:

  • Провайдер — пресет (DeepSeek, OpenAI) или «Свой»;
  • Адрес API — база без хвостового слэша, /chat/completions дописывается сам. Например https://api.openai.com/v1;
  • Модель — строка, которую понимает ваш провайдер (gpt-4o-mini, deepseek-chat, qwen2.5:7b — что угодно);
  • Ключ — если сервер его требует; для локальных серверов подойдёт любая строка;
  • Название — как помощник будет подписан в интерфейсе.

При сохранении выполняется живой запрос. Подключение не сохранится, пока провайдер не ответил, а отказ приходит разобранным: неверный ключ, недостаточно средств, лимит запросов, нет такой модели, сервер недоступен, ответ не в формате. «Настроено» без «работает» в продукте не бывает — это отдельное правило, а не удачное совпадение.

Что делает помощник

Две функции, обе синхронные и обе с человеком в контуре:

  • варианты названия дефекта по его описанию;
  • черновик тест-кейса из требования — предусловия, шаги, ожидаемый результат.

Ничего не подставляется само и никуда не отправляется без действия пользователя.

Куда это подключают на практике

  • Облачный провайдер напрямую — самый быстрый путь: ключ, адрес, проверка, готово. Подходит, если тексты дефектов не содержат ничего чувствительного.
  • Внутренний шлюз компании. Во многих организациях доступ к моделям уже проксируется через собственный сервис с квотами и журналированием — он и указывается как адрес API.
  • Локальная модель. Периметр не покидается вовсе, см. vLLM и Ollama.

Во всех трёх случаях настройка одна и та же и делается на пространство: у разных заказчиков в одной инсталляции могут быть разные провайдеры.

Оплата и учёт

Счёт вы получаете от провайдера, а не от нас: никакой внутренней валюты, пакетов «коинов» и наценки сверху. На карточке подключения видно число генераций за 30 дней и последний вызов — время, функция, исход, токены. Этого достаточно, чтобы сверить наш счётчик со счётом провайдера и вовремя заметить, что функция перестала работать.

Что уходит наружу

Только текст конкретной функции: описание дефекта или текст требования. Не уходят вложения, состав пространства и содержимое других проектов. Помощник по умолчанию выключен — пока провайдер не подключён, наружу не уходит вообще ничего.

Если по регламенту тексты не должны покидать контур — поставьте модель рядом с сервисом: vLLM и Ollama подключаются тем же полем «Адрес API».

Чего в продукте нет

  • нет поддержки провайдеров с собственным несовместимым протоколом: формат запроса должен быть как у OpenAI;
  • нет нескольких провайдеров одновременно в одном пространстве — один активный, чтобы счёт и поведение были предсказуемы;
  • нет агентного режима «модель сама правит данные»: для работы агента с дефектами есть MCP, и там действует человек и его права.

С чего начать

  1. Проверьте, что у выбранного провайдера есть /v1/chat/completions в формате OpenAI.
  2. Подключите его и дождитесь зелёной живой проверки.
  3. Через неделю сверьте счётчик генераций со счётом провайдера — так вы поймёте реальную стоимость функции для вашей команды.

Попробуйте на своём проекте

Заведите проект, загрузите первый отчёт или заведите первый дефект — бесплатный тариф без карты. Нужно демо на ваших сценариях — напишите на hello@qadesk.ru.

Создать проект