Как выбрать модель по цене: практическое сравнение котировок Протока
Практическое сравнение котировок моделей Протока: как считать стоимость входных и выходных токенов, выбрать модель под задачу и подключить её через совместимый API.
Выбор модели для API — это не только вопрос качества ответа. На итоговую стоимость влияют объём входного контекста, длина вывода и частота запросов. Поэтому сравнивать модели полезно по структуре расходов: сколько стоит вход, сколько — выход и какая модель подходит под конкретную задачу.
В Протоке действует оплата по факту за каждый запрос. Подключение к OpenAI-совместимым клиентам и Anthropic SDK выполняется через адрес https://dualchat.pro/v1.
Как устроена стоимость запроса
Котировка состоит из двух частей:
- входные токены — системные инструкции, история диалога, документы и текст запроса;
- выходные токены — ответ модели.
Если приложение отправляет большой контекст, цена входа становится особенно важной. Если модель генерирует длинные ответы, сильнее влияет стоимость выхода. Формула простая:
стоимость = входные токены / 1 000 000 × цена входа
+ выходные токены / 1 000 000 × цена выхода
Например, запрос с 100 000 входных и 10 000 выходных токенов к GPT-6 Sol на котировках Протока на дату публикации обойдётся примерно в 2,04 ₽: 1,36 ₽ за вход и 0,68 ₽ за выход.
Котировки моделей на дату публикации
Ниже указаны цены Протока на дату публикации, в рублях за 1 млн токенов.
| Модель | Вход | Выход | |---|---:|---:| | the model 5 | 88,00 ₽ | 440,00 ₽ | | the model 5.5 | 64,27 ₽ | 322,34 ₽ | | the model 4.8 | 134,48 ₽ | 674,34 ₽ | | the model 5.5 | 60,60 ₽ | 303,00 ₽ | | the model 4.6 | 93,23 ₽ | 466,15 ₽ | | the model 5 | 48,45 ₽ | 242,25 ₽ | | GPT-6 Sol | 13,60 ₽ | 67,98 ₽ | | GPT-5.6 Terra | 7,58 ₽ | 45,45 ₽ |
Самая низкая котировка в таблице — у GPT-5.6 Terra: 7,58 ₽ за 1 млн входных и 45,45 ₽ за 1 млн выходных токенов на дату публикации. У GPT-6 Sol вход стоит 13,60 ₽, а выход — 67,98 ₽ за 1 млн токенов на дату публикации.
В таблице есть повторяющиеся отображаемые названия с разными котировками. Перед подключением такой строки проверьте актуальное название и slug в разделе котировок Протока.
Что выбрать для разных сценариев
Большой объём запросов
Для классификации, извлечения полей, маршрутизации обращений и других массовых операций важна цена входа. Начать можно с GPT-5.6 Terra: на дату публикации вход стоит 7,58 ₽ за 1 млн токенов, а выход — 45,45 ₽.
Если приложению нужна другая модель, можно протестировать GPT-6 Sol. Его входная котировка составляет 13,60 ₽, выходная — 67,98 ₽ за 1 млн токенов на дату публикации.
Длинные ответы и генерация контента
Когда основная нагрузка приходится на выходные токены, смотрите прежде всего на эту часть котировки. Среди указанных строк минимальная цена выхода — у the model 5 с котировкой 242,25 ₽ за 1 млн токенов на дату публикации. У двух строк the model 5.5 указаны значения 303,00 ₽ и 322,34 ₽.
Такая разница важна для сценариев, где модель формирует документы, отчёты, пояснения или программный код. Окончательный выбор лучше делать на собственных примерах: цена — только один параметр, а результат зависит от задачи и промпта.
Большой контекст и длинные ответы
Для запросов с большим объёмом входных и выходных токенов заранее сравните обе части котировки. Например, у the model 4.8 на дату публикации указаны 134,48 ₽ за вход и 674,34 ₽ за выход на 1 млн токенов. При регулярной нагрузке такая разница заметно влияет на бюджет.
Как сравнить стоимость на своей нагрузке
Для точного сравнения зафиксируйте четыре показателя:
- среднее число входных токенов;
- среднее число выходных токенов;
- количество запросов в день или месяц;
- долю запросов с длинным контекстом.
Допустим, сервис отправляет 50 000 запросов в месяц. Каждый запрос содержит 8 000 входных токенов и генерирует 1 500 выходных. Общий объём составит 400 млн входных и 75 млн выходных токенов. Для GPT-5.6 Terra расчёт на дату публикации будет таким:
400 × 7,58 ₽ + 75 × 45,45 ₽ = 6 440,75 ₽
Для GPT-6 Sol тот же объём составит:
400 × 13,60 ₽ + 75 × 67,98 ₽ = 10 538,50 ₽
Для точных значений используйте фактическое количество токенов из логов приложения.
Подключение через OpenAI-совместимый API
В существующем клиенте достаточно заменить base_url, ключ и значение model. Ключ вида sk-dc-… создаётся в кабинете в разделе «Ключи».
client = OpenAI(
api_key="sk-dc-…",
base_url="https://dualchat.pro/v1"
)
response = client.chat.completions.create(
model="gpt-6-sol",
messages=[
{"role": "system", "content": "Отвечай кратко и по существу."},
{"role": "user", "content": "Составь план проверки API-интеграции."}
]
)
В параметре model указывается slug модели латиницей — так, как он приведён в котировках. Для GPT-6 Sol это gpt-6-sol, для GPT-5.6 Terra — gpt-5.6-terra. Для остальных строк используйте slug из актуального списка Протока.
Как снизить расходы
Сначала измерьте токены, а затем настройте маршрутизацию запросов. Полезно:
- сокращать повторяющиеся инструкции;
- ограничивать ненужную историю диалога;
- задавать разумный лимит ответа;
- использовать кэширование промптов для повторяющегося контекста;
- сравнивать цену и долю успешных ответов.
В Протоке поддерживаются стриминг, кэширование промптов, эмбеддинги, изображения, видео и аудио. Пополнять баланс можно картой онлайн, по счёту для организации или через СБП. Списание выполняется по факту за каждый запрос.
Вывод
Для массовых операций начните с GPT-5.6 Terra или GPT-6 Sol. Для длинных ответов сравните строки с минимальной ценой выхода и проверьте результат на собственной выборке. Окончательное решение принимайте по формуле «вход плюс выход» и фактическому объёму токенов.
Посмотрите актуальные котировки и подключите нужную модель в Протоке: https://dualchat.pro?utm_source=blog&utm_medium=article&utm_campaign=kak-vybrat-model-po-cene