Перейти к содержимому

Какую модель выбрать

Ассистент работает с любой моделью, которую отдаёт выбранный провайдер, — выбор за вами. Чтобы этот выбор был осознанным, мы прогнали несколько популярных моделей на одинаковом наборе типовых вопросов и собрали результаты в одну таблицу: что отвечают, как быстро и во сколько это обходится.

Проверка проведена в августе 2026 года. Модели и цены у провайдеров меняются быстро, поэтому смотрите на порядок величин и на принципы выбора, а не на конкретные цифры.

Один и тот же набор из двенадцати вопросов, какие обычно задаёт пользователь PrintWizard: с чего начать первую печатную форму, как вывести QR-код и сумму прописью, как настроить формат числа и перенос строки в ячейке, как напечатать пачку документов, как работать с наборами данных и соединениями, что нужно для печати в Word. Отдельный вопрос — о возможности, которой в PrintWizard нет: он проверяет, признает ли ассистент отсутствие функции вместо того, чтобы придумать несуществующие настройки.

Каждый ответ оценивали по трём признакам: получил ли пользователь ответ вообще, опирается ли ответ на документацию продукта и попадает ли он в суть вопроса.

Все модели прогонялись через одного провайдера — российский агрегатор RouterAI, чтобы условия были одинаковыми. Дополнительно одну модель прогнали ещё и напрямую у поставщика: что дал этот замер — в разделе Провайдеры.

МодельОтвечаетВремя ответаРасход на вопросСтоимость вопроса
deepseek/deepseek-v4-flash-0731на все 12~36 с~19 тыс. токенов~0,17 ₽
openai/gpt-5.6-lunaна все 12~31 с~12 тыс. токенов~0,15 ₽
qwen/qwen3.7-flashна 11 из 12~41 с~28 тыс. токенов~0,09 ₽
openai/gpt-5.6-luna-proна все 12~39 с~55 тыс. токенов~0,69 ₽

Идентификаторы приведены так, как они записаны в каталоге RouterAI: у агрегаторов имя модели обычно с префиксом поставщика, при прямом подключении префикса нет (gpt-5.6-luna). У DeepSeek проверялся датированный снимок модели — -0731; без суффикса это отдельная строка каталога.

Время и расход — средние по двенадцати вопросам, все четыре замера сделаны через одного провайдера. Стоимость посчитана по тарифам RouterAI на момент проверки: у других провайдеров цифры отличаются, соотношение примерно сохраняется.

Чем модели отличаются по существу:

  • deepseek-v4-flash даёт самые подробные ответы: раскладывает настройки по шагам, оформляет таблицами перечни реквизитов и допустимых значений. Если нужен разбор с деталями — это лучший выбор.
  • gpt-5.6-luna отвечает короче и точнее по формулировке, заметно быстрее остальных и лучше справляется с вопросами, на которые в документации нет прямого ответа: собирает ответ из соседних разделов, а не пересказывает ближайший.
  • qwen3.7-flash отвечает в целом верно, но тратит заметно больше обращений к документации: в среднем четыре с половиной круга поиска против двух-трёх у остальных. На одном вопросе из двенадцати он так и не собрал ответ — перебирал разделы, пока не упёрся в лимит обращений. Отсюда и самый большой расход токенов, и самое долгое ожидание.
  • gpt-5.6-luna-pro на нашем наборе вопросов по содержанию ответов от обычной версии не отличается, но расходует в четыре с половиной раза больше токенов и отвечает дольше. Переплачивать за неё для работы с ассистентом смысла нет.

Ориентир: при активном использовании — десять вопросов в рабочий день — за месяц выходит примерно 20–40 рублей. Разовые вопросы обходятся в доли рубля.

Расход зависит не только от модели, но и от вопроса: если ассистенту хватает одного обращения к документации, вопрос стоит дешевле, чем когда он перебирает несколько разделов. Общая закономерность: чем точнее сформулирован вопрос, тем дешевле и быстрее ответ.

  • Если не хотите разбираться — оставьте предустановленную модель. Она подобрана как разумный компромисс между качеством, ценой и доступностью.
  • Если важна скорость и краткость ответов — попробуйте gpt-5.6-luna.
  • Если важна подробность и разбор по шагамdeepseek-v4-flash.
  • Если хотите минимальную цену — подойдёт qwen3.7-flash, с поправкой на то, что на сложном вопросе он может так и не дойти до ответа.

Модель меняется в настройках ассистента в любой момент и выбирается из каталога вашего провайдера — переключиться и сравнить самому недолго.

Каталог провайдера обычно содержит десятки моделей. На что смотреть:

  • Поддержка вызова инструментов. Ассистент ищет ответы во встроенной документации, а для этого модель должна уметь вызывать инструменты. Модели без такой поддержки будут отвечать «из общих знаний» и чаще ошибаться в том, что касается самого PrintWizard. Те, про которые провайдер прямо сообщил, что инструментов нет, ассистент в список не выводит, — но такие сведения отдаёт не каждый каталог, поэтому проверить всё за вас он не может.
  • Размер контекста. Берите от 64 тысяч токенов. Сегодня запрос ассистента укладывается в 25 тысяч даже на самых объёмных вопросах — он передаёт модели только подобранные разделы документации. Но набор инструментов будет расширяться: чтение кода макета и структуры метаданных даст заметно больше контекста, и запас пригодится.
  • «Думающие» модели. Модели с режимом рассуждений тратят на ответ больше времени и токенов. Ассистент по возможности отключает этот режим сам, но если выбранная модель существует только в «думающем» варианте, ответы будут дороже.
  • Версии pro и max. Более дорогая версия той же модели редко даёт заметно лучший ответ на вопросы по продукту — сравните сами, прежде чем переплачивать.

Все перечисленные модели доступны через нескольких провайдеров сразу. Российские агрегаторы (в списке провайдеров они отмечены) работают без VPN и принимают оплату в рублях; прямые подключения к зарубежным сервисам требуют VPN и зарубежной карты.

Мы прогнали один и тот же набор вопросов на модели gpt-5.6-luna двумя путями — напрямую у поставщика и через агрегатор. Результаты полезно знать заранее:

  • Объём запроса одинаковый. Разница составила меньше процента: посредник ничего не добавляет к тому, что уходит модели.
  • Ответы те же. Полнота и формулировки не изменились: агрегатор передаёт запрос модели как есть.
  • Через агрегатор немного дольше. Ответы приходили примерно на треть медленнее — 31 секунда против 23 — на практике это несколько секунд на вопрос.
  • Кэш может срабатывать хуже. Каждый следующий запрос ассистента начинается с того же, что и предыдущий, — инструкции и уже подобранные разделы документации, — а провайдеры тарифицируют такое повторное начало заметно дешевле. Напрямую из кэша обслужилось около 88 % входных токенов, через агрегатор на той же модели — около 57 %. Объём запроса от этого не меняется, а счёт — да. Это один прогон, и на кэш влияет много обстоятельств, но при сравнении провайдеров держите в уме: низкая цена за тысячу токенов может съедаться худшим попаданием в кэш.

Если расход важен, сравните тарифы в каталоге своего провайдера: ассистент показывает баланс и расход токенов после каждого ответа, включая обслуженные из кэша.

Отдельно стоит помнить: у одной модели в каталоге бывает несколько строк — обычная версия и pro, а иногда ещё и датированные снимки вроде -0731. Названия похожи, а расход отличается в разы — сверяйте не только семейство модели, но и точный идентификатор целиком.

  • Ассистент — подключение, ключ API, проверка соединения и настройка провайдера.