Какую модель выбрать
Ассистент работает с любой моделью, которую отдаёт выбранный провайдер, — выбор за вами. Чтобы этот выбор был осознанным, мы прогнали несколько популярных моделей на одинаковом наборе типовых вопросов и собрали результаты в одну таблицу: что отвечают, как быстро и во сколько это обходится.
Проверка проведена в августе 2026 года. Модели и цены у провайдеров меняются быстро, поэтому смотрите на порядок величин и на принципы выбора, а не на конкретные цифры.
Как проверяли
Заголовок раздела «Как проверяли»Один и тот же набор из двенадцати вопросов, какие обычно задаёт пользователь PrintWizard: с чего начать первую печатную форму, как вывести QR-код и сумму прописью, как настроить формат числа и перенос строки в ячейке, как напечатать пачку документов, как работать с наборами данных и соединениями, что нужно для печати в Word. Отдельный вопрос — о возможности, которой в PrintWizard нет: он проверяет, признает ли ассистент отсутствие функции вместо того, чтобы придумать несуществующие настройки.
Каждый ответ оценивали по трём признакам: получил ли пользователь ответ вообще, опирается ли ответ на документацию продукта и попадает ли он в суть вопроса.
Все модели прогонялись через одного провайдера — российский агрегатор RouterAI, чтобы условия были одинаковыми. Дополнительно одну модель прогнали ещё и напрямую у поставщика: что дал этот замер — в разделе Провайдеры.
Результаты
Заголовок раздела «Результаты»| Модель | Отвечает | Время ответа | Расход на вопрос | Стоимость вопроса |
|---|---|---|---|---|
deepseek/deepseek-v4-flash-0731 | на все 12 | ~36 с | ~19 тыс. токенов | ~0,17 ₽ |
openai/gpt-5.6-luna | на все 12 | ~31 с | ~12 тыс. токенов | ~0,15 ₽ |
qwen/qwen3.7-flash | на 11 из 12 | ~41 с | ~28 тыс. токенов | ~0,09 ₽ |
openai/gpt-5.6-luna-pro | на все 12 | ~39 с | ~55 тыс. токенов | ~0,69 ₽ |
Идентификаторы приведены так, как они записаны в каталоге RouterAI: у агрегаторов
имя модели обычно с префиксом поставщика, при прямом подключении префикса нет
(gpt-5.6-luna). У DeepSeek проверялся датированный снимок модели — -0731;
без суффикса это отдельная строка каталога.
Время и расход — средние по двенадцати вопросам, все четыре замера сделаны через одного провайдера. Стоимость посчитана по тарифам RouterAI на момент проверки: у других провайдеров цифры отличаются, соотношение примерно сохраняется.
Чем модели отличаются по существу:
- deepseek-v4-flash даёт самые подробные ответы: раскладывает настройки по шагам, оформляет таблицами перечни реквизитов и допустимых значений. Если нужен разбор с деталями — это лучший выбор.
- gpt-5.6-luna отвечает короче и точнее по формулировке, заметно быстрее остальных и лучше справляется с вопросами, на которые в документации нет прямого ответа: собирает ответ из соседних разделов, а не пересказывает ближайший.
- qwen3.7-flash отвечает в целом верно, но тратит заметно больше обращений к документации: в среднем четыре с половиной круга поиска против двух-трёх у остальных. На одном вопросе из двенадцати он так и не собрал ответ — перебирал разделы, пока не упёрся в лимит обращений. Отсюда и самый большой расход токенов, и самое долгое ожидание.
- gpt-5.6-luna-pro на нашем наборе вопросов по содержанию ответов от обычной версии не отличается, но расходует в четыре с половиной раза больше токенов и отвечает дольше. Переплачивать за неё для работы с ассистентом смысла нет.
Сколько это стоит на практике
Заголовок раздела «Сколько это стоит на практике»Ориентир: при активном использовании — десять вопросов в рабочий день — за месяц выходит примерно 20–40 рублей. Разовые вопросы обходятся в доли рубля.
Расход зависит не только от модели, но и от вопроса: если ассистенту хватает одного обращения к документации, вопрос стоит дешевле, чем когда он перебирает несколько разделов. Общая закономерность: чем точнее сформулирован вопрос, тем дешевле и быстрее ответ.
Что выбрать
Заголовок раздела «Что выбрать»- Если не хотите разбираться — оставьте предустановленную модель. Она подобрана как разумный компромисс между качеством, ценой и доступностью.
- Если важна скорость и краткость ответов — попробуйте
gpt-5.6-luna. - Если важна подробность и разбор по шагам —
deepseek-v4-flash. - Если хотите минимальную цену — подойдёт
qwen3.7-flash, с поправкой на то, что на сложном вопросе он может так и не дойти до ответа.
Модель меняется в настройках ассистента в любой момент и выбирается из каталога вашего провайдера — переключиться и сравнить самому недолго.
Если выбираете другую модель
Заголовок раздела «Если выбираете другую модель»Каталог провайдера обычно содержит десятки моделей. На что смотреть:
- Поддержка вызова инструментов. Ассистент ищет ответы во встроенной документации, а для этого модель должна уметь вызывать инструменты. Модели без такой поддержки будут отвечать «из общих знаний» и чаще ошибаться в том, что касается самого PrintWizard. Те, про которые провайдер прямо сообщил, что инструментов нет, ассистент в список не выводит, — но такие сведения отдаёт не каждый каталог, поэтому проверить всё за вас он не может.
- Размер контекста. Берите от 64 тысяч токенов. Сегодня запрос ассистента укладывается в 25 тысяч даже на самых объёмных вопросах — он передаёт модели только подобранные разделы документации. Но набор инструментов будет расширяться: чтение кода макета и структуры метаданных даст заметно больше контекста, и запас пригодится.
- «Думающие» модели. Модели с режимом рассуждений тратят на ответ больше времени и токенов. Ассистент по возможности отключает этот режим сам, но если выбранная модель существует только в «думающем» варианте, ответы будут дороже.
- Версии pro и max. Более дорогая версия той же модели редко даёт заметно лучший ответ на вопросы по продукту — сравните сами, прежде чем переплачивать.
Провайдеры
Заголовок раздела «Провайдеры»Все перечисленные модели доступны через нескольких провайдеров сразу. Российские агрегаторы (в списке провайдеров они отмечены) работают без VPN и принимают оплату в рублях; прямые подключения к зарубежным сервисам требуют VPN и зарубежной карты.
Мы прогнали один и тот же набор вопросов на модели gpt-5.6-luna двумя путями —
напрямую у поставщика и через агрегатор. Результаты полезно знать заранее:
- Объём запроса одинаковый. Разница составила меньше процента: посредник ничего не добавляет к тому, что уходит модели.
- Ответы те же. Полнота и формулировки не изменились: агрегатор передаёт запрос модели как есть.
- Через агрегатор немного дольше. Ответы приходили примерно на треть медленнее — 31 секунда против 23 — на практике это несколько секунд на вопрос.
- Кэш может срабатывать хуже. Каждый следующий запрос ассистента начинается с того же, что и предыдущий, — инструкции и уже подобранные разделы документации, — а провайдеры тарифицируют такое повторное начало заметно дешевле. Напрямую из кэша обслужилось около 88 % входных токенов, через агрегатор на той же модели — около 57 %. Объём запроса от этого не меняется, а счёт — да. Это один прогон, и на кэш влияет много обстоятельств, но при сравнении провайдеров держите в уме: низкая цена за тысячу токенов может съедаться худшим попаданием в кэш.
Если расход важен, сравните тарифы в каталоге своего провайдера: ассистент показывает баланс и расход токенов после каждого ответа, включая обслуженные из кэша.
Отдельно стоит помнить: у одной модели в каталоге бывает несколько строк —
обычная версия и pro, а иногда ещё и датированные снимки вроде -0731. Названия
похожи, а расход отличается в разы — сверяйте не только семейство модели, но и
точный идентификатор целиком.
Что дальше
Заголовок раздела «Что дальше»- Ассистент — подключение, ключ API, проверка соединения и настройка провайдера.