Модели и цены
Какие модели доступны в WorkAI и сколько стоит запрос: списание идёт в WorkCoins по фактической стоимости токенов, а модель WorkAI Free работает без списаний.
WorkAI работает с моделями нескольких провайдеров, а расход по каждому запросу списывается во внутренней валюте — WorkCoins (Ⓦ). Списание считается по фактической стоимости запроса у провайдера, а не по числу «запросов» или сообщений. Дополнительно в списке моделей всегда есть пункт WorkAI Free — бесплатная открытая модель, которая не расходует Ⓦ вообще.
Актуальные рублёвые цены тарифов, стоимость коина и калькулятор «сколько запросов даёт N Ⓦ» живут на странице тарифов — здесь описана механика, которая за этими цифрами стоит.
Какие модели доступны
Каталог моделей одинаков для всех платных тарифов: тариф определяет только объём WorkCoins в месяц, а не набор моделей. Дорогая модель на младшем тарифе не заблокирована — она просто быстрее расходует баланс.
Ниже — модели Anthropic, OpenAI и xAI, для которых в докc уже есть отдельные страницы с деталями (ID, лимиты, для каких задач подходят). Каталог шире: помимо них, в списке моделей доступны Google Gemini и DeepSeek — актуальный полный список со стоимостью запроса смотрите на странице моделей.
Колонка «Класс» — это внутренний уровень стоимости модели (budget / standard / premium). Колонка «Контекст» — максимальное окно контекста модели.
Anthropic
| Модель | ID | Класс | Контекст | Максимум вывода |
|---|---|---|---|---|
| Sonnet 5 | claude-sonnet-5 | standard | 1M | 128K |
| Opus 5 | claude-opus-5 | premium | 1M | 128K |
| Opus 4.8 | claude-opus-4-8 | premium | 1M | 64K |
| Fable 5 | claude-fable-5 | premium | 1M | 128K |
| Haiku 4.5 | claude-haiku-4-5-20251001 | budget | 200K | 64K |
OpenAI
| Модель | ID | Класс | Контекст | Максимум вывода |
|---|---|---|---|---|
| GPT-5.6 Sol | gpt-5.6 | premium | 1M | 128K |
| GPT-5.6 Terra | gpt-5.6-terra | standard | 1M | 128K |
| GPT-5.6 Luna | gpt-5.6-luna | standard | 1M | 128K |
| GPT-5.4 | gpt-5.4 | premium | 1M | 128K |
| GPT-5.3 Codex | gpt-5.3-codex | premium | 400K | 128K |
| GPT-5.4 Mini | gpt-5.4-mini | standard | 400K | 128K |
| GPT-5.4 Nano | gpt-5.4-nano | budget | 400K | 128K |
| GPT-4.1 | gpt-4.1 | standard | 1M | 32K |
xAI
| Модель | ID | Класс | Контекст | Максимум вывода |
|---|---|---|---|---|
| Grok 4.3 | grok-4.3 | standard | 1M | 32K |
| Grok 4.20 Reasoning | grok-4.20-reasoning | standard | 1M | 32K |
| Grok 4.20 Fast | grok-4.20-fast | standard | 1M | 32K |
| Grok Build 0.1 | grok-build-0.1 | budget | 256K | 32K |
Каталог меняется: модели, которые провайдер снял с обслуживания или которые заменены более новой версией, убираются из списка выбора. Так уже произошло с Opus 4.6 и Opus 4.7 — их нет в выборе, но старые записи об их использовании и расчёт по ним сохраняются.

Какую модель выбрать под задачу
Если не хочется разбираться — берите Sonnet 5: это универсальный выбор для большинства задач разработки (в режиме «Создатель» WorkAI работает именно на ней). Дальше имеет смысл двигаться только от конкретной причины: не хватает качества на сложной задаче — вверх, задача простая и повторяемая — вниз. Если модель не выбрана явно, запрос уходит в режим Auto.
| Задача | Разумный выбор | Почему |
|---|---|---|
| Повседневная работа с кодом: рефакторинг, code review, тесты, работа с API | Sonnet 5 | Средний класс стоимости, полный набор возможностей — рассуждения, кэш, изображения и PDF, вызов инструментов |
| Сложная архитектура, долгая агентная задача, разбор запутанного бага | Opus 5, Opus 4.8, Fable 5, GPT-5.6 Sol, GPT-5.4 | Премиум-класс: глубже рассуждают и дольше держат задачу, но и расход заметно выше |
| Агентное написание и правка файлов | GPT-5.3 Codex, Grok Build 0.1 | Модели, специально обученные на задачах агентного кодирования |
| Быстрые вопросы, документация, краткие пересказы | Haiku 4.5, GPT-5.4 Nano, GPT-5.6 Luna | Бюджетные и быстрые; окна меньше, но для коротких задач этого хватает |
| Много однотипных вызовов инструментов, где важна задержка | Grok 4.20 Fast, GPT-4.1 | Работают без режима рассуждений — отвечают быстрее и не тратят токены на размышления |
| Нужно строгое следование инструкциям без «фантазии» | Grok 4.20 Reasoning, GPT-4.1 | Ставка на предсказуемость вывода и надёжный вызов инструментов |
Два практических правила. Первое: модель можно менять посреди диалога — история сохранится, так что начинать с дешёвой и переключаться на дорогую, когда задача не поддалась, вполне рабочая тактика. Второе: если задача упирается не в интеллект модели, а в объём материала, дешевле дать агенту точный контекст (см. Контекст и Правила), чем брать модель дороже.
Что означает класс модели
Класс (budget / standard / premium) — это ранжирование внутри каталога одного провайдера, а не общая шкала цен. Сравнивать классы между провайдерами нельзя: например, Sonnet 5 и GPT-5.4 Mini обе относятся к standard, но по цене за миллион токенов вывода Sonnet заметно дороже.
То же и внутри одной линейки. GPT-5.6 Luna формально в том же классе, что и GPT-5.6 Terra, но фактически это самая дешёвая модель линейки 5.6 — на уровне GPT-5.4 Nano ($0.20 за миллион токенов входа и $1.20 за миллион токенов вывода против $2 и $12 у Terra). Grok 4.3, Grok 4.20 Reasoning и Grok 4.20 Fast стоят одинаково ($1.25 / $2.50 за миллион токенов) — деление между ними идёт по глубине задачи, а не по цене.
Класс отвечает на вопрос «лёгкая, средняя или тяжёлая модель у этого провайдера», а не «сколько будет стоить запрос» — для второго есть калькулятор на странице тарифов.
Как считаются WorkCoins
Формула одна: WorkCoins = стоимость запроса в долларах × курс коина. Курс задаётся централизованно и учитывает курс рубля.
Что важно знать про сам расчёт:
- Списание идёт по факту, после ответа модели. Перед запросом WorkAI только проверяет, что баланс положительный, но ничего не резервирует. Поэтому точная цена запроса заранее неизвестна — она зависит от того, сколько токенов реально ушло и вернулось.
- Разные части запроса стоят по-разному. Отдельно считаются некэшированный вход, чтение из кэша, запись в кэш и вывод модели. Чтение из кэша обычно на порядок дешевле обычного входа — поэтому длинный диалог по одному и тому же проекту стоит меньше, чем кажется по объёму контекста.
- Токены рассуждений — это вывод. У моделей с reasoning внутренние рассуждения тарифицируются как выходные токены, даже если вы их не видите. Более глубокий режим рассуждений стоит дороже при том же вопросе.
- Внутри система считает с точностью до 0.0001 Ⓦ, а в личном кабинете суммы показываются округлёнными до сотых — поэтому у совсем дешёвых запросов в истории может стоять
0,00 Ⓦ.
Во входные токены попадает не только текст вашего сообщения: туда же идут системные инструкции, ваши правила, прикреплённые файлы и изображения, вся предыдущая переписка этого чата и результаты работы инструментов — каждый прочитанный агентом файл и вывод каждой команды остаются в истории и оплачиваются в следующих запросах тоже. Поэтому длинная агентная сессия по большому проекту стоит дороже одиночного вопроса той же модели.
Списывается всё это из одного баланса, но по порядку: сначала бонусные коины, затем тарифные, затем докупленные, и только последним — перерасход, если вы его включили.
Средний запрос в калькуляторе на странице тарифов — это примерно 2000 токенов контекста и 800 токенов ответа. Ваш реальный расход будет выше на больших проектах и ниже на коротких вопросах.
Почему один и тот же запрос стоит по-разному
Основных причин четыре:
- Длина контекста. Чем больше файлов и истории диалога видит модель, тем больше входных токенов.
- Попадание в кэш. Повторные запросы по тому же контексту частично оплачиваются по льготной ставке чтения кэша.
- Глубина рассуждений. Reasoning-режимы генерируют дополнительные токены вывода.
- Очень длинный контекст у части моделей OpenAI. У GPT-5.4 и у всех трёх моделей GPT-5.6 (Sol, Terra, Luna) после 272 000 токенов входа в одном запросе включается повышенная ставка: вход дорожает вдвое, вывод — в полтора раза. У остальных моделей OpenAI — GPT-5.4 Mini, GPT-5.4 Nano, GPT-5.3 Codex, GPT-4.1 — такой надбавки нет, у них единая ставка на всё окно. У моделей Anthropic и xAI её нет тоже: ставка одинакова на всём окне, включая 1M.
Как настроить глубину рассуждений и окно контекста
У моделей есть переключатели прямо в панели выбора модели — они влияют и на качество, и на расход:
- Reasoning. У моделей Anthropic с адаптивным мышлением доступны None / Low / Medium / High, а у Opus 4.8, Opus 5 и Fable 5 — дополнительно Max; по умолчанию Medium. У Haiku 4.5 выбор проще: рассуждения включены или выключены. У OpenAI набор уровней свой: у GPT-5.6, GPT-5.4 — Low / Medium / High / Extra High, у GPT-5.4 Mini и Nano — Minimal / Low / Medium / High, у GPT-5.3 Codex — Low / Medium / High без возможности выключить рассуждения совсем. У xAI глубину принимает только Grok 4.3 (None / Low / Medium / High, по умолчанию High); у остальных моделей Grok переключателя нет — они рассуждают внутри себя, но настроить это нельзя, и WorkAI намеренно не показывает выбор там, где провайдер его не поддерживает.
- Context. Переключатель задаёт локальный лимит окна: с какого объёма WorkAI начинает сжимать историю диалога. У моделей Anthropic с окном 1M это 200K (по умолчанию) или 1M, у Haiku 4.5 — 100K или 200K (по умолчанию). У моделей OpenAI — 272K по умолчанию и 1M либо 400K вторым пунктом.
- Pro-режим. Есть только у моделей GPT-5.6 и работает, когда рассуждения включены. Он не меняет ставку за токен, но заметно увеличивает расход Ⓦ за счёт большего числа токенов рассуждений.
- Processing mode. Режим обработки на стороне OpenAI: Default, Flex и Priority. Здесь меняется именно ставка за токен: Flex примерно вдвое дешевле обычной обработки, но может отвечать дольше, Priority — примерно вдвое дороже и быстрее. Набор пунктов зависит от модели.
У Anthropic сам переключатель Context на цену токена не влияет — наценки за длинный контекст там нет. У моделей OpenAI из списка выше выбор большого окна сам по себе тоже ничего не стоит, но если запрос реально перевалит за 272 000 токенов входа, включится повышенная ставка (см. раздел выше).
Что такое контекстное окно и что происходит, когда оно заканчивается
Контекстное окно — это максимальный объём, который модель может держать перед глазами в одном запросе: ваше сообщение, история чата, файлы, инструкции и результаты инструментов вместе. В таблицах выше это колонка «Контекст», и измеряется он в токенах (грубо — несколько символов текста на токен).
Диалог не обрывается, когда окно заполняется. Незадолго до потолка WorkAI сжимает историю сам:
- у моделей Anthropic Opus 5, Opus 4.8 и Sonnet 5 старая часть диалога заменяется связным пересказом: что за задача, какие решения приняты, какие файлы смотрели, какой следующий шаг. Пересказ пишет сама модель;
- у остальных моделей, включая Haiku 4.5, сжатие проще: из истории вычищаются рассуждения и старые вызовы инструментов (последние около десяти пар вызовов сохраняются), а если и этого мало — отбрасываются самые давние ходы диалога.
Пока идёт сжатие, в чате видна строка «Контекст сжат, продолжаю ответ…», а после в переписке остаётся пометка «История диалога сжата для соблюдения лимита контекста» — её видно и когда вы вернётесь к этому чату позже. Модальных окон и остановки работы здесь нет: запрос продолжается автоматически.
Сжатую память WorkAI хранит на вашей машине и после перезапуска редактора — заново платить за сжатие того же диалога не придётся. При переключении модели посреди диалога пересказ тоже сохраняется: он переводится в обычный текст, понятный любой модели.
Сжать историю можно и вручную — отправьте в чат команду /compact. Это полезно, когда диалог уже разросся, а вы собираетесь задать большой новый вопрос и не хотите платить за перевоз всей предыдущей переписки.
Что при этом теряется: подробности. Пересказ сохраняет задачу, решения и имена файлов, но точные формулировки старых сообщений из него уходят. Если для дальнейшей работы важна конкретная деталь из начала диалога — повторите её в новом сообщении или начните новый чат.
Момент, с которого начинается сжатие, задаёт переключатель Context (см. раздел выше): больший лимит — реже сжатие и больше сохранённого контекста, но и больше входных токенов в каждом запросе.
Где посмотреть, сколько списалось
Текущий баланс всегда виден в строке состояния редактора — значок с числом Ⓦ. Наведите на него, чтобы увидеть разбивку по источникам (тариф, бонус, купленные, долг по перерасходу); клик открывает раздел оплаты.
Подробная история — в личном кабинете, в разделах «Обзор» и «Оплата». По каждому запросу видно дату, модель, режим, долю попаданий в кэш и списанную сумму в Ⓦ. Это же место отвечает на вопрос «почему сегодня ушло больше, чем вчера»: сравните модель и процент кэша у дорогих строк.
Что входит в тариф
Тарифы отличаются только объёмом WorkCoins в месяц: Free, Pro, Pro+, Business и Max. Каталог моделей, глубина рассуждений и размер контекста на всех платных тарифах одинаковы. Цены — на странице тарифов.
Оплата идёт напрямую в рублях: банковские карты и СБП, а также Apple Pay и Google Pay. Отдельного зарубежного платёжного шлюза и оплаты в валюте нет.
Неиспользованный остаток тарифного пула переносится на следующий месяц частично: при продлении подписки переносится до 500 Ⓦ, остальное сгорает. Бонусные и докупленные коины по этому правилу не сгорают — они лежат отдельным пулом.
Что даёт бесплатный аккаунт
При регистрации начисляется приветственный бонус (по умолчанию 500 Ⓦ). Начисляется он после подтверждения адреса почты — если баланс новый и нулевой, скорее всего письмо ещё не подтверждено, и WorkAI прямо скажет об этом вместо предложения оплатить тариф.
Пока на бесплатном аккаунте есть бонусный остаток, доступен полный каталог моделей. Через 30 дней приветственный период заканчивается, но неизрасходованные бонусные коины не сгорают — доступ к каталогу держится, пока они не потрачены. Дальше бесплатный аккаунт живёт так:
- когда бонусный остаток исчерпан, из списка моделей остаётся только режим Auto;
- после окончания приветственного периода бесплатному аккаунту с подтверждённой почтой раз в месяц пополняют бонусный остаток до 100 Ⓦ;
- WorkAI Free остаётся доступен всегда и не расходует коины вообще.
Тот же переход на Auto происходит, когда платная подписка закончилась и бонусный остаток израсходован. Докупленные пакеты коинов при этом не сгорают — но потратить их до продления подписки можно только в режиме Auto.
Что такое WorkAI Free
Это один пункт в списке моделей, за которым стоит открытая модель, выбранная платформой. Запросы к ней бесплатны — WorkCoins не списываются, свой ключ не нужен.
Конкретная модель за этим пунктом меняется: WorkAI сам находит доступные открытые модели, проверяет их на реальных задачах и дважды в сутки пересматривает выбор, а работоспособность текущей модели проверяет чаще. Именно поэтому в списке одно стабильное название, а не десяток отдельных строк — ваш выбор не «протухает» при смене модели.
Ограничения честно ниже, чем у платного каталога: работа с изображениями и режим рассуждений недоступны, ответ ограничен 16 000 токенов, зато вызов инструментов работает — агент может читать и править файлы. Это хороший способ попробовать продукт и закрывать простые задачи, но не замена платному каталогу на сложной работе.
Что происходит, когда WorkCoins заканчиваются
Запросы перестают проходить, и WorkAI показывает понятное сообщение с вариантами действий. Тихой подмены выбранной модели на более дешёвую не происходит — это осознанное решение: модели различаются по цене в десятки раз, и подменять их без вашего ведома нечестно.
Когда баланс достигает нуля, приходит письмо — один раз за платёжный период, а не серия предупреждений «осталось 20%».
Варианты, чтобы продолжить работу:
- Докупить пак WorkCoins — разовая покупка, коины не сгорают в конце месяца. Подробности и ограничения — на странице Докупка WorkCoins.
- Включить работу сверх лимита. Доступно на платном тарифе с привязанной картой и только после того, как вы сами включите этот режим. Лимит перерасхода фиксированный — 2500 Ⓦ, одинаковый для всех тарифов; цена такого коина выше подписочной и зафиксирована в оферте — 1,2 ₽ за 1 Ⓦ, а долг автоматически гасится при следующем продлении. Пока долг не погашен, доступ ограничен.
- Перейти на тариф с большим лимитом.
Перерасход и автоматическая докупка паков — взаимоисключающие режимы: включение одного выключает другое, чтобы баланс не пополнялся двумя способами разом.
Баланс проверяется и на стороне редактора, до отправки запроса. Если связь с сервером пропала, WorkAI работает по последнему известному состоянию баланса и останавливает запросы, когда израсходовано 90 % лимита (а по устаревшим данным — 80 %), чтобы не копить долг вслепую.
Что не списывает WorkCoins
- Служебные генерации. Названия чатов и имена проектов генерируются моделью, но пользователю не выставляются — расход фиксируется в истории с пометкой и не уменьшает баланс.
- Внутренние повторы при сбоях. Если запрос пришлось повторить из-за проблемы на нашей стороне, повтор оплачиваем мы: расход по нему записывается в историю, но с баланса не снимается.
- Ответ, который до вас не дошёл. Если связь с редактором оборвалась или вы остановили генерацию, не дождавшись конца, запрос не списывается — даже если модель успела потратить токены. Расход по нему всё равно виден в истории, но с пометкой и с нулевой суммой.
- WorkAI Free. Любые запросы к бесплатной модели — 0 Ⓦ.
Чего в этом списке нет: полученный ответ, который вам не понравился, и повторная попытка задать тот же вопрос другими словами — обычные оплачиваемые запросы, модель уже отработала. Сжатие истории диалога тоже выполняет модель, поэтому оно попадает в расход как обычные токены.
Можно ли подключить свой ключ провайдера
Да. В WorkAI можно добавить собственный ключ провайдера, и тогда запросы через него не списывают WorkCoins и не облагаются комиссией платформы — вы платите провайдеру напрямую по его тарифам. Расход при этом всё равно попадает в вашу историю использования, чтобы было видно, куда уходят токены.
Подключить можно ключи Anthropic, OpenAI, xAI, Google Gemini, DeepSeek, OpenRouter, GigaChat, Yandex AI Studio, а также любой сервис с API, совместимым с OpenAI.
Модели, подключённые своим ключом, появляются в общем списке рядом с моделями платформы — переключаться между ними можно в том же меню.