Модели и цены
Каталог моделей WorkAI: Claude, GPT, Gemini, Grok и DeepSeek. Списание в WorkCoins, ставки в Ⓦ на странице моделей. В интерфейсе — сумма в Ⓦ, не токены.
WorkAI работает с моделями Anthropic, OpenAI, xAI и DeepSeek. Google Gemini есть в публичном каталоге, но в селекторе редактора линейка не включена — платформенный биллинг Gemini не открыт. Расход списывается во внутренней валюте — WorkCoins (Ⓦ): не «за запрос» и не «за сообщение», а по фактическому объёму токенов запроса. В списке моделей всегда есть пункт Модель WorkAI Free — бесплатная модель без списания Ⓦ.
Эта страница отвечает на три разных вопроса, которые часто путают:
- Какие модели есть и чем они отличаются.
- Сколько спишется с вашего баланса — это WorkCoins. Ориентиры «N Ⓦ за типичный запрос» — на странице моделей, рублёвые тарифы и калькулятор — на тарифах.
- Из чего складывается расход — вход, кэш, вывод, глубина рассуждений. Ставки в Ⓦ за миллион токенов — на странице моделей. В редакторе и в истории вы видите сумму в Ⓦ и долю попаданий в кэш, без счётчика токенов запроса.
Какие модели доступны в WorkAI
Каталог одинаков для всех платных тарифов: тариф задаёт только объём WorkCoins в месяц, а не набор моделей. Дорогая модель на младшем тарифе не заблокирована — она быстрее расходует баланс.
Ниже — модели, для которых в документации есть отдельные карточки (ID, лимиты, для каких задач подходят), плюс DeepSeek и Gemini из публичного каталога. Полный список с ориентиром в Ⓦ за запрос — на странице моделей.
Колонка «Класс» — внутренний уровень стоимости модели у этого провайдера (budget / standard / premium). Колонка «Контекст» — максимальное окно.
Anthropic
| Модель | ID | Класс | Контекст | Максимум вывода |
|---|---|---|---|---|
| Sonnet 5 | claude-sonnet-5 | standard | 1M | 128K |
| Opus 5 | claude-opus-5 | premium | 1M | 128K |
| Opus 4.8 | claude-opus-4-8 | premium | 1M | 64K |
| Fable 5.1 | claude-fable-5-1 | premium | 1M | 128K |
| Fable 5 | claude-fable-5 | premium | 1M | 128K |
| Haiku 4.5 | claude-haiku-4-5-20251001 | budget | 200K | 64K |
OpenAI
| Модель | ID | Класс | Контекст | Максимум вывода |
|---|---|---|---|---|
| GPT-6 Astra | gpt-6-astra | premium | 1M | 128K |
| GPT-5.6 Sol | gpt-5.6 | premium | 1M | 128K |
| GPT-5.6 Terra | gpt-5.6-terra | standard | 1M | 128K |
| GPT-5.6 Luna | gpt-5.6-luna | standard | 1M | 128K |
| GPT-5.4 | gpt-5.4 | premium | 1M | 128K |
| GPT-5.3 Codex | gpt-5.3-codex | premium | 400K | 128K |
| GPT-5.4 Mini | gpt-5.4-mini | standard | 400K | 128K |
| GPT-5.4 Nano | gpt-5.4-nano | budget | 400K | 128K |
| GPT-4.1 | gpt-4.1 | standard | 1M | 32K |
xAI
| Модель | ID | Класс | Контекст | Максимум вывода |
|---|---|---|---|---|
| Grok 4.6 | grok-4.6 | standard | 500K | 32K |
| Grok 4.3 | grok-4.3 | standard | 1M | 32K |
| Grok 4.20 Reasoning | grok-4.20-reasoning | standard | 1M | 32K |
| Grok 4.20 Fast | grok-4.20-fast | standard | 1M | 32K |
| Grok Build 0.1 | grok-build-0.1 | budget | 256K | 32K |
Google Gemini
Отдельных карточек в /docs/models нет. Ориентир в Ⓦ — на странице моделей. В селекторе редактора модели Google не показываются: платформенный биллинг Gemini не включён; со своим ключом Google Ⓦ не списываются.
| Модель | ID | Класс | Контекст | Максимум вывода |
|---|---|---|---|---|
| Gemini 3.1 Pro | gemini-3.1-pro | premium | 2M | 64K |
| Gemini 3.5 Flash | gemini-3.5-flash | standard | 1M | 64K |
| Gemini 3 Flash | gemini-3-flash | budget | 1M | 64K |
| Gemini 3.1 Flash Lite | gemini-3.1-flash-lite | budget | 1M | 64K |
DeepSeek
| Модель | ID | Класс | Контекст |
|---|---|---|---|
| DeepSeek V4 Pro | deepseek-v4-pro | standard | 1M |
| DeepSeek V4 Flash | deepseek-v4-flash | budget | 1M |
Каталог меняется: модели, которые провайдер снял с обслуживания или заменил более новой версией, убираются из списка выбора. Так уже произошло с Opus 4.6 и Opus 4.7 — их нет в выборе, но старые записи об использовании и расчёт по ним сохраняются.
Сколько стоит запрос в WorkCoins
Ваш счёт — это WorkCoins, не «пакет запросов».
Расход в Ⓦ зависит от модели и объёма запроса: сколько токенов ушло на вход, сколько прочитано из кэша, сколько сгенерировано в ответе. Объём вычислений за один Ⓦ устанавливается платформой и со временем меняется; количество Ⓦ на вашем балансе при этом не меняется. Точная сумма известна только после ответа: WorkAI заранее проверяет, что баланс положительный, но ничего не резервирует.
Поэтому цифры «Ⓦ за запрос» на странице моделей — оценка для среднего запроса (≈ 2000 токенов контекста и 800 токенов ответа) по текущему курсу, а не фикс и не гарантия: длинная агентная сессия по большому репозиторию уйдёт выше, короткий вопрос — ниже. Порядок величины такой: лёгкие модели (GPT-5.4 Mini, Haiku 4.5, DeepSeek V4 Flash) — около 1 Ⓦ и меньше, средние (Sonnet 5, Gemini 3.5 Flash, GPT-5.4) — 1–3 Ⓦ, тяжёлые (Opus 5, Fable 5, GPT-5.6 Sol) — примерно от 3 до 10 Ⓦ, а в длинных агентных сессиях заметно больше. Актуальные значения считаются из живых данных платформы на каждом открытии страницы; ориентир — калькулятор «сколько запросов даёт N Ⓦ» на тарифах и счётчик в редакторе, точный расход по каждому запросу — в истории запросов кабинета.
В истории использования по каждому запросу видно дату, модель, режим, долю попаданий в кэш и списанную сумму в Ⓦ. Счётчик входных и выходных токенов в интерфейсе не показываем: для решения «почему сегодня ушло больше» достаточно модели, кэша и суммы.
Если нужно сравнить модели между собой по ставкам — страница моделей. Если нужно понять, хватит ли тарифа на месяц — тарифы.
Ставки моделей
Ставки каждой модели — вход, чтение и запись кэша, вывод — в WorkCoins за миллион токенов, вместе с оценкой «Ⓦ за средний запрос», опубликованы на странице моделей. Они считаются из живых данных платформы на каждом открытии страницы: объём вычислений за один Ⓦ устанавливается платформой и может меняться, поэтому в документации цифры не дублируются.
Это не ваш чек и не цена тарифа WorkAI: рубли за подписку и стоимость одного Ⓦ — только на тарифах. У OpenAI есть ещё режимы Flex (дешевле) и Priority / Fast (дороже) — они переключаются в селекторе модели и меняют ставку, а не только скорость.
Как читать ставки входа, кэша и вывода
Четыре ставки модели — это четыре разных счётчика, не «цена запроса».
- Вход — некэшированные токены промпта: системные инструкции, правила, ваше сообщение, история чата, прикреплённые файлы и результаты инструментов.
- Запись кэша — первый раз, когда кусок промпта кладётся в кэш. У Anthropic это 1,25× или 2× входа в зависимости от TTL; у GPT-5.6 — 1,25×.
- Чтение кэша — повтор того же куска. Обычно в 5–10 раз дешевле входа, у DeepSeek — ещё сильнее. Поэтому второй запрос по тому же проекту часто дешевле первого, даже если текст «выглядит таким же длинным».
- Вывод — ответ модели. Токены рассуждений (reasoning / thinking) тоже вывод, даже если в чате их не видно. Более глубокий режим рассуждений не меняет ставку за токен, но увеличивает их число.
Длинный контекст — отдельный порог, не «включённый режим 1M». У GPT-5.4 и всего семейства GPT-5.6 порог 272 000 входных токенов в одном запросе: вход ×2, вывод ×1,5. У Gemini 3.1 Pro порог 200 000. У всех моделей Grok порог 200 000, и надбавка там жёстче: вдвое дорожают и вход, и вывод. Само переключение Context в селекторе ничего не стоит, пока фактический запрос порог не перевалил.
Какую модель выбрать под задачу
Если не хочется разбираться — берите Sonnet 5: универсальный выбор для большинства задач разработки (в веб-режиме «Создатель» WorkAI работает именно на ней на любом тарифе; десктопный «Создатель» на Free идёт на GPT-5.4 Mini). Дальше двигайтесь от конкретной причины: не хватает качества — вверх, задача простая и повторяемая — вниз. Если модель не выбрана явно, запрос уходит на модель по умолчанию (см. Модель по умолчанию).
| Задача | Разумный выбор | Почему |
|---|---|---|
| Повседневная работа с кодом: рефакторинг, code review, тесты, работа с API | Sonnet 5 | Средний класс стоимости, полный набор возможностей — рассуждения, кэш, изображения и PDF, вызов инструментов |
| Сложная архитектура, долгая агентная задача, разбор запутанного бага | Opus 5, Opus 4.8, Fable 5, GPT-5.6 Sol, GPT-5.4 | Премиум-класс: глубже рассуждают и дольше держат задачу, но и расход заметно выше |
| Агентное написание и правка файлов | GPT-5.3 Codex, Grok Build 0.1 | Модели, специально обученные на задачах агентного кодирования |
| Быстрые вопросы, документация, краткие пересказы | Haiku 4.5, GPT-5.4 Nano, GPT-5.6 Luna | Бюджетные и быстрые; окна меньше, но для коротких задач этого хватает |
| Много однотипных вызовов инструментов, где важна задержка | Grok 4.20 Fast, GPT-4.1 | Работают без режима рассуждений — отвечают быстрее и не тратят токены на размышления |
| Нужно строгое следование инструкциям без «фантазии» | Grok 4.20 Reasoning, GPT-4.1 | Ставка на предсказуемость вывода и надёжный вызов инструментов |
Два практических правила. Первое: модель можно менять посреди диалога — история сохранится, так что начинать с дешёвой и переключаться на дорогую, когда задача не поддалась, вполне рабочая тактика. Второе: если задача упирается не в интеллект модели, а в объём материала, дешевле дать агенту точный контекст (см. Контекст и Правила), чем брать модель дороже.
Что означает класс модели
Класс (budget / standard / premium) — ранжирование внутри каталога одного провайдера, а не общая шкала цен. Сравнивать классы между провайдерами нельзя: Sonnet 5 и GPT-5.4 Mini обе в standard, но ставка вывода у Sonnet выше — это видно в таблицах выше.
То же внутри одной линейки. GPT-5.6 Luna формально в том же классе, что и GPT-5.6 Terra, но это самая дешёвая модель семейства 5.6 — по ставке рядом с GPT-5.4 Nano, не с Terra. Три Grok 4.x стоят одинаково: класс не отвечает на вопрос «сколько спишется».
Класс — «лёгкая, средняя или тяжёлая модель у этого провайдера». Сколько будет стоить запрос — ставки и ориентир в Ⓦ на моделях, рубли — на тарифах.
Как считаются WorkCoins
Расход в Ⓦ зависит от модели и объёма запроса; ориентир — калькулятор на странице тарифов и счётчик в редакторе.
Что важно знать про сам расчёт:
- Списание идёт по факту, после ответа модели. Перед запросом WorkAI только проверяет, что баланс положительный, но ничего не резервирует. Поэтому точная цена заранее неизвестна — она зависит от того, сколько токенов реально ушло и вернулось.
- Разные части запроса стоят по-разному. Некэшированный вход, чтение кэша, запись в кэш и вывод считаются отдельно. Чтение кэша обычно на порядок дешевле обычного входа — длинный диалог по одному проекту стоит меньше, чем кажется по объёму контекста.
- Токены рассуждений — это вывод. У моделей с reasoning внутренние рассуждения тарифицируются как выходные токены, даже если вы их не видите. Более глубокий режим стоит дороже при том же вопросе.
- Внутри система считает с точностью до 0.0001 Ⓦ, а в личном кабинете суммы округляются до сотых — у совсем дешёвых запросов в истории может стоять
0,00 Ⓦ.
Во входные токены попадает не только текст вашего сообщения: туда же идут системные инструкции, ваши правила, прикреплённые файлы и изображения, вся предыдущая переписка этого чата и результаты работы инструментов — каждый прочитанный агентом файл и вывод каждой команды остаются в истории и оплачиваются в следующих запросах тоже. Поэтому длинная агентная сессия по большому проекту стоит дороже одиночного вопроса той же модели.
Списывается всё это из одного баланса, но по порядку: сначала бонусные коины, затем тарифные, затем докупленные, и только последним — прежний перерасход (режим больше не предоставляется, но у тех, кто включил его раньше, долг ещё может быть).
Почему один запрос стоит по-разному
Основных причин четыре:
- Длина контекста. Чем больше файлов и истории диалога видит модель, тем больше входных токенов.
- Попадание в кэш. Повторные запросы по тому же контексту частично оплачиваются по льготной ставке чтения кэша.
- Глубина рассуждений. Reasoning-режимы генерируют дополнительные токены вывода.
- Порог длинного контекста у части моделей. У GPT-5.4 и у всех трёх GPT-5.6 после 272 000 токенов входа в одном запросе включается повышенная ставка: вход дорожает вдвое, вывод — в полтора раза. У Gemini 3.1 Pro порог — 200 000 токенов. У моделей Grok порог — те же 200 000 токенов, но надбавка считается иначе: вдвое дорожают и вход, и вывод, и повышенная ставка применяется ко всему запросу, а не только к превышению. Порог xAI считает по всему промпту, включая токены, прочитанные из кэша, — то есть высокий процент попаданий в кэш от надбавки не спасает. У GPT-5.4 Mini, GPT-5.4 Nano, GPT-5.3 Codex, GPT-4.1, у моделей Anthropic и DeepSeek такой надбавки нет: ставка одна на всём окне.
Настройка рассуждений и окна контекста
У моделей есть переключатели прямо в панели выбора модели — они влияют и на качество, и на расход:
- Reasoning. У моделей Anthropic с адаптивным мышлением доступны None / Low / Medium / High, а у Opus 4.8, Opus 5 и Fable 5 — дополнительно Max; по умолчанию Medium. У Haiku 4.5 выбор проще: рассуждения включены или выключены. У OpenAI набор уровней свой: у GPT-5.6, GPT-5.4 — Low / Medium / High / Extra High, у GPT-5.4 Mini и Nano — Minimal / Low / Medium / High, у GPT-5.3 Codex — Low / Medium / High без возможности выключить рассуждения совсем. У xAI глубину принимают Grok 4.6 (Low / Medium / High / Extra High) и Grok 4.3 (None / Low / Medium / High), у обеих по умолчанию Medium; у остальных моделей Grok переключателя нет — они рассуждают внутри себя, но настроить это нельзя, и WorkAI намеренно не показывает выбор там, где провайдер его не поддерживает.
- Context. Переключатель задаёт локальный лимит окна: с какого объёма WorkAI начинает сжимать историю диалога. У моделей Anthropic с окном 1M это 200K (по умолчанию) или 1M, у Haiku 4.5 — 100K или 200K (по умолчанию). У моделей OpenAI — 272K по умолчанию и 1M либо 400K вторым пунктом. У моделей xAI и Gemini 3.1 Pro — 200K по умолчанию (ровно до порога удвоенного тарифа) и полное окно модели вторым пунктом; у них переключатель ограничивает вход, а ответ резервируется отдельно.
- Pro-режим. Есть только у моделей GPT-5.6 и работает, когда рассуждения включены. Он не меняет ставку за токен, но заметно увеличивает расход Ⓦ за счёт большего числа токенов рассуждений.
- Processing mode. Режим обработки на стороне OpenAI: Default, Flex и Priority. Здесь меняется именно ставка за токен: Flex примерно вдвое дешевле обычной обработки, но может отвечать дольше, Priority — примерно вдвое дороже и быстрее. Набор пунктов зависит от модели.
У Anthropic сам переключатель Context на цену токена не влияет — повышенной ставки за длинный контекст там нет. У моделей OpenAI из списка выше выбор большого окна сам по себе тоже ничего не стоит, но если запрос реально перевалит за 272 000 токенов входа, включится повышенная ставка (см. раздел выше).
Что такое контекстное окно
Контекстное окно — это максимальный объём, который модель может держать перед глазами в одном запросе: ваше сообщение, история чата, файлы, инструкции и результаты инструментов вместе. В таблицах каталога это колонка «Контекст», и измеряется он в токенах (грубо — несколько символов текста на токен).
Диалог не обрывается, когда окно заполняется. Незадолго до потолка WorkAI сжимает историю сам:
- у моделей Anthropic Opus 5, Opus 4.8 и Sonnet 5 старая часть диалога заменяется связным пересказом: что за задача, какие решения приняты, какие файлы смотрели, какой следующий шаг. Пересказ пишет сама модель;
- у моделей xAI (все Grok) историю сжимает сам xAI: когда запрос подходит к выбранному лимиту Context (за несколько процентов до него; чем длиннее история, тем больше запас на неточность подсчёта токенов, но не раньше 85 % лимита — на 200K это около 170 000 токенов), WorkAI отправляет накопленную часть диалога на сжатие и дальше подставляет сжатую запись вместо старых сообщений. Последний ваш вопрос и текущий цикл инструментов обычно остаются дословно; если сам текущий ход уже слишком велик, сжимается и его начало. Сжатие — отдельный вызов модели и оплачивается как обычный запрос отдельной строкой в расходах: вход — сжимаемая история, выход — размер сжатой записи;
- у остальных моделей, включая Haiku 4.5, сжатие проще: из истории вычищаются рассуждения и старые вызовы инструментов (последние около десяти пар вызовов сохраняются), а если и этого мало — отбрасываются самые давние ходы диалога.
Пока идёт сжатие, в чате видна строка «Контекст сжат, продолжаю ответ…», а после в переписке остаётся пометка «История диалога сжата для соблюдения лимита контекста» — её видно и когда вы вернётесь к этому чату позже. Модальных окон и остановки работы здесь нет: запрос продолжается автоматически.
Сжатую память WorkAI хранит на вашей машине и после перезапуска редактора — заново платить за сжатие того же диалога не придётся. При переключении модели посреди диалога пересказ тоже сохраняется: он переводится в обычный текст, понятный любой модели.
У Grok сжатая запись устроена иначе: её выдаёт xAI в зашифрованном виде, прочитать её может только та же модель, и хранится она на сервере WorkAI сутки с последнего сжатия. Если вернуться к диалогу позже, переключиться на другую модель или отредактировать уже сжатое сообщение, история при следующем запросе будет сжата заново — это снова оплачиваемый вызов.
Сжать историю можно и вручную — отправьте в чат команду /compact. Это полезно, когда диалог уже разросся, а вы собираетесь задать большой новый вопрос и не хотите платить за перевоз всей предыдущей переписки.
Что при этом теряется: подробности. Пересказ сохраняет задачу, решения и имена файлов, но точные формулировки старых сообщений из него уходят. Если для дальнейшей работы важна конкретная деталь из начала диалога — повторите её в новом сообщении или начните новый чат.
Момент, с которого начинается сжатие, задаёт переключатель Context (см. раздел выше): больший лимит — реже сжатие и больше сохранённого контекста, но и больше входных токенов в каждом запросе.
Где посмотреть списание WorkCoins
Текущий баланс всегда виден в строке состояния редактора — значок с числом Ⓦ. Наведите на него, чтобы увидеть разбивку по источникам (тариф, бонус, купленные, долг по перерасходу); клик открывает раздел оплаты.
Подробная история — в личном кабинете, в разделах «Обзор» и «Оплата». По каждому запросу видно дату, модель, режим, долю попаданий в кэш и списанную сумму в Ⓦ. Это же место отвечает на вопрос «почему сегодня ушло больше, чем вчера»: сравните модель и процент кэша у дорогих строк. Токены запроса в этой таблице не выводим.
Что входит в тариф WorkAI
Тарифы отличаются только объёмом WorkCoins в месяц: Free, Pro, Pro+, Business и Max. Каталог моделей, глубина рассуждений и размер контекста на всех платных тарифах одинаковы. Цены в рублях — на странице тарифов.
Оплата идёт напрямую в рублях: банковские карты и СБП, а также Apple Pay и Google Pay. Отдельного зарубежного платёжного шлюза и оплаты в валюте нет.
Неиспользованный остаток тарифного пула переносится на следующий месяц частично: при продлении подписки переносится половина неиспользованного месячного объёма тарифа, остальное сгорает. Дробную часть округляем вверх, в пользу пользователя.
База расчёта — только сам месячный объём тарифа. Всё, что к моменту продления лежит на балансе сверх месячного лимита, — это недотраченный перенос из прошлого периода: он действует ровно один месяц и в базу нового расчёта не входит. Поэтому доля никогда не берётся с доли, и тарифный баланс не поднимается выше полутора месячных лимитов: 1 500 Ⓦ на Pro, 4 800 Ⓦ на Pro+ — независимо от того, сколько месяцев длится подписка. Копить тарифные Ⓦ из месяца в месяц невозможно: если платить и не тратить, баланс встанет на этом потолке со второго месяца и дальше расти не будет.
На цифрах для Pro (1 000 Ⓦ/мес): остался 601 Ⓦ — перенесётся 301 Ⓦ, и новый период начнётся с 1 301 Ⓦ. Остаток 1 400 Ⓦ (там уже лежит прошлый перенос) — считаем только от 1 000, перенесётся 500 Ⓦ, новый период начнётся с 1 500 Ⓦ.
Бонусные и докупленные коины в этот расчёт не входят — они лежат отдельными пулами и по правилу переноса не сгорают. Долг (уход в минус за период) переносится целиком, и перенос остатка с долгом взаимоисключающи: если баланс отрицательный, переносить нечего.
Что даёт бесплатный аккаунт
При регистрации начисляется приветственный бонус — 300 Ⓦ. Начисляется он после подтверждения адреса почты — если баланс новый и нулевой, скорее всего письмо ещё не подтверждено, и WorkAI прямо скажет об этом вместо предложения оплатить тариф. Бонус действует 30 дней с момента первого списания; после этого неизрасходованный остаток сгорает, а бесплатному аккаунту раз в месяц начисляется до 100 Ⓦ.
Две цифры «100 Ⓦ» на бесплатном тарифе — разные вещи, не путайте:
- 100 Ⓦ в месяц — сколько начисляется после окончания 30-дневного бонуса (ежемесячное пополнение);
- 100 Ⓦ в сутки — сколько можно потратить за скользящее 24-часовое окно от первого расхода, а не с полуночи, с любого остатка, хоть бонусного, хоть месячного — см. дневной лимит ниже.
На бесплатном тарифе (как Cursor Hobby) выбираются Модель WorkAI Free, модель по умолчанию и модели базового класса — их набор определяет платформа. Сейчас в селекторе редактора это Haiku 4.5, GPT-5.6 Luna, GPT-5.4 Mini, GPT-5.4 Nano, GPT-4.1, Grok 4.6, DeepSeek V4 Pro и DeepSeek V4 Flash (сверено 21.09.2026 по серверному гейту бесплатного тарифа; порог платформа может менять, актуальный набор всегда виден в селекторе моделей). Welcome-бонус 300 Ⓦ и ежемесячное пополнение 100 Ⓦ не открывают Opus, Sonnet, GPT-5.4 и остальные frontier-модели — они остаются в списке серыми с кнопкой «Улучшить тариф». Полный каталог — с Pro.
Дальше бесплатный аккаунт живёт так:
- пока есть бонусный остаток, модель по умолчанию и модели базового класса списывают Ⓦ, модель WorkAI Free — нет;
- когда бонусный остаток исчерпан, исполняется только модель WorkAI Free (0 Ⓦ), пока не придёт ежемесячное пополнение 100 Ⓦ — и эти 100 тоже только на модель по умолчанию и модели базового класса, не на Opus;
- Модель WorkAI Free остаётся доступна всегда и не расходует коины вообще.
Тот же переход на ограниченный каталог происходит, когда платная подписка закончилась и бонусный остаток израсходован. Докупленные пакеты коинов при этом не сгорают — но потратить их до продления подписки можно только на модели по умолчанию и моделях базового класса.
Дневной лимит на бесплатном тарифе
На бесплатном тарифе за скользящие 24 часа с момента первого расхода можно потратить не больше 100 Ⓦ — это верхняя планка расхода, а не ежедневное начисление (ежемесячное пополнение после бонуса — тоже 100 Ⓦ, но это другая цифра, см. выше): коины списываются с вашего обычного баланса (бонус, месячное пополнение, пакеты), просто не быстрее 100 Ⓦ за 24 часа. Неизрасходованный остаток дневного лимита на следующий период не переносится; счётчик обнуляется через 24 часа после того, как вы его начали тратить, а не в фиксированное время суток.
Что видно: в личном кабинете в разделе «Оплата» — строка «Сегодня потрачено N из 100 Ⓦ» и время обновления; при достижении лимита WorkAI вправе не выполнить запрос к модели, расходующей Ⓦ, и прямо говорит, что упёрлись в дневной лимит и когда он обновится, — это не «WorkCoins закончились», баланс при этом остаётся прежним.
Что делать, если лимита не хватает: дождаться окончания 24-часового окна (точное время видно в кабинете и в сообщении об ошибке), продолжить на модели WorkAI Free (эта модель не расходует Ⓦ и под лимит не попадает) или перейти на Pro — на платных тарифах дневного лимита нет.
Что такое модель WorkAI Free
Это один пункт в списке моделей, за которым стоит модель, выбранная платформой. Запросы к ней бесплатны — WorkCoins не списываются ни на каком тарифе, свой ключ не нужен.
Конкретная модель за этим пунктом меняется: WorkAI сам находит доступные бесплатные модели (через OpenRouter), проверяет их на реальных задачах и дважды в сутки пересматривает выбор, а работоспособность текущей модели проверяет чаще. Когда бесплатные модели недоступны, запрос выполняет модель из платного каталога — за счёт WorkAI, для вас это по-прежнему модель WorkAI Free без списаний. Именно поэтому в списке одно стабильное название, а не десяток отдельных строк — ваш выбор не «протухает» при смене модели.
Ограничения честно ниже, чем у платного каталога: работа с изображениями и режим рассуждений недоступны, ответ ограничен 16 000 токенов, зато вызов инструментов работает — агент может читать и править файлы. Это хороший способ попробовать продукт и закрывать простые задачи, но не замена платному каталогу на сложной работе.
Когда заканчиваются WorkCoins
Запросы перестают проходить, и WorkAI показывает понятное сообщение с вариантами действий. Тихой подмены выбранной модели на более дешёвую не происходит — это осознанное решение: модели различаются по цене в десятки раз, и подменять их без вашего ведома нечестно.
Когда баланс достигает нуля, приходит письмо — один раз за платёжный период, а не серия предупреждений «осталось 20%».
Варианты, чтобы продолжить работу:
- Докупить пак WorkCoins — разовая покупка, коины не сгорают в конце месяца. Подробности и ограничения — на странице Докупка WorkCoins.
- Включить автодокупку паков. Доступно на платном тарифе с привязанной картой и только после того, как вы сами включите этот режим: когда баланс упадёт ниже порога, с карты спишется пак со скидкой заранее — без долга.
- Перейти на тариф с большим лимитом.
Работа «в долг» (перерасход сверх лимита) больше не предоставляется. Если вы включали её раньше, режим отключится сам после погашения долга — придёт письмо.
Остаток баланса виден в редакторе, а решение по каждому запросу принимает сервер: если WorkCoins не хватает, вы увидите причину и что делать дальше.
Что не списывает WorkCoins
- Служебные генерации. Названия чатов и имена проектов генерируются моделью, но пользователю не выставляются — расход фиксируется в истории с пометкой и не уменьшает баланс.
- Внутренние повторы при сбоях. Если запрос пришлось повторить из-за проблемы на нашей стороне, повтор оплачиваем мы: расход по нему записывается в истории, но с баланса не снимается.
- Ответ, который до вас не дошёл. Если связь с редактором оборвалась или вы остановили генерацию, не дождавшись конца, запрос не списывается — даже если модель успела потратить токены. Расход по нему всё равно виден в истории, но с пометкой и с нулевой суммой.
- Модель WorkAI Free. Любые запросы к бесплатной модели — 0 Ⓦ.
Чего в этом списке нет: полученный ответ, который вам не понравился, и повторная попытка задать тот же вопрос другими словами — обычные оплачиваемые запросы, модель уже отработала. Сжатие истории диалога тоже выполняет модель, поэтому оно попадает в расход как обычные токены.
Свой ключ провайдера
Да. В WorkAI можно добавить собственный ключ провайдера, и тогда запросы через него не списывают WorkCoins — вы платите провайдеру напрямую по его тарифам. Запрос всё равно попадает в историю использования (модель, режим, без списания Ⓦ).
Подключить можно ключи Anthropic, OpenAI, xAI, Google Gemini, DeepSeek, OpenRouter, GigaChat, Yandex AI Studio, а также любой сервис с API, совместимым с OpenAI.
Модели, подключённые своим ключом, появляются в общем списке рядом с моделями платформы — переключаться между ними можно в том же меню.