WorkAI

Grok 4.20 Fast

Версия Grok 4.20 без рассуждения: отвечает почти без задержки, окно 1 млн токенов с переключателем Context (200K по умолчанию), удвоенный тариф после 200K.

Grok 4.20 Fast — версия Grok 4.20 от xAI без режима рассуждения (ID модели: grok-4.20-fast, выпущена в марте 2026 года). Модель не тратит время на обдумывание и отвечает почти сразу, поэтому её берут там, где важна реакция: живой диалог и агентные сценарии с длинной цепочкой вызовов инструментов, где задержка на каждом шаге складывается в заметное ожидание. Для задач, где нужна точность на многошаговом разборе, она не подходит — там нужна модель с рассуждением.

Сколько текста помещается в один запрос

Окно контекста — 1 000 000 токенов. У всех моделей xAI в WorkAI есть переключатель Context: по умолчанию стоит 200K — ровно до порога, после которого тариф xAI удваивается; второй пункт открывает полное окно модели. Переключатель ограничивает объём входа: ответ резервируется отдельно, в физическом окне модели. В режиме 1M длинные логи, документация и накопленная история помещаются целиком, но после 200 000 токенов промпта тариф удваивается (см. «Сколько это стоит»).

Когда диалог подходит к выбранному лимиту Context, WorkAI сжимает историю средствами самого xAI: старые сообщения заменяются сжатой записью, последний вопрос и текущий цикл инструментов, как правило, остаются дословно. Сжатие оплачивается как обычный запрос к модели — подробнее в разделе «Что такое контекстное окно».

Ответ за один раз ограничен 32 768 токенами — этого хватает на развёрнутый ответ или крупный блок структурированных данных.

Что модель умеет кроме текста

  • Читает изображения — скриншот или схему можно приложить к сообщению.
  • Вызывает инструменты агента: правит файлы, запускает команды, ищет по проекту. Это её основной сценарий.
  • Отвечает потоком и умеет возвращать ответ в заданной структуре — удобно, когда результат разбирает другая программа.
  • Повторные запросы с одинаковым началом контекста обходятся дешевле: кэш у xAI работает автоматически. В инструментальных сценариях, где к модели обращаются много раз подряд в рамках одной задачи, это заметно.

Рассуждения у модели нет вовсе — ни включить, ни настроить его нельзя, переключателя Reasoning в её опциях не будет. PDF напрямую она тоже не читает: документ придётся передать текстом. Своего интернет-поиска у Grok в WorkAI нет. Как прикреплять файлы и изображения — на странице Контекст агента.

Сколько это стоит

Модель относится к среднему классу стоимости. У поставщика её цена совпадает с Grok 4.3 и Grok 4.20 Reasoning: за отказ от рассуждения скидки в тарифе нет, экономия получается косвенная — модель не тратит токены на обдумывание, поэтому запрос выходит дешевле по факту. Дешевле по ставке в линейке xAI только Grok Build 0.1.

У xAI есть надбавка за длинный контекст, и она жёстче, чем у OpenAI: как только промпт одного запроса достигает 200 000 токенов, вдвое дорожают и вход, и выход, причём по повышенной ставке пересчитывается весь запрос, а не только превышение сверх порога. Порог считается по всему промпту, включая токены, прочитанные из кэша, — высокий процент попаданий в кэш от надбавки не спасает. Миллионное окно доступно целиком, но заход за 200 000 токенов удваивает чек запроса. Механика списания WorkCoins описана на странице Модели и цены, актуальные рублёвые цифры — на странице тарифов. Модель поддерживает работу со своим ключом xAI.

Когда выбирать Grok 4.20 Fast

ЗадачаСтоит ли брать эту модель
Длинная цепочка вызовов инструментов подрядДа
Быстрый диалог, где ждут мгновенный ответДа
Большой лог или документация целикомДа — окно 1M с переключателем Context (200K по умолчанию)
Многошаговый анализ, где важна корректностьНет — возьмите Grok 4.20 Reasoning
Нужен контроль глубины рассужденияНет — только у Grok 4.3

Если модель выбирать не хочется, WorkAI использует модель по умолчанию — см. страницу Модель по умолчанию.