Grok 4.20 Fast — версия Grok 4.20 от xAI без режима рассуждения (ID модели: `grok-4.20-fast`, выпущена в марте 2026 года). Модель не тратит время на обдумывание и отвечает почти сразу, поэтому её берут там, где важна реакция: живой диалог и агентные сценарии с длинной цепочкой вызовов инструментов, где задержка на каждом шаге складывается в заметное ожидание. Для задач, где нужна точность на многошаговом разборе, она не подходит — там нужна модель с рассуждением. ## Сколько текста помещается в один запрос Окно контекста — 1 000 000 токенов. У всех моделей xAI в WorkAI есть переключатель **Context**: по умолчанию стоит **200K** — ровно до порога, после которого тариф xAI удваивается; второй пункт открывает полное окно модели. Переключатель ограничивает объём входа: ответ резервируется отдельно, в физическом окне модели. В режиме 1M длинные логи, документация и накопленная история помещаются целиком, но после 200 000 токенов промпта тариф удваивается (см. «Сколько это стоит»). Когда диалог подходит к выбранному лимиту Context, WorkAI сжимает историю средствами самого xAI: старые сообщения заменяются сжатой записью, последний вопрос и текущий цикл инструментов, как правило, остаются дословно. Сжатие оплачивается как обычный запрос к модели — подробнее в разделе [«Что такое контекстное окно»](/docs/models-and-pricing#что-такое-контекстное-окно). Ответ за один раз ограничен 32 768 токенами — этого хватает на развёрнутый ответ или крупный блок структурированных данных. ## Что модель умеет кроме текста - Читает изображения — скриншот или схему можно приложить к сообщению. - Вызывает инструменты агента: правит файлы, запускает команды, ищет по проекту. Это её основной сценарий. - Отвечает потоком и умеет возвращать ответ в заданной структуре — удобно, когда результат разбирает другая программа. - Повторные запросы с одинаковым началом контекста обходятся дешевле: кэш у xAI работает автоматически. В инструментальных сценариях, где к модели обращаются много раз подряд в рамках одной задачи, это заметно. Рассуждения у модели нет вовсе — ни включить, ни настроить его нельзя, переключателя Reasoning в её опциях не будет. PDF напрямую она тоже не читает: документ придётся передать текстом. Своего интернет-поиска у Grok в WorkAI нет. Как прикреплять файлы и изображения — на странице [Контекст агента](/docs/agent/context). ## Сколько это стоит Модель относится к среднему классу стоимости. У поставщика её цена совпадает с [Grok 4.3](/docs/models/grok-4-3) и [Grok 4.20 Reasoning](/docs/models/grok-4-20-reasoning): за отказ от рассуждения скидки в тарифе нет, экономия получается косвенная — модель не тратит токены на обдумывание, поэтому запрос выходит дешевле по факту. Дешевле по ставке в линейке xAI только [Grok Build 0.1](/docs/models/grok-build-0-1). У xAI есть надбавка за длинный контекст, и она жёстче, чем у OpenAI: как только промпт одного запроса достигает 200 000 токенов, вдвое дорожают и вход, и выход, причём по повышенной ставке пересчитывается **весь** запрос, а не только превышение сверх порога. Порог считается по всему промпту, включая токены, прочитанные из кэша, — высокий процент попаданий в кэш от надбавки не спасает. Миллионное окно доступно целиком, но заход за 200 000 токенов удваивает чек запроса. Механика списания WorkCoins описана на странице [Модели и цены](/docs/models-and-pricing), актуальные рублёвые цифры — на странице [тарифов](/pricing). Модель поддерживает работу со своим ключом xAI. ## Когда выбирать Grok 4.20 Fast | Задача | Стоит ли брать эту модель | |---|---| | Длинная цепочка вызовов инструментов подряд | Да | | Быстрый диалог, где ждут мгновенный ответ | Да | | Большой лог или документация целиком | Да — окно 1M с переключателем Context (200K по умолчанию) | | Многошаговый анализ, где важна корректность | Нет — возьмите [Grok 4.20 Reasoning](/docs/models/grok-4-20-reasoning) | | Нужен контроль глубины рассуждения | Нет — только у [Grok 4.3](/docs/models/grok-4-3) | Если модель выбирать не хочется, WorkAI использует модель по умолчанию — см. страницу [Модель по умолчанию](/docs/model-router).