Термин

Контекстное окно

Объём текста в токенах, который модель способна удерживать одновременно — включая ваш запрос, всю историю переписки и сам ответ. Кончилось окно — начало разговора «выпадает» из памяти модели.

Что это

Представьте контекстное окно как стол ограниченного размера: на него кладут ваше задание, примеры, историю переписки — и то, что модель пишет в ответ, тоже занимает место на этом же столе. Когда стол заполнен, самое старое приходится сдвинуть и потерять из виду.

Сколько окна бывает

По обзорам рынка на середину 2026 года российские модели вроде YandexGPT и GigaChat в основных версиях держат порядка 128–131 тысячи токенов — это заметно больше объёма, скажем, целой книги средней длины. У передовых зарубежных моделей окно доходит уже до миллиона токенов и больше, хотя качество удержания информации на таком объёме у разных моделей отличается.

Почему это важно вам

Если вы просите модель отредактировать длинный гайд, учтите: инструкция, примеры стиля и сам текст статьи должны поместиться в одно окно одновременно, иначе модель забудет начало брифа к концу правки. На практике для длинных материалов (гайд на 3–4 тысячи слов) проще резать работу на этапы — план, затем разделы по очереди, — чем пытаться сделать всё одним запросом с максимальной нагрузкой на окно.