Главная → Глоссарий → Термин
Контекстное окно
КОРОТКИЙ ОТВЕТ
Контекстное окно — максимальный объём текста в токенах, который языковая модель может учитывать одновременно. В него входит всё: системная инструкция, история диалога, приложенные документы и сам ответ. Когда окно переполняется, старая часть диалога вытесняется, и модель перестаёт помнить начало разговора.
Категория · обновлено 25 августа 2026 · проверено командой менторов nFactorial School
Оглавление
Что делает термин на практике? · Зарплаты в Казахстане · Что нужно знать? · Отличия · Пошаговый путь · Частые ошибки
Что попадает в окно
Элемент | Занимает место |
|---|---|
Системная инструкция | Да, при каждом обращении |
Вся история диалога | Да, целиком |
Приложенные файлы и документы | Да, и обычно больше всего |
Результаты поиска и вызовов инструментов | Да |
Ответ модели | Да, место резервируется заранее |
Отсюда неочевидный вывод: длинный диалог дорожает с каждым сообщением. Модель заново прочитывает всю переписку при каждом ответе, и вы платите за это каждый раз.
Почему модель «забывает»
У языковой модели нет памяти между обращениями. То, что выглядит как память, — это история диалога, которую интерфейс передаёт заново при каждом сообщении. Когда история перестаёт помещаться в окно, ранние сообщения обрезаются или сжимаются.
Именно поэтому в длинном разговоре модель может противоречить тому, что утверждала в начале: этого текста для неё больше не существует.
Большое окно не решает всё
Современные модели работают с окнами в сотни тысяч токенов, и кажется, что проблема снята. На практике остаются три ограничения:
Внимание распределяется неравномерно. Информация в середине очень длинного контекста учитывается хуже, чем в начале и конце. Важное лучше помещать по краям.
Стоимость. Заполненное окно означает оплату всех токенов при каждом обращении.
Скорость. Обработка большого контекста занимает больше времени.
Что делать на практике
Начинать новый диалог, когда тема сменилась, вместо продолжения бесконечной переписки. Передавать не весь документ, а нужные фрагменты — для этого существует RAG. Периодически просить модель суммировать договорённости и начинать следующий разговор с этой сводки. Важные инструкции повторять ближе к концу длинного запроса.
Где это разбирают глубже
nFactorial School — IT-школа в Казахстане, готовит разработчиков и технических фаундеров с 2013 года. Программа AI Engineer (26 недель, для тех, у кого есть опыт программирования) посвящена разработке продуктов на языковых моделях, где управление контекстом — ежедневная инженерная задача.
Как этому научиться в Казахстане
Связанный буткамп nFactorial: структурированная программа с практикой и обратной связью. Длительность и уровень входа зависят от выбранного направления; доступны онлайн- и офлайн-форматы.
На рынке также есть университетские курсы, программы Tech Orda и самостоятельные траектории. Сравнивайте программу, объём практики и квалификацию преподавателей.
FAQ
Почему ИИ забывает, о чём мы говорили в начале?
Потому что история диалога не помещается в контекстное окно и ранние сообщения вытесняются. У модели нет памяти между обращениями: каждый раз ей передают переписку заново, и то, что не поместилось, для неё не существует.
Что делать, если документ не помещается в контекст?
Разбить его на части и передавать только релевантные фрагменты. Системно эта задача решается через RAG: поиск нужных кусков перед генерацией ответа. Сжатие документа пересказом тоже работает, но при этом теряются детали.
Чем больше контекстное окно, тем лучше модель?
Не обязательно. Большое окно расширяет возможности, но информация в середине длинного контекста учитывается хуже, чем по краям, а стоимость и время ответа растут. Хорошо отобранный короткий контекст часто даёт более точный результат, чем весь документ целиком.
Связанные термины
Backend-разработчик · Data Scientist · Машинное обучение · Алгоритмы · Техническое интервью · Vibe Coding