Что такое контекстное окно нейросети?
Контекстное окно — это максимальный объём текста в токенах, который модель обрабатывает за один запрос: ваш вопрос, история чата, вложенные документы и её собственный ответ. Всё за его пределами модель не видит. У современных моделей окно — от десятков тысяч до миллиона токенов.
Обновлено
Почему размер окна важен
Чем больше окно, тем больше материалов можно дать модели за раз: целую книгу, договор, стенограмму встречи или сотни заметок. Маленькое окно заставляет делить документ на части и терять связи между ними.
Но большое окно не означает идеальное понимание. Чем длиннее контекст, тем дороже и медленнее ответ и тем выше шанс, что модель упустит деталь из середины.
Как это связано с поиском по заметкам
Даже миллион токенов не вместит всю личную базу за годы. Поэтому сервисы, которые отвечают по вашим документам, сначала находят несколько самых подходящих фрагментов (поиск по смыслу), а в окно кладут только их. Этот подход называют RAG — генерация с опорой на найденные источники.
Сколько это в страницах
- Русский текст — примерно 2–4 символа на токен, английский — около 4.
- 100 тысяч токенов — это порядка 150–250 страниц русского текста.
- Часовая стенограмма встречи — обычно 10–20 тысяч токенов.
Пример
Вы загружаете в чат договор на 60 страниц и стенограмму совещания на час и просите найти противоречия. Если окно модели 32 тысячи токенов, всё это не поместится — часть текста просто не будет учтена, и модель пропустит противоречия в отрезанной части. С окном на сотни тысяч токенов оба документа войдут целиком, а ответ станет полнее, но медленнее и дороже.
Частые вопросы по теме
Что будет, если текст больше контекстного окна?
Сервис обрежет его, откажет или разобьёт на части. Часть информации модель не увидит.
Влияет ли контекстное окно на цену?
Да, в платных API оплата идёт за токены на входе и выходе: длинный контекст — дороже.
У какой нейросети самое большое окно?
Лидеры меняются; в 2025–2026 годах несколько моделей поддерживают около миллиона токенов.
Нужно ли большое окно для заметок?
Не обязательно: поиск по смыслу отбирает нужные заметки, и хватает среднего окна.
Чем контекстное окно отличается от памяти?
Окно — то, что модель видит в текущем запросе; память — сохранённые факты, которые приложение подкладывает в окно в новых разговорах.
Похожие вопросы
Что такое токены в нейросетях?
Токен — кусочек текста, которым оперирует модель: целое короткое слово, часть длинного слова, знак препинания или…
02Как нейросеть ищет ответы в моих документах (RAG)?
Документы заранее режутся на фрагменты, и для каждого считается числовой «отпечаток смысла» — эмбеддинг. Когда вы…
03Почему нейросеть забывает начало разговора?
У модели есть контекстное окно — максимальный объём текста, который она видит за раз. Всё, что в него не помещается…
04Почему нейросеть выдумывает факты?
Языковая модель не ищет ответ в базе фактов, а продолжает текст самым вероятным образом. Если точного знания нет, она…
05Почему ИИ так уверенно ошибается?
Уверенный тон — это стиль текста, а не степень знания. Модель учится писать как хорошие ответы в интернете, а они…
06Почему нейросеть отвечает по-разному на один и тот же вопрос?
Модель выбирает следующее слово не строго самое вероятное, а случайно среди вероятных — так ответы звучат живее. Эту…