TL;DR

Контекстное окно — это конечный фрагмент диалога, который AI «видит» в любой момент; всё за его пределами для модели фактически не существует. Держите это окно маленьким, чистым и сфокусированным на одной теме — и AI останется резвым, быстрым и дешёвым.

Аналогия

Перестаньте представлять AI как «разум». Вместо этого представьте умнейшего на Земле клерка, работающего за столом шириной ровно 4 фута.

Каждое ваше сообщение — лист бумаги, ложащийся на правый край стола. А у клерка есть ритуал, который он никогда не нарушает:**чтобы написать каждый ответ, он перечитывает все листы, лежащие на столе прямо сейчас — слева направо, каждый раз, без исключений.**Никакого просмотрового чтения. Никакого «это я помню». Полное перечитывание для каждого ответа, навсегда.

И жестокая деталь:**стол никогда не становится больше.**Он сделан на заводе фиксированного размера. Когда прибывает новый лист, а места нет, самый старый лист выскальзывает с левого края — не в ящик, не в шкаф, а в шредер. Клерк не скорбит.Он даже не замечает, что что-то исчезло.

Этот стол и есть контекстное окно.Когда вы говорите «AI забыл мою инструкцию», забывание не произошло.Лист с инструкцией просто соскользнул со стола.Клерк по-прежнему блистателен — просто стол полон.

Последняя деталь, касающаяся кошелька: этот клерк берёт оплату за листы.Поскольку каждый ответ требует перечитывания всего стола, чем дольше вы оставляете его захламлённым, тем больше платите за каждое генерируемое слово.Захламлённый стол — это не только растерянный клерк, но и дорогой клерк.

Как это работает и слоты чатов Uzu

Внутри большая языковая модель не «помнит» диалог — она его перечитывает на каждом ходу. Видимый текст измеряется в токенах (считайте токен примерно тремя четвертями слова), и эта зона видимости — контекстное окно.Попало внутрь — прочитано; не поместилось — суммируется или отбрасывается.

Что лежит на столе в произвольный момент:

Что на столеЧто это значит для вас
Системные инструкцииПостоянные команды AI — занимают место ещё до того, как вы заговорили
Персона и рольКарточка персонажа, которую клерк перечитывает перед каждым ответом
Ваши недавние сообщенияСамые свежие листы — всегда полностью видны
Ответы самого AIДа, он тоже перечитывает свои слова — длинные ответы вытесняют вас со стола
Вложения и вставленный текстСамые тяжёлые листы, без сомнения

Вот почему такие техники, как промпт одного запроса, работают так хорошо: полная и точная инструкция остаётся на столе и работает на вас на каждом ходу.Вот почему few-Shot промптинг — вставка решённых примеров в промпт — силён, но дорог как место на столе: каждый пример — это лист, который клерк будет перечитывать вечно.

Контекст — это ресурс, и приложение Uzu обращается с ним именно так. Uzu отправляет последние ~20 сообщений диалога, автоматически сжимая более ранние ходы в резюме — как клерк, периодически переплетающий самые старые листы в одну тонкую выжимку.Важные нити выживают, не переполняя стол. Uzu также сознательно ограничивает число одновременно открытых чатов, расширяя лимит с уровнем.Каждый открытый чат — отдельный стол, за который платится содержание.Мёртвые диалоги — не хлам; они вытесняют важную работу.

Экономика сходится и здесь: каждый токен, который модель перечитывает, — обработанный токен.Поэтому чистое контекстное окно заканчивается меньшим числом G-Credits, чем грязное.Точность экономит деньги дважды — один раз при написании промпта и по разу на каждый последующий ход.

Рабочее правило простое:

**Один стол — одна работа.**Один чат — одна тема, на листах только суть, а хлам — в шредер до того, как счёт выйдет из-под контроля.

Частые ловушки

  1. **Вести всю жизнь в одном вечном чате.**Чат, где вы планируете поездку, спрашиваете об аренде и отлаживаете рецепт — это стол, погребённый под нерелевантными листами.Новую тему — в новый чат: новый стол, стопроцентная концентрация.
  2. **Повторять всё ещё видимую инструкцию.**Если промпт одного запроса прибыл 12 сообщений назад, а диалог всё ещё короток, повторение — пустая трата токенов.Повторяйте правило, только когда оно явно соскользнуло с края — длинный диалог, потерянное ограничение.
  3. **Вставлять документ на 40 страниц и задавать один вопрос.**Самый тяжёлый лист на любом столе — выгрузка сырого документа.Сначала извлеките нужные разделы или используйте специализированный инструмент — в Uzu приложенный PDF становится эффективно цитируемым постоянным контекстом, а не перепосылаемым на каждом ходу полным текстом.
  4. **Путать окно с памятью.**Контекстное окно — это рабочее пространство, а не хранилище.Это стол, а не жёсткий диск — закройте чат, и стол вытерт.То, что вы хотите сохранить, нужно сохранять намеренно (записать или сохранить в память, поддерживаемую приложением).
  5. **Спорить с «забывшим» AI.**Когда модель противоречит старой инструкции, она не упрямится — лист упал со стола.Не воюйте с симптомом: переформулируйте ключевое ограничение или начните чистый чат, где оно близко к началу.

FAQ

Что такое контекстное окно в AI?

Контекстное окно — это максимальный объём текста (измеряемый в токенах), который модель AI может обработать за один раз.Оно включает ваши инструкции, историю диалога, прошлые ответы самого AI и приложенные документы.Всё за пределами окна не может повлиять на текущий ответ.Вот почему длинные диалоги в итоге «теряют» начальные инструкции.

Почему AI забывает то, что сам говорил в начале диалога?

Потому что модель никогда не сохраняла это — она лишь перечитывала то, что попадает в контекстное окно.По мере роста диалога ранние обмены суммируются или отбрасываются за пределы окна.Дело не в невнимательности AI — старейшие листы буквально покинули поле зрения.

Большое контекстное окно — это то же самое, что память AI?

Нет, и это смешение порождает бесконечные разочарования.Контекстное окно — временное рабочее пространство: оно существует, только пока жив диалог, и перечитывается на каждом ходу.Память — вроде сохранённых фактов или систем запоминания, которые предлагают некоторые приложения, — это отдельный, намеренный слой хранения, живущий дольше одного чата.Большое окно: более широкий стол.Память: картотека.Нужны обе, но роли у них разные.

Следующий урок

А теперь часть, о которой не предупреждают новичков: всё вышесказанное прекрасно работает и тогда, когда AI неправ.Модель с чистым столом реже противоречит инструкциям — но всё равно способна спокойнейшей уверенностью излагать ложь.Это не баг вашего промпта.Это иллюзия уверенности — покерное лицо, встроенное в каждую большую языковую модель.Научиться его распознавать — важнейший навык защиты в AI.

Следующий урок: Иллюзия уверенности

Упражнение перед уходом: откройте свой самый долгий чат и прочитайте его как инспектор стола.Какие листы всё ещё заслуживают места — а какие соскользнули три темы назад?Начните чистый чат и заметьте разницу в первом же ответе.