Услуги
Сайты и магазиныЛендинги ★Создание сайтовИнтернет-магазины
ИИ и автоматизацияИИ-секретарь ★Автоворонка и прогрев ★Telegram-боты ★Автоматизация ★CRM-разработка
ПродвижениеSEO-продвижениеAI-продвижение ★Контекстная рекламаSMM и соцсети
Наружка, печать и производствоВывески и буквыНаружная рекламаБаннеры и штендерыТипографияВизиткиШирокоформатБрендированиеОклейка автоТорговое оборудованиеМатериалы для рекламы
Дизайн и поддержкаДизайнПоддержка
КомплексDigital под ключ ★
РешенияКейсыПортфолиоЦеныО студииБлогКонтакты Обсудить проект

Организация работы

Сократили стартовый контекст вдвое: 24 386 → 12 263 токена

Экономия здесь второй по важности результат. Первый — предзагруженный факт неотличим от проверенного: агент выдаёт число из стартовой памяти с той же уверенностью, что и число, которое он только что посмотрел.

Замер: 9 августа 2026наш замер

Чем проверено: замер предзагрузки до и после, контрольное измерение первой оптимизации

Короткий вывод. Стартовый контекст — то, что агент читает до первого вашего слова. Замерили свой: 24 386 токенов предзагрузки, после ревизии 12 263, ровно вдвое меньше. Сорок процентов объёма занимал накопленный слой памяти, ещё двадцать один — стартовый хук. Экономия оказалась вторым по важности результатом. Первая «оптимизация», сделанная без замера, объём увеличила: 18 малых индексов выросли с 4 431 до 4 918 байт. А главная причина чистить предзагрузку вообще не про деньги: предзагруженный факт неотличим от проверенного — агент выдаёт число из стартового текста ровно с той же уверенностью, с какой выдал бы результат проверки.

Что именно мерили

Перед каждой сессией в модель уходит набор слоёв: общие инструкции, инструкции проекта, вывод стартового хука, накопленный слой памяти, описания доступных навыков. Ни один из них не запрашивается — они приезжают всегда, на любой вопрос, включая «привет».

Считали сторонним токенайзером общего назначения. Оговорка стоит прямо в отчёте: это прокси, а не счётчик самой модели, поэтому абсолютные значения приблизительны, а отношения между слоями и разница до/после — устойчивы.

Слой предзагрузкиБылоДоляСтало
Накопленный слой памяти9 70740%5 046
Инструкции проекта7 05629%3 994
Вывод стартового хука5 00221%880
Общие инструкции1 8528%1 439
Описания навыков7693%904
Итого24 386100%12 263 (−50%)

Честная разбивка по готовности: вживую применено пока только сокращение памяти — −4 661 токен (−19%). Ещё −7 184 вступают в силу при слиянии веток, а −413 ждут решения по содержанию общих инструкций.

Оптимизация, которая сделала хуже

Первая версия сокращения индексов памяти выглядела разумно: вместо перечня записей в малой зоне оставить сноску «нужное найдётся поиском». Замер после правки показал обратное — суммарный вес 18 малых индексов вырос: 4 431 → 4 918 байт.

Почему так вышло. Сноска «возьми поиском» — это несколько десятков байт на каждую зону, а спрятанный указатель в маленькой зоне занимал меньше. На зоне из трёх записей инструкция, как искать записи, тяжелее самих записей.

Из промаха вышел порог: зона считается малой при восьми записях и меньше, и у таких зон указатель остаётся на месте. Без замера правка уехала бы в работу как улучшение — она ведь сокращала текст, это видно глазом.

Класс шире нашего случая. Любая оптимизация, принятая по виду диффа, а не по числу после прогона, с вероятностью около половины идёт в минус. Единственная защита — мерить то же самое тем же способом до и после, а не «оценивать».

Честный минус: наше изменение добавило 322 токена

Вторая работа того же цикла разделяла данные по проектам, чтобы сессия в одном контуре не тянула контекст соседнего. Итог по экономии отрицательный, и в отчёте он написан прямым текстом: экономии на предзагрузке изменение не даёт, оно её увеличивает на 322 токена — стартовый хук потяжелел с 5 002 до 5 324, замерено прогоном, а не прикинуто.

Тип запускаСтартовых токенов былоИзменение
Изолированная копия репозитория14 784+322
Общее рабочее дерево13 4290
Дочерний проект со своими инструкциями9 6510
Дочерний проект без своих инструкций2 0280
Остальные репозитории1 9560

Минус приняли осознанно: изменение решало задачу разделения данных, а не экономии, и платить за него тремя сотнями токенов на одном типе запуска дешевле, чем разбирать потом утечку контекста между проектами. Ценность здесь в другом — в отчёте написано «моё изменение экономии не даёт». Отчёт, где все строки со знаком плюс, читать нельзя: он либо неполон, либо подогнан.

Зачем чистить предзагрузку, если токены дёшевы

Настоящая причина всплыла в середине работы. Число, приехавшее в контекст на старте, внутри ответа неотличимо от числа, полученного проверкой: и то и другое агент выдаёт утвердительно, без пометки об источнике. Отсюда правило, которое мы для себя вывели: из предзагрузки убирается всё числовое.

Как это выглядит в жизни. Стартовый хук печатал в контекст готовые значения из рабочей базы. Сессия отвечала ими бодро и точно — до дня, когда значения устарели. Ошибку такого рода невозможно заметить внутри ответа: он не отличается от правильного ничем.

Указатель вместо значения решает обе задачи разом: контекст легчает, а число попадает в ответ только через обращение к источнику — то есть с датой и с возможностью перепроверки.

Что сделать у себя

  1. Посчитайте свою предзагрузку по слоям. Не общий объём, а именно разбивку: почти всегда один слой занимает половину, и это не тот слой, на который вы думали.
  2. Выкиньте из стартового контекста все значения. Числа, суммы, остатки, адреса — заменяются указателем «где взять». Ответ должен доставаться проверкой, а не памятью о вчерашнем.
  3. Каждую правку размера меряйте тем же способом до и после. Правка, сокращающая текст на вид, регулярно увеличивает его на весах.
  4. Пишите минусы в отчёт цифрой. «Экономии нет, стало на 322 токена больше» — нормальная строка отчёта; её отсутствие в чужом отчёте — повод перечитать остальные строки.
Итог. Половина стартового контекста уходила на то, что никто не запрашивал, и часть этого объёма активно вредила — подсовывала непроверяемые факты. Сокращение вдвое — приятный побочный результат; главный в том, что теперь видно, откуда в ответе взялось число.

Источники материала

  • Ревизия слоёв знаний: замер предзагрузки по пяти слоям до и после, токенайзер общего назначения как прокси, разбивка по готовности изменений.
  • Отчёт о разделении данных по проектам: замер стартовых токенов по пяти типам запуска и зафиксированный отрицательный итог по экономии.
  • Рабочий журнал сокращения индексов памяти: замер веса 18 малых зон до и после первой версии правки, порог «зона малая при ≤8 записях».
  • Инвентарь замеров, группа «Организация работы с ИИ-агентами».

Пятый модуль курса — организация и источник истины

Что грузится в вашего агента до первого слова, сколько это стоит и как отличить предзагруженный факт от проверенного. Замер делается на вашем контуре прямо на занятии.

Программа курса и цены
Соседние материалы
Предыдущий замер: Отказ от безопасного тоже сбойСледующий замер: Восемь поправок от человекаВсе материалы журнала

Обсудим ваш проект

Оставьте заявку — свяжемся в течение 15 минут в рабочее время, зададим пару вопросов и пришлём ориентир по цене и срокам. Бесплатно, без обязательств.

  1. 1. Заявка или квиз
  2. 2. Короткий созвон / переписка
  3. 3. Бесплатная смета и план
  4. 4. Договор и старт

Бесплатно и ни к чему не обязывает. Ответим за 15 минут.