Услуги
Сайты и магазиныЛендинги ★Создание сайтовИнтернет-магазины
ИИ и автоматизацияИИ-секретарь ★Автоворонка и прогрев ★Telegram-боты ★Автоматизация ★CRM-разработка
ПродвижениеSEO-продвижениеAI-продвижение ★Контекстная рекламаSMM и соцсети
Наружка, печать и производствоВывески и буквыНаружная рекламаБаннеры и штендерыТипографияВизиткиШирокоформатБрендированиеОклейка автоТорговое оборудованиеМатериалы для рекламы
Дизайн и поддержкаДизайнПоддержка
КомплексDigital под ключ ★
РешенияКейсыПортфолиоЦеныО студииБлогКонтакты Обсудить проект

Прибор врёт

Правило замера сработало против нас трижды

Первая редакция вывода гласила, что ловушку не берёт никто, — виноват оказался наш скрипт с чужим допуском. Единственная задача, где наша сборка обошла всех, судится значением, подтверждённым только нашим же докстрингом. А лучший результат заезда мы выбросили из отчёта, потому что прогон был один.

Замер: 9 августа 2026разбор своих ошибок

Чем проверено: перепрогон с верным допуском n=3 по восьми участникам, аудит источников эталона, повторная проверка внешней задачи оптимизации

Короткий вывод. Правило замера чего-то стоит, только когда режет в свою сторону. За один заезд наши правила сработали против нас трижды: скрипт с неверным допуском занизил результат и опроверг наш же вывод; единственная задача, где наша сборка обошла всех, судится по числу, которое подтверждаем только мы; лучший результат заезда мы выбросили из отчёта из-за n=1. С правильным допуском картина перевернулась: 3 из 3 у нашей сборки, 1 из 3 у второй модели, 0 из 3 у остальных шести. Выброшенный результат — 1370 тактов и ускорение 107,835×, единственное верное решение из пяти участников.

Случай первый: «ловушку не берёт никто»

В батарее гео-задач была пара-ловушка: близкие по звучанию пункты, между которыми легко ошибиться на сотню километров. Первая редакция вывода звучала уверенно — ловушку не берёт ни один участник. Вывод пошёл в отчёт.

Разбор показал, что виноват не участник, а наш собственный скрипт проверки. Пара помечена в эталоне как приблизительная, допуск для таких пар — 15%. Скрипт применил общий 10%. При эталоне 975 и ответе 870 промах составляет 10,8% — то есть ровно в зазоре между двумя допусками.

УчастникПопаданий из 3 прогоновОтвет
Наша сборка3 / 3870 · 870 · 870
Вторая модель1 / 3
Остальные шесть0 / 3

Три одинаковых ответа подряд — признак устойчивости, а не удачи. Скрипт же превратил устойчивое попадание в круглый ноль и выдал это за свойство моделей.

Самая неприятная деталь. Ложный вывод прозвучал в том же сообщении, где мы праздновали, что позитивный контроль поймал дефект в приборе. Одна и та же реплика содержала доказательство работоспособности метода и результат, полученный в обход этого метода. Внимание к приборам не переносится автоматически на соседнюю строку отчёта.

Случай второй: победа, которую судит наше собственное число

Эталон из двадцати пар собирался по внешним источникам: 19 пар из 20 имеют внешнее подтверждение значения. У одной пары список источников пуст.

Единственный источник значения 975 км для неё — наш же докстринг во внутренней утилите сборки гео-фактов. Не справочник, не карта, не открытая база: строка кода, которую когда-то написали мы сами. Именно эта пара и оказалась той ловушкой, где наша сборка дала 3 из 3 против нуля у большинства.

Как поступили и почему так. Пару оставили в эталоне ради сопоставимости: убирать задачу после того, как увидел результаты, — худший вид подгонки. Но публиковать её как победу нельзя: единственная задача, где мы обошли всех, проверяется числом, которое подтверждаем только мы. Сюжет не в том, что число неверное, а в том, что оно непроверяемо снаружи по построению.

Правило, которое из этого выросло: у каждой пары эталона поле внешнего источника обязательно и заполняется до прогона. Пустое поле не запрещает задачу — оно запрещает делать на ней вывод о превосходстве.

Случай третий: лучший результат заезда выброшен из отчёта

На внешней задаче оптимизации наша сборка дала верное решение за 1370 тактов при эталоне задачи 1487. Позитивный контроль на немодифицированном базисе дал ровно 147 734 такта — отсюда ускорение 107,835×. Остальные четыре участника завалили задачу целиком.

Результат в отчёт не пошёл. Причина одна и не связана с самим числом: n=1. Один прогон не отличает способность от удачного броска, а именно на этом мы уже обжигались в соседней части заезда, где красивое одиночное значение не воспроизвелось ни разу.

Оговорка из того же протокола. До одного из объявленных задачей порогов решению не хватило 7 тактов. Ещё одна причина не подавать результат как рекорд — и хороший пример того, как выглядит честная строка в собственном отчёте.

Задача внешняя, эталон взят из её описания, повторить прогон может кто угодно. Отсюда и цена решения: выбросили не сомнительный результат, а лучший и полностью воспроизводимый. Правило «n=1 не публикуется» иначе не стоило бы ничего.

Что забрать себе

  1. Держите допуск в эталоне, а не в скрипте. Пара приблизительная — метка и её допуск живут рядом со значением. Общий допуск в коде проверки рано или поздно применится к паре, для которой он не предназначен.
  2. Красный результат проверяйте так же придирчиво, как зелёный. Вывод «не смог никто» — такой же вывод прибора, как «смогли все», и ломается он тем же способом.
  3. Заведите обязательное поле внешнего источника у каждого эталонного значения. Пустое поле — сигнал: задачу считаем, вывод о превосходстве на ней не делаем.
  4. Не убирайте задачу из эталона после того, как увидели результаты. Помечайте и оставляйте: удаление задним числом неотличимо от подгонки.
  5. Правило про n применяйте к своим победам первым. Выброшенный лучший результат — единственное доказательство, что правило настоящее.
Что мы считаем главным. Три случая различаются по знаку — один занизил, два касались наших лучших чисел, — но механизм у них общий: проверять готовы то, что не нравится, и сложнее проверять то, что нравится. Единственная защита — процедура, применённая до того, как стало видно, кто победил.

Источники материала

  • Чистые перепрогоны, 04–05.08.2026, раздел про пару-ловушку: допуск 15% для приблизительных пар против применённых 10%, три одинаковых ответа 870 при эталоне 975, промах 10,8%, распределение попаданий по восьми участникам.
  • Разбор ошибок диспетчера, 05.08.2026: ложный вывод «ловушку не берёт никто» и его соседство в одном сообщении с празднованием сработавшего позитивного контроля.
  • Чистые перепрогоны, раздел про источники эталона: 19 пар из 20 с внешним подтверждением, одна пара с пустым списком источников и значением из собственного докстринга.
  • Сплошная сверка цифр, раздел про внешнюю задачу оптимизации: 1370 тактов, верное решение, базис 147 734, ускорение 107,835×, недобор 7 тактов до порога, отбраковка по n=1.

Разбор входит в четвёртое занятие курса — приёмка результата

Процедура, написанная до того, как стало видно, кто победил: допуск рядом со значением, обязательное поле внешнего источника, запрет на публикацию n=1 в свою пользу. На курсе такая процедура собирается под ваш контур приёмки, а не под абстрактный бенчмарк.

Программа курса и цены
Соседние материалы
Предыдущий замер: Ответ уже лежал в контекстеСледующий замер: 22 своих числа: подтвердилось 9Все материалы журнала

Обсудим ваш проект

Оставьте заявку — свяжемся в течение 15 минут в рабочее время, зададим пару вопросов и пришлём ориентир по цене и срокам. Бесплатно, без обязательств.

  1. 1. Заявка или квиз
  2. 2. Короткий созвон / переписка
  3. 3. Бесплатная смета и план
  4. 4. Договор и старт

Бесплатно и ни к чему не обязывает. Ответим за 15 минут.