НАДЁЖНОСТЬСтатистические свойстваGENLAYER LABS RESEARCH
Краткое введение в это исследование:
Некоторые решения легко автоматизировать.
Аргумент
Шесть вопросов, одна система.
Каждая глава задаёт один вопрос и отвечает на него. Вот все ответы сразу; остальная часть страницы — доказательства, а в конце каждой главы — статья с полным обоснованием.
- 00МЕХАНИЗМЧто мы строим?Блокчейн, который умеет судить.
- 01НАДЁЖНОСТЬМожно ли доверять маленькой группе ИИ-судей?Доверие становится числом.
- 02СОГЛАСИЕКогда два ответа ИИ — «один и тот же»?Это объявляет контракт.
- 03АДАПТАЦИЯСколько оценки покупать для каждого решения?Ровно столько, сколько оправдывает цена ошибки.
- 04ТОКЕНОМИКАПочему голоса не купить компьютерами?Голоса — заблокированный капитал.
- 05СТИМУЛЫКто заплатит, чтобы оспорить неверное решение?Тот, для кого выплата делает это рациональным.
- 06ФОРМАЛЬНАЯ ВЕРИФИКАЦИЯСовпадает ли развёрнутый код с математикой?Перепроверяется при каждом изменении.
00 · Механизм
GenLayer — блокчейн, который умеет судить.
GenLayer — блокчейн, контракты которого могут действовать по вопросам без доказуемого ответа: выполнена ли работа как обещано, пришёл ли груз повреждённым. Его консенсус — Optimistic Democracy: лидер предлагает ответ, группа валидаторов — каждый со своей ИИ-моделью — голосует, а вердикт остаётся открытым для оспаривания, прежде чем стать окончательным.
Одно решение — от начала до конца.
01НАДЁЖНОСТЬ
Можно ли доверять решению, если оценщики расходятся во мнениях или действуют нечестно?
Да — потому что доверие становится числом. Статья точно вычисляет, как часто небольшая случайная группа совпадает с объявленной совокупностью судей, даже когда внутри сидят злоумышленники.
Задайте трудный вопрос широкой совокупности честных оценщиков — и 80 могут ответить «да», 20 «нет». GenLayer же всегда спрашивает лишь небольшую случайную горстку. Насколько можно доверять этой горстке?
Представьте объявленную совокупность возможных судей (совокупность оценщиков). Если она склоняется к одному ответу, как часто небольшая случайная группа окажется на той же стороне? Эта вероятность и есть воспроизводимость: совпадение с совокупностью, а вовсе не истина. Статья вычисляет её точно, включая худший случай, когда злоумышленники всегда голосуют против честного большинства.
Измените долю ответов, долю злоумышленников и число оценщиков.
Злоумышленники превращают совокупность 80/20 в 70/30. Голосуют сорок семь случайных судей. Как часто они всё же окажутся на стороне честного большинства?
Около 99,8%. Подмена десятой части совокупности почти не сказывается на 47 судьях. При 11 судьях то же число падает до 92%; при 1537 — практически 100%. Попробуйте сами ниже.
Худший случай по точной неадаптивной модели из статьи: каждый голос злоумышленников направлен против честного большинства.
Что именно доказывает статья
Точные формулы: как часто группа любого размера совпадает с объявленной совокупностью — с подкупом и без него, — и способ сертифицировать, сколько будущих решений разрешится воспроизводимо (вероятности ошибки конечной группы, поверхности чувствительности, операционные сертификаты).
Чем помогает более крупная группа оценщиков?
Чем больше судей вы отбираете, тем меньше вероятность, что группа разойдётся со стороной, которую предпочитает вся совокупность.
От чего зависит стабильность результата?
Чем единодушнее совокупность, тем меньше судей нужно для устойчивого результата.
Означает ли воспроизводимость, что ответ верен?
Нет. Это значит, что случайные группы обычно оказываются на той же стороне, что и объявленная совокупность. Истинность — отдельный, эмпирический вопрос.
Что если часть оценщиков — злоумышленники?
Статья точно вычисляет ошибку в худшем случае, когда известная доля совокупности подкуплена ещё до жеребьёвки группы. Устойчивость измеряется, а не постулируется.
02СОГЛАСИЕ
Кто решает, что два ответа ИИ совпадают?
Контракт. Каждый вызов объявляет, что считается «тем же ответом», и валидаторы судят предложение лидера по этому объявленному правилу — принцип эквивалентности.
Откуда берётся голос? Задайте ИИ один и тот же вопрос дважды — формулировки будут разными. Классический блокчейн считает любое расхождение сбоем и отвергает честную работу.
Решение — принцип эквивалентности: каждый вызов контракта объявляет, что считается «тем же ответом». Лидер выполняет работу и предлагает ответ; остальные повторяют задачу и судят по этому правилу. Объявите его удачно — и в голосах будет суждение. Объявите неудачно — и они станут единодушными, но пустыми, либо начнут отвергать всё честное.
Переключите критерий — и посмотрите, как изменится голосование.
1 КОНТРАКТ ОБЪЯВЛЯЕТ, ЧТО СЧИТАЕТСЯ ТЕМ ЖЕ ОТВЕТОМ
llm_call( task = "Соответствует ли сданный отчёт заданию?", equivalence = "тот же вердикт, что и при вашем повторном запуске", )
# или объявите: · ·
2 ЛИДЕР ВЫПОЛНЯЕТ ВЫЗОВ И ПРЕДЛАГАЕТ ОТВЕТ
«Соответствует заданию — ценообразование и конкуренты проработаны основательно; регулирование затронуто лишь вскользь, но затронуто».
3 ПЯТЬ ВАЛИДАТОРОВ ПОВТОРЯЮТ ЗАПУСК И ГОЛОСУЮТ ПО ОТВЕТУ ЛИДЕРА
Что именно задаёт whitepaper
Для каждого вызова контракт объявляет критерий, по которому валидатор судит, является ли ответ лидера приемлемым — возможно, сверяясь с собственным повторным запуском.
Это настоящий синтаксис?
Нет, это иллюстрация. Настоящие контракты GenVM — Python-классы в песочнице, но сам механизм (объявляемый для каждого вызова критерий на каждую ИИ-операцию) ровно такой, каким его задаёт whitepaper.
Почему два валидатора отклоняют честный ответ?
Их собственные повторные запуски честно приходят к противоположному вердикту. Это расхождение, а не обман: оно никогда не наказывается, а математика раздела «Надёжность» построена так, чтобы его поглощать.
Кто выбирает критерий?
Разработчик контракта, отдельно для каждого вызова. Разные вызовы в одном контракте могут объявлять разные критерии.
Почему просто не потребовать от всех валидаторов в точности одинакового результата?
У вызовов ИИ и чтения веба нет единственно верного результата: два правильных пересказа отличаются словами. Детерминированный код по-прежнему проверяется байт в байт.
03АДАПТАЦИЯ
Зачем спрашивать тысячу оценщиков, если хватит пары десятков?
Покупать ровно столько оценки, сколько оправдывает цена ошибки. На каждом шаге — остановиться, перепроверить или сгенерировать заново — лучший ход тот, что даёт наименьшие ожидаемые суммарные потери, и статья его вычисляет.
Каждая оценка — оплачиваемая работа. Возврат на 200 $ не заслуживает группы из 1537 судей; перевод из казны на 20 000 $ — возможно, да.
На каждом шаге система может остановиться, оплатить дополнительных судей для того же ответа (перепроверить) или оплатить новый ответ (сгенерировать заново). Лучший ход минимизирует ожидаемые суммарные потери: гонорары судей плюс средняя цена ошибки. Статья вычисляет идеальный ориентир; следуют ли ему реальные апелляции — вопрос раздела «Стимулы» ниже.
Сколько оценщиков стоит оплатить для этого решения?
На кону вопроса, по которому согласны 80%, 2000 $. Каждый судья стоит 10 центов. Где остановиться дешевле всего?
23 судьи: около 3,50 $ со всем. Остановка на 11 оставляет 23 $ ожидаемых потерь; 767 обходятся в 76,70 $ гонораров и не убирают ничего.
Каждый оценщик берёт 10 центов. Размеры групп берутся из раундов протокола — от 5 до 1537.
Итог = плата + риск для каждого раунда. Останавливайтесь там, где чёрная линия достигает минимума.
Что именно доказывает статья
Точное правило, какой ход даёт наименьшие ожидаемые потери; сертификаты, остающиеся в силе при смене ответа; и доказательство, что лестница эскалации GenLayer выполняет менее чем шестикратный объём работы идеально осведомлённого выбора (планировщик G-AE-ADS, шести-конкурентное расписание).
Почему система может начать всего с нескольких оценщиков?
Большинство решений разрешается дёшево. Добавляйте судей только когда выигрыш перевешивает затраты.
Когда дополнительная проверка оправданна?
Когда ставки достаточно высоки или свидетельства достаточно слабы, чтобы оплатить ещё один взгляд.
Зачем отдельно рассматривать повторную проверку текущего ответа и поиск нового?
Они покупают разное: перепроверка добавляет свидетельств о том же ответе, повторная генерация меняет сам ответ. Статья оценивает каждый вариант до того, как деньги потрачены.
Действительно ли работающая сеть следует этому идеальному правилу?
Здесь это не показано. Правило — ориентир планировщика; сеть достигает его лишь если кому-то лично выгодно подать нужную апелляцию. Именно это изучает раздел «Стимулы».
04ТОКЕНОМИКА
Что мешает одному игроку запустить столько узлов, чтобы захватить сеть?
Голоса — это заблокированный капитал, а не компьютеры. Захват означает купить — и поставить под удар — огромную долю GEN, токена, который никто не может печатать по своему желанию.
До сих пор мы считали, что голоса трудно купить. Но компьютеры дёшевы: один человек может держать тысячу узлов.
Поэтому голоса принадлежат заблокированному GEN — токену, который никто не может печатать по своему желанию. Валидатор блокирует минимум 42 000 GEN, которые может потерять (стейк); любой другой может передать свои GEN валидатору, которому доверяет (делегирование). Захватить сеть — значит скупить огромную долю всего GEN и оставить её там, где сеть может её сжечь (слэшинг).
Посмотрите, как один и тот же атакующий пытается захватить власть в двух разных мирах.
плодит поддельных голосующих, каждый примерно за 0 $…
ДОЛЯ ВСЕГО GEN, КОТОРУЮ ПРИШЛОСЬ СКУПИТЬ АТАКУЮЩЕМУ
та же атака здесь: купить и заблокировать 0% всего GEN. Смошенничает — этот стейк сгорит (слэшинг).
Из закреплённых таблиц статьи: минимум 42 000 GEN для валидатора, 42 GEN для делегирования, разблокировка 7 эпох, до 5% штрафа за мошенничество.
Что именно задаёт статья
Экономический двигатель под этим судом: фиксированная генезис-эмиссия 4,2 млрд GEN, выпуск, снижающийся с 9% к 4% (потолок, а не обещание), вознаграждения из комиссий и выпуска, правила стейкинга и штрафы, которые никогда не бьют по честному несогласию — только по доказуемым нарушениям.
Откуда берутся деньги, которыми платят валидаторам?
Два потока: комиссии за транзакции и выпуск, снижающийся с 9% к 4% по фиксированной кривой (потолок; сжигания могут только опустить его). DAO финансируется исключительно из комиссий, поэтому её доход следует за реальным использованием.
За что валидатора действительно наказывают?
Честная ошибка и нарушение оцениваются по-разному. Проигранный голос сжигает лишь суммы масштаба комиссии, никогда не основной депозит. Простой штрафуется на 1%, доказанное мошенничество — 5% с лидера, а проигранная апелляция теряет залог. Несогласие поглощается, нарушение наказывается.
Достаточно ли квадратного корня, чтобы остановить атаку Сивиллы?
Нет, и статья прямо это говорит. Вогнутый вес лишь сглаживает концентрацию; дробление останавливает то, что каждая личность обязана заблокировать полные 42 000 GEN, держать собственный узел и отвечать собственным штрафом.
Можно ли получать вознаграждение, не запуская собственный узел?
Да. Делегируйте от 42 GEN — и вознаграждения капитализируются автоматически. Комиссии сравнивать не нужно: протокол фиксирует деление, и каждый GEN в позиции валидатора приносит одинаковую ставку.
05СТИМУЛЫ
Кто заплатит, чтобы оспорить неверное решение?
Тот, для кого выплата делает это рациональным. У награды за апелляцию узкое безопасное окно: достаточно большая, чтобы обоснованные сомнения действовали, и достаточно малая, чтобы слепой спам по-прежнему терял деньги.
Помните голосование 3:2? Решения с таким перевесом заслуживают второго взгляда. Но тот, кто оспаривает, обязан заблокировать деньги (залог) и рискует их потерять. Зачем ему это?
Статья разделяет две вещи, которые звучат похоже: когда системе нужна ещё одна группа — и когда частному лицу выгодно её созвать. Расходятся они в обе стороны: неподанные апелляции (никто не платит) и пустые апелляции (кто-то платит зря). Рычаг — размер выплаты: слишком мал, и сомнения останутся невысказанными; слишком велик, и слепое оспаривание превращается в бизнес.
Размер выплаты определяет, ради каких сомнений стоит действовать.
Что именно доказывает статья
Точная цена разрыва между идеальным правилом остановки и реальным поведением апелляций (регрет реализации), доказательство, что никакая фиксированная пара «залог — вознаграждение» не подходит всем нагрузкам, и условия, при которых откалиброванная выплата этот разрыв закрывает.
Что побуждает участника подать апелляцию?
Его шансы выиграть, вознаграждение, залог под риском, стоимость апелляции и любой личный интерес в исходе.
Можно ли настроить стимулы так, чтобы участники действительно подавали полезные апелляции?
При определённых условиях — да. Статья показывает, как откалибровать вознаграждения, чтобы частный интерес совпадал с теми случаями, когда системе действительно нужна ещё одна группа.
Почему важно, что апелляцию могут подать несколько участников?
Как только апеллировать могут многие, их решения начинают взаимодействовать: ожидание, гонка, дублирование усилий. Механизм должен оценить все три.
Почему просто не поднять залог, чтобы отсечь пустые апелляции?
Больший залог оплачивает группу и отпугивает спам, но связывает капитал: арифметика выигрыша может остаться прежней, тогда как круг тех, кому апелляция по карману, резко сужается.
06ФОРМАЛЬНАЯ ВЕРИФИКАЦИЯ
Действительно ли протокол ведёт себя так, как задумано?
Перепроверяется при каждом изменении. Машинно проверяемая модель Optimistic Democracy сверяется с развёрнутыми контрактами по мере их эволюции — и уже поймала настоящие ошибки.
Всё выше — математика о проекте; сеть же исполняет код, который меняется каждую неделю. Поэтому машинно проверяемая модель Optimistic Democracy (проверка модели в TLA+) перепроверяется против контрактов по мере их развития.
Что именно охватывает верификация?
Слоистая модель: канонический граф состояний, спецификации TLA+, проверяемые против него, и отображение каждого перехода в Solidity-код зафиксированной ревизии.
Доказывает ли это, что в коде нет ошибок?
Нет. Она доказывает заявленные свойства о заявленной модели зафиксированной ревизии. Именно это сужение и делает утверждения проверяемыми.
Зачем перепроверять, а не доказать один раз?
Протокол продолжает меняться. Каждая ревизия перепроверяется по тем же свойствам, поэтому тихий дрейф проявляется как непройденная проверка, а не как инцидент в продакшене.
А этот контроль когда-нибудь ловил что-то настоящее?
Да: та самая гонка и три нарушенных инварианта выше. Всё подтверждено в реализации и передано разработчикам.
ОСНОВНЫЕ ИССЛЕДОВАНИЯ
Шесть вопросов. Пять статей.
Измерить группу, оценить эскалацию, финансировать суд, выровнять апелляции, верифицировать код.
НАДЁЖНОСТЬAggregate Disambiguation SystemsКак число оценщиков влияет на надёжность
АДАПТАЦИЯAdaptive Economic DisambiguationСтатья скоро выйдет
ТОКЕНОМИКАGEN TokenomicsСтатья скоро выйдет
СТИМУЛЫMulti-Agent Appeal GamesСтатья скоро выйдет
ФОРМАЛЬНАЯ ВЕРИФИКАЦИЯLayered Formal VerificationСтатья скоро выйдет
Каждый термин — один раз