на этой неделе я немного провел времени в проводнике политик Ньютона — просто пролистывал то, что люди действительно развернули. я не искал ничего конкретного.
одна запись постоянно привлекала мое внимание: политика на естественном языке. описание достаточно простое: оно оценивает правило на простом английском по ончейн-замыслу с помощью llm, а не вручную написанного rego. не нужно изучать dsl, не нужно разбираться в синтаксисе rego — просто опишите условие, и пусть модель решает.
в этом есть смысл.
сначала я сосредоточился на том, что именно делает эта политика. более интересной оказалась часть о том, сколько раз ее развертывали.
пейджер на странице explorer в Newton листает на странице 1 из 49, всего 290 результатов, и часть этого первого экрана — это та же самая политика. политика на естественном языке, то же имя, то же описание слово в слово, другой адрес каждый раз. и это не совпадение в названиях: один и тот же создатель стоит как минимум за тремя из них.
эта часть не совсем укладывается в голове.

что именно записывается на каждую инстанцию — это не рассуждения моделей, а объект «только вердикт»: пройдено или не пройдено, без показа того, как до этого дошли. регo больше не кодирует логику в этих развертываниях — это просто передача всего, что решил модель.
значит, вердикт переехал куда-то ещё.
rego ценят за то, что оно детерминированное и статически проверяемое: можно рассуждать о том, что политика разрешит и что не разрешит, ещё до того как что-либо будет запускаться с её использованием. передача этого решения llm лишает это свойство. граница всё равно будет соблюдаться, но то, что её обеспечивает, уже нельзя полностью проаудировать извне.
поэтому политика не убирает необходимость принимать решение.
это просто переносит это в модель.
но кое-что всё время не давало покоя, пока я пересчитывал дубликаты. 290 развертываний одного экспериментального шаблона без видимых различий между ними — это не очевидное доказательство того, что идея работает. это может так же легко означать, что никто не проверяет, держится ли вердикт llm как реальный рубеж безопасности: они просто копируют то, что уже существует.
повторение — не валидация.
здесь доступность — реальная. написание rego означает изучение языка политики, к которому большинство разработчиков solidity или python никогда не прикасались. описание условия простыми словами и последующая проверка модели по нему относительно намерения убирает этот барьер. для маркетплейса Newton, созданного, чтобы привлечь разработчиков ИИ, а не специалистов по rego, — это осознанный компромисс.
этот выбор дизайна следует за этим.

часть, которую я ещё не полностью для себя определил: значит ли то, что есть 290 почти идентичных развертываний, что этот шаблон тихо стал для Newton доверенным способом ограничивать действия, управляемые ИИ, или это значит, что один и тот же шаблон просто скопировали 290 раз, не подвергая стресс-тестированию то, что происходит, когда модель выносит вердикт неправильно?
ньюто не показывает здесь свою работу.
нет истории версий между клонами, нет признаков, что кто-то из них отклонился от оригинала, чтобы обработать пограничный случай, ничего, что отличало бы один трек развертывания от другого. только по explorer нельзя понять, что это было тестирование, кроме как копирование.
политика на естественном языке — действительно полезный примитив для Newton, если она выдерживает то, как её описывают. открытый вопрос — доказывают ли триста копий это, или просто доказывают, что её легко найти.
если один и тот же шаблон переустанавливают столько раз, это значит, что он выдержал достаточно реального использования и ему доверяют, или же дизайн «только вердикт» просто делает сбой достаточно незаметным, чтобы никто не заметил, что его не должно было быть?
@NewtonProtocol $NEWT #Newt $BILL $TRIA
