Генеративный искусственный интеллект превратил интернет в пространство, где убедительное изображение, голос или видеозапись больше нельзя автоматически считать свидетельством реального события. В авторской колонке CoinDesk директор по развитию Succinct Labs Брайан Трунцо утверждает: эпоха безобидных ИИ-картинок закончилась, а борьба с дипфейками при помощи обычных детекторов уже проигрывает гонку технологиям генерации. Детекторы ищут статистические признаки синтетического изображения, однако после размытия, сжатия или другой незначительной обработки их выводы могут измениться. Кроме того, проверка обычно начинается уже после публикации, когда фальшивка успевает собрать миллионы просмотров. Получается бесконечная игра: разработчики совершенствуют распознавание, а создатели подделок находят новый способ его обойти.
Проблема становится серьёзнее из-за перехода от чат-ботов к автономным AI-агентам. Такие системы способны искать информацию, публиковать материалы, оформлять покупки, проводить платежи и взаимодействовать с другими программами без постоянного контроля человека. Ошибка, вредоносная инструкция или незаметно искажённые данные могут масштабироваться на тысячи операций. При этом установить, почему модель приняла конкретное решение, часто трудно: её ответы вероятностны, а внутренняя логика не похожа на обычный журнал последовательных команд. По мнению Трунцо, маркировка ИИ-контента и заявления разработчиков о безопасности не дают достаточных гарантий. Он предлагает заменить доверие проверяемым математическим доказательством: «Не “поверьте мне на слово”, а “докажите это”».
Читайте также
Криптокомпания Тони Паркера отказывается от покупки биткоина
Главным инструментом автор называет доказательства с нулевым разглашением, или Zero-Knowledge Proofs. Эта криптографическая технология позволяет подтвердить истинность утверждения, не раскрывая лежащие в его основе конфиденциальные данные. Например, система может доказать, что результат был получен определённой моделью с заданными параметрами, не публикуя саму модель, исходный запрос, персональные сведения или коммерческие секреты. В теории ZK-доказательства способны подтвердить происхождение фотографии, целостность набора данных, полномочия цифрового агента и соблюдение установленных ограничений. Каждое значимое действие — платёж, сделка, подписание договора или передача данных — может сопровождаться подтверждением того, кто его разрешил и при каких условиях. Для банков, маркетплейсов, государственных сервисов и медиаплатформ это означало бы возможность проверять не обещания оператора, а криптографически зафиксированные факты.
Идея уже выходит за пределы криптовалютной индустрии. Национальный институт стандартов и технологий США изучает стандартизацию доказательств с нулевым разглашением. Отдельная инициатива NIST посвящена идентификации и авторизации AI-агентов, включая способы доказать их полномочия, обеспечить защищённые журналы действий и связать операции машины с разрешением человека. Стэнфордский AI Index одновременно фиксирует быстрый рост регулирования искусственного интеллекта, однако законы развиваются медленнее возможностей систем.
ZK — не единственный подход. Коалиция C2PA развивает стандарт Content Credentials, который криптографически фиксирует происхождение и историю изменений цифрового контента. Эти механизмы могут дополнять друг друга: Content Credentials объясняют, откуда появился файл, а ZK-доказательства подтверждают корректность вычислений и полномочия агента без раскрытия секретов. Технология пока остаётся сложной и ресурсоёмкой, особенно для крупных нейросетей. Исследователи называют проверяемое машинное обучение перспективным направлением, но признают нерешённые проблемы производительности, масштабирования и стандартизации. Поэтому заявление о том, что математика является «единственной надеждой», скорее отражает позицию автора, связанного с разработчиком ZK-инфраструктуры.
Тем не менее основной вывод трудно игнорировать: интернет эпохи автономного ИИ нуждается не только в обнаружении подделок, но и во встроенной системе доказательств. Следующим символом доверия после значка HTTPS может стать подтверждение того, кем создан контент, какой системой выполнено действие и кто действительно дал ей разрешение.





