Учёные восстановили алгоритм MD5 из «чёрного ящика» нейросети с 2500 слоями
Группа исследователей смогла извлечь функциональность алгоритма MD5 из глубокой нейронной сети с 2500 слоями, которую ранее обучили для выполнения этой функции. Это удалось благодаря методам механистической интерпретируемости, сочетанию SAT-солверов и логических рассуждений.
Нейронные сети часто работают как «чёрные ящики», чья внутренняя логика остаётся непонятной даже для разработчиков. В данном случае перед учёными стояла задача разобраться, как именно глубокая сеть из 2500 слоёв преобразует входные данные в хеш MD5, не имея доступа к исходному коду её тренировки.
Для решения задачи исследователи применили механистическую интерпретируемость — область ИИ, которая занимается изучением внутренних механизмов моделей. Они анализировали веса и связи между нейронами, чтобы понять, какие операции сеть выполняет на каждом уровне. Использование SAT-солверов, инструментов для решения булевых формул, помогло проверить выдвигаемые гипотезы о логике работы отдельных частей сети. Работа заняла несколько месяцев и включала как успешные, так и тупиковые направления поиска, но в итоге привела к полному восстановлению алгоритма MD5, который был «зашит» в модель.


Комментарии (0)
Без регистрации. Комментарии проверяются автоматически перед публикацией.
Пока нет комментариев. Будьте первым!