OpenAI наняла терминатора, чтобы тот охранял терминатора
OpenAI создала GPT-Red — ИИ-хакера для поиска уязвимостей в других нейросетях, как сообщает MIT Tech Review.
Суть: OpenAI представила GPT-Red — ИИ-хакера, задача которого — взламывать другие нейросети этой же компании, чтобы потом латать дыры. То есть мы теперь используем искусственный интеллект для защиты от искусственного интеллекта, который сами же и породили.
Абсурд ситуации в том, что это напоминает бесконечный цикл: сначала выпускаем сырой продукт, потом нанимаем другого ИИ, чтобы он нашёл в нём баги, а затем гордо рапортуем о повышении безопасности. Кто реально выигрывает? Очевидно, OpenAI — они получают бесплатный аудит от собственной же разработки, экономя на зарплатах хакеров-людей, и одновременно создают инфоповод для заголовков.
Но главный подвох в другом: GPT-Red — это тот же самый ИИ, только с другой инструкцией. Он не найдёт тех уязвимостей, которые не заложены в его собственной логике. Это как попросить шулера проверить колоду карт — он увидит только те фокусы, которые сам знает.
А если серьёзно, то вся эта история — лишь способ легализовать внутреннее тестирование под видом прорыва. Завтра они скажут, что GPT-Red нашёл критические ошибки, послезавтра — что их исправили, а послепослезавтра выпустят новую версию с теми же багами, но под другим соусом.
Ирония судьбы: мы создали ИИ, чтобы он защищал нас от ИИ, но забыли спросить, кто защитит нас от создателей этого ИИ.
Афоризм: Чем больше ИИ охраняет ИИ, тем меньше шансов, что кто-то из них окажется человеком.