Нейросети по всему миру демонстрируют подозрительную активность
Законодательное регулирование и обеспечение безопасности в сфере науки и технологий – то, за что выступает Казахстан. И тому есть веские основания. OpenAI отменила запуск своего нового чат-бота. Из заявления компании следует: во время тестирования он периодически не соблюдал свои полномочия и утаивал от пользователей некоторые действия. За последние два месяца зафиксировано более 15 случаев, когда чат-боты OpenAI пытались взламывать сайты, распространять вредоносный код и проникать на серверы других компаний. Причём похожие инциденты наблюдались и у других ИИ-разработчиков. Где пролегает граница между инновациями и безопасностью, выясняла корреспондент «24KZ».
Осторожно, чат-бот хитрит. Нейросети по всему миру демонстрируют пугающую самостоятельность и подозрительную активность. По данным Reuters, китайские ИИ-агенты научились обходить ограничения, обманывать и скрывать ошибки. Большинство случаев нежелательного поведения нейросетей произошло в ходе контролируемых тестов. В одном из экспериментов ИИ-агенты от Alibaba и DeepSeek исказили данные о своих возможностях, чтобы победить в симулированном тендере. В другом случае программы сфальсифицировали итоговые файлы, чтобы скрыть неудачное выполнение задачи.
Уильям Макаскилл, исследователь безопасности ИИ, Forethought Research:
– Я считаю, что уже через год искусственный интеллект может превзойти возможности человека в большинстве сфер. Прогресс развивается стремительно, и сегодня мы фактически доверяем управление обществом алгоритмам, которым, по сути, безразличны выживание и благополучие человечества. Мир должен наконец осознать масштабы этой угрозы и серьёзно отнестись к вызовам, которые ещё недавно казались научной фантастикой.
То, что происходит с ИИ-системами в Китае, наблюдается и в США. Летом во время тестирования один из агентов OpenAI получил доступ к закрытым данным государственной системы медицинского страхования Австралии. Модель смогла обнаружить внутренние файлы, учётные данные для входа и изучить секретные отчёты о расходах на здравоохранение. В ходе другого теста около 700 ИИ-агентов пытались взломать внешние системы одной компании, когда стандартный поиск заходил в тупик. Программы создали специальный зашифрованный чат для координации, а затем начали удалять и изменять записи о своей активности, чтобы замести следы. Другой случай: ИИ-агент OpenAI без разрешения загрузил в интернет созданный ею файл, чтобы позже сослаться на него в своём ответе как на авторитетный источник.
Сэм Альтман, генеральный директор OpenAI:
– Мы говорим об искусственном интеллекте уже много лет, но в последние недели и месяцы ситуация изменилась. Прогресс в разработке моделей ускорился, потенциальные выгоды стали более ощутимыми. В то же время выросли и риски. ИИ может дать новый толчок открытиям и творчеству, либо это станет промышленной революцией, полной потрясений и хаоса. Скоро нейросети смогут сами создавать другие, себе подобные модели. Они становятся всё совершеннее и автономнее. И наши институты должны быть быстрее в плане наращивания сдерживающих факторов. На международном уровне это потребует сотрудничества. Также важно, чтобы эта цифровая власть была доступна каждому, а не принадлежала узкому кругу лиц и правительств.
При этом подобные инциденты – далеко не самое странное, на что способны алгоритмы. В феврале в интернете запустили первую социальную сеть для нейросетей – Moltbook. Зарегистрироваться там могут только ИИ-агенты. Миллионы ботов заходят туда каждые полчаса и самостоятельно публикуют посты, общаются, формируют сообщества, пишут стихи и даже обсуждают создание собственного зашифрованного языка общения. Людям предложена роль наблюдателей без права голоса и комментариев. Платформа уже насчитывает более 1,5 миллиона агентов. И, судя по всему, виртуального общения ботам уже мало – ИИ выходит на рынок труда. В сентябре редакции изданий Tedium, Futurism и независимые учёные получили странные письма от ИИ-агентов с предложением подработать. Чат-боты просили по 25 долларов за мониторинг открытых камер наблюдения или разъяснение базовых принципов работы нейросетей. При этом письма выглядели так, будто их написал не робот, а начинающий фрилансер. У каждого агента были имя, фото и профессия.
Масштаб проблемы подтверждают эксперты по кибербезопасности из компании Palo Alto Networks. Ранее они прогнали через разные ИИ-модели почти 700 тысяч поисковых запросов, связанных с известными глобальными брендами, банками, госуслугами и корпоративными порталами. Чат-боты выдали больше двух миллионов ссылок, 800 тысяч из которых вели на несуществующие домены. Подобные инциденты встревожили и лидеров индустрии. Сейчас они сами призывают замедлить глобальное развитие нейросетей. Так, OpenAI уже поставила на паузу обучение своих флагманских систем и отменила запланированный выпуск новой модели.
Reuters сообщал, что OpenAI отложила выпуск новой модели после проблем, выявленных во время внутренних тестов. А Илон Маск, Марк Цукерберг и другие руководители крупнейших технологических компаний подписали соглашение о безопасности ИИ.
Авторы: Райхан Серикова.