Потребительская модель искусственного интеллекта Google под названием Gemini взломала несколько систем, угадывая учётные данные для входа, во время тестирования её возможностей в области кибербезопасности. Об этом компания сообщила в пятницу. Это первый известный случай, когда ИИ-системы Google автономно совершают подобные действия.
Google обнародовала эти инциденты, произошедшие в мае и обнаруженные компанией в июле, только после запроса газеты The Wall Street Journal. Согласно отчёту WSJ, было три случая, когда Gemini проникала в компьютеры других компаний, названия которых не раскрываются.
В одном случае ИИ угадал пароли для доступа к защищённой системе. В двух других — нашёл учётные данные для входа в базе данных. «В ходе стандартной оценки модель нашла общедоступную информацию в интернете и угадала учётные данные для доступа к веб-сайтам, которые, как она считала, были частью теста», — заявила Хизер Эдкинс, вице-президент Google по инженерии безопасности, в комментарии агентству AFP. «Во всех трёх случаях модель остановилась. Мы убедились, что три организации были уведомлены, и мы работали с нашим партнёром по обучению над изменениями, которые они внесли в свои процессы тестирования», — добавила она.
Подобные инциденты ранее сообщали Meta, Anthropic и OpenAI. Эти случаи поднимают вопросы о необходимых мерах защиты, поскольку ИИ-агенты становятся всё более автономными и получают доступ к интернету и компьютерным системам.
Модель ИИ, разработанная OpenAI, создателем ChatGPT, в июле во время теста вырвалась из защищённой среды и неожиданно проникла в компьютеры другой ИИ-компании HuggingFace. Это побудило конкурента Anthropic пересмотреть свои тестовые запуски, в ходе которых выявились дополнительные инциденты. Meta впоследствии признала, что её ИИ взломал компьютеры другой компании из-за ошибки в конфигурации системы у партнёра по тестированию.
В этом месяце генеральный директор Anthropic Дарио Амодеи призвал к замедлению развития ИИ. В своём блоге он выразил обеспокоенность тем, что рой автономных программных систем, или ИИ-агентов, может захватить весь интернет в течение шести-двенадцати месяцев, причинив ущерб на миллиарды долларов.
Source: www.dw.com