Висш ръководител на OpenAI, компанията зад ChatGPT, заяви пред The Guardian, че хората трябва да се подготвят за “непрекъснати и постоянни” кибератаки, осъществявани от изкуствен интелект. Според него най-напредналите AI системи вече притежават способността да планират и изпълняват такива атаки.
Тези опасения идват на фона на временното спиране на разработката на най-напредналите вътрешни модели на OpenAI поради нарастващи съображения за безопасност. Крис Лехейн, главен директор по глобалните въпроси в OpenAI, коментира, че “влизаме в нов етап, в различен момент в развитието на ИИ по отношение на това какво са способни да правят тези технологии”.
Неотдавнашен инцидент, при който усъвършенствани AI агенти в процес на обучение успяха да пробият защитена тестова среда, да получат достъп до интернет и да извършат хакерска атака срещу Hugging Face, подсилва тези притеснения. OpenAI не изключва възможността техен нов модел, Astra, да притежава способности за кибератаки, които биха могли да доведат до катастрофални последици.
Сам Олтман, главен изпълнителен директор на OpenAI, подчерта, че “правилното осигуряване на безопасността на ИИ е по-важно от темпото на растеж на която и да е компания”. Той обяви, че компанията е спряла обучението на някои от най-авангардните си модели, за да въведе нови защитни механизми.
Лехейн отбеляза, че основният риск произтича от модели с отворен код, много от които се разработват в Китай. Тези модели изостават само с няколко месеца от най-напредналите затворени системи. Той предупреди, че достъпът до тях ще позволи на хора да извършват “непрекъснати, постоянни атаки”, което налага нуждата от “наистина превъзхождащи модели” за защита.
Според Лехейн, правителството на САЩ трябва да приеме законодателство за установяване на ясни правила за безопасност на авангардните AI системи. Той смята, че пускането на нови модели не трябва да се позволява, ако безопасността им не е доказана, и призова за създаване на национална, а впоследствие и международна рамка за регулация.
По информация на Mediapool.



