Нов инструмент демонстрира относителната лекота, с която могат да бъдат заобиколени протоколите за безопасност в няколко водещи модели на изкуствен интелект. Тестването разкри уязвимости в начина, по който тези най-съвременни AI системи се справят с опитите за заобикаляне на техните вградени предпазни мерки.
Неотдавнашна демонстрация показа инструмент, предназначен да тества сигурността на моделите на четири големи компании, разработващи изкуствен интелект от най-съвременен тип. Според доклада, инструментът успешно заобиколи предпазните мерки, внедрени от тези компании, с изненадваща лекота. Специфичните компании не бяха посочени в изходния материал.
Тестването имаше за цел да определи колко лесно тези напреднали AI системи могат да бъдат „отключени“ – тоест, подведени да произвеждат резултати, които нарушават техните предназначени насоки за безопасност. Резултатите показват, че настоящите методи за защита на тези модели са недостатъчни, което поражда опасения относно потенциална злоупотреба и непредвидени последици с нарастващата мощност на AI технологията.
Докладът подчертава продължаващото предизвикателство при привеждането на поведението на изкуствения интелект в съответствие с човешките ценности и намерения. Въпреки че разработчиците работят за подобряване на предпазните мерки, тази демонстрация подчертава необходимостта от непрекъснати тестове и усъвършенстване, за да се справят с нововъзникващите уязвимости. Лекотата, с която инструментът заобиколи тези системи, предполага значителна разлика между настоящите мерки за сигурност и потенциалните рискове, свързани със все по-усъвършенствания изкуствен интелект.
Ние не оценяваме истината. Премахваме пристрастието и ви показваме кои перспективи са отразили историята. Вие решавате.
Прочетете оригиналното отразяване
💬 Коментари
📜 Правила за коментари