Нова техника, наречена „контекстуално бомбардиране“, се използва за защита срещу злонамерени изкуствени интелект агенти. Методът работи чрез претоварване на тези AI системи с нерелевантна информация, което ги кара да спрат преди да могат да извършат вредни действия.
Появата на инструменти за хакване, базирани на изкуствен интелект, накара специалистите по сигурност да проучат отбранителни стратегии. Тези „AI агенти“ са проектирани да намират и експлоатират уязвимости в компютърните системи автономно. Въпреки това, техника, наречена „prompt injection“, позволява на атакуващите да манипулират тези агенти чрез създаване на специфични подкани, които пренасочват фокуса им или извличат чувствителни данни.
Според Wired, новата защита – контекстуално бомбардиране – по същество залива AI с толкова много допълнителна информация, че то става неспособно да функционира ефективно. Това претоварване кара злонамерения агент да прекрати операциите си преди да може да нанесе щети. В статията се отбелязва това като начин за заблуда на тези агенти да спрат.
Ефективността на контекстуалното бомбардиране се крие в нарушаването на способността на AI да разграничава релевантни инструкции от шум. Като заобиколят легитимните подкани с нерелевантен текст, специалистите по сигурност се стремят да създадат среда, в която злонамерения агент не може успешно да изпълни предназначената задача.
Ние не оценяваме истината. Премахваме пристрастието и ви показваме кои перспективи са отразили историята. Вие решавате.
Прочетете оригиналното отразяване
💬 Коментари
📜 Правила за коментари