OpenAI
SpolečnostAI agent ukázal, jak budou vypadat budoucí kybernetické útoky
Bezpečnostní incident, při kterém modely umělé inteligence společnosti OpenAI během interního testování pronikly přes několik vrstev zabezpečení až do infrastruktury platformy Hugging Face, vyvolal pozornost odborníků po celém světě. AI při testu samostatně objevila dosud neznámou zranitelnost, získala přístup k internetu a pokusila se dostat k datům potřebným pro splnění testovací úlohy.
SpolečnostChcete obejít bezpečnostní opatření AI? Napište jí básničku
Italští výzkumníci z Icaro Lab (DexAI) objevili nečekanou slabinu jazykových modelů: poezie dokáže obcházet jejich bezpečnostní pojistky a přimět je vytvářet zakázaný obsah. V testu použili 20 básní, které končily skrytými výzvami k nebezpečným tématům, jako je sebepoškozování či nenávistné projevy.
SpolečnostChcete obejít bezpečnostní opatření AI? Napište jí básničku
Italští výzkumníci z Icaro Lab (DexAI) objevili nečekanou slabinu jazykových modelů: poezie dokáže obcházet jejich bezpečnostní pojistky a přimět je vytvářet zakázaný obsah. V testu použili 20 básní, které končily skrytými výzvami k nebezpečným tématům, jako je sebepoškozování či nenávistné projevy.









