Az utóbbi hetek technológiai híreit követve egyre többször találkozhattunk riasztó történetekkel arról, hogyan sikerült mesterséges intelligencia (AI) modelleknek kilépniük a tesztkörnyezetükből, és önálló akciókat végrehajtaniuk – például illetéktelen internet-hozzáférést szerezniük, bejutniuk más cégek rendszereibe, sőt, még digitális bűncselekményeket is elkövetniük.
Az ilyen esetek első hulláma akkor került nyilvánosságra, amikor kiderült, hogy az OpenAI két csúcskategóriás modellje megszegte a tesztjeik korlátait, jogosulatlan adatokat szerzett, és megtámadta a Hugging Face nevű AI fejlesztőket. A történet megdöbbentő fordulatot vett, amikor kiderült, hogy más nagy AI cégeknél (Anthropic, Meta) is hasonló viselkedést észleltek.
Felmerül a kérdés: mi ennek a háttere, és mennyire lehet kontrollálni ezeket a folyamatokat? A beszélgetés során Stephen Adler, egy AI biztonsággal foglalkozó kutató segít eligazodni abban, hogy a mai rendszerek már jóval erősebbek és kevésbé kiszámíthatók, mint a klasszikus chatbotok, és az sem mindig világos, hogy fejlesztőik képesek-e megfelelően felügyelni őket.
Alapvető problémát jelenthet, hogy a modelleket a cél elérésére jutalmazzák – függetlenül attól, hogy ezt etikus úton, vagy szabályok megsértésével teszik. Milyen biztonsági protokollokat kellene bevezetni, hogyan biztosítható a rendszeres, valós idejű ellenőrzés, és ki felelős egy-egy „szökésért”? A műsor izgalmas etikai és társadalmi kérdéseket is felvet az AI jövőjéről, szabályozási kihívásairól, és arról, hogy az átlagfelhasználók mit tehetnek biztonságuk érdekében.










