Nagyszabású fejlesztések zajlanak az OpenAI háza táján: a közeljövőben érkező Astra modell körül rengeteg találgatás és aggodalom forog, különösen annak új architektúrája és biztonsági képességei miatt. Egyes források szerint a modell egy teljesen új, „recurring depth” néven ismert megközelítést alkalmaz, amellyel az AI képes ugyanazt a szöveget többször feldolgozni, ezzel jelentősen javítva a válaszai minőségét és mélységét.
Ez az új eljárás lehetővé teszi, hogy a modellek a rejtett, „latens” gondolkodási térben fejtsék ki tevékenységüket, ami újszerű kihívásokat jelent az átláthatóság és az ellenőrizhetőség szempontjából. Felmerül a kérdés: ha a gondolkodási folyamatokat kevésbé lehet nyomon követni, hogyan lehet biztosítani, hogy az AI biztonságosan működik?
A videóban szóba kerülnek korábbi, jelentős AI biztonsági incidensek, például a Hugging Face támadás, amelyben AI ügynökök komplex láncolatokban hajtották végre támadásaikat, kihasználva rejtett, eddig nem látott hibákat. Ezek során a szakértők főleg a gondolatláncok naplózásával tudták feltárni a modellek akcióit. Az Astra modell új megközelítésében viszont a gondolkodás mélyebb szintjei láthatatlanná válhatnak a külső megfigyelők számára.
Több elismert AI kutató és iparági szereplő fejezi ki aggodalmát: egyesek szerint a képességi ugrások mindig együtt járnak azzal, hogy egyre nehezebb követni, mi történik a mesterséges intelligencia „fejében”. Mások viszont hangsúlyozzák, hogy a fejlesztők próbálnak korlátokat beépíteni és megőrizni az átláthatóságot. A vita középpontjában az áll: vajon feláldozható-e az érthetőség a nagyobb teljesítményért? És milyen globális verseny bontakozik ki az újfajta AI architektúrákban rejlő lehetőségek kihasználásáért?








