Különböző GPT-6 Astra erőfeszítési szinteket tesztel végig a szerző, hogy megtudja, hogyan befolyásolja a modell válaszainak minőségét, sebességét és a felhasznált tokenek számát az, hogy alacsony, közepes, magas vagy akár maximális erőfeszítési szinten fut-e a feladat.
A kísérlet során minden egyes erőfeszítési szintet ugyanazzal a kutatási és fejlesztési projekttel próbáltak ki, sőt, a korábbi Soul modellen is teszteltek az összehasonlítás kedvéért. Részletesen bemutatásra kerül, hogy az egyes szintek mennyi időt vesznek igénybe, hány tokent fogyasztanak el, milyen megoldásokat javasolnak, illetve mennyit dolgoznak ki önállóan egy vállalkozási ötlet feltérképezésén.
A videóban több ponton is felmerül a kérdés: vajon a magasabb erőfeszítési szint ténylegesen jobb eredményt produkál, illetve az autonómia, a részletesség vagy az önálló gondolkodás növekszik-e ilyenkor? Érdekes megfigyelni, hogy a tokenhasználat, az idő és az eredmények minősége sokszor nem arányosan változik. Az is szóba kerül, hogy a régebbi modellek, például a Soul, bizonyos esetekben mennyire versenyképesek maradnak.
Felvetődik a dilemma, hogy a legtöbb hétköznapi feladatnál érdemes-e egy gyorsabb, költséghatékonyabb erőfeszítési szintet választani, vagy tényleg szükség van a legmagasabb szintű erőforráshasználatra. Mindeközben a tesztelés módszertanáról, az átláthatóságról és a különböző funkciók használatáról is szó esik, például a különböző párhuzamos szálak indításáról.










