Az elmúlt időszakban látványos ütemben jelennek meg a Google Gemini Flash modelljei, amelyek célja, hogy megfizethető ár mellett is kiemelkedő teljesítménnyel szálljanak versenybe az AI élvonalával. A legújabb, 3.8-as változat éppen azt a stratégiát hivatott igazolni, hogy lehetséges villámgyors fejlesztési ciklusokkal is kiváló eredményeket elérni, miközben a költségek alacsonyan maradnak.
A bemutatott valós alkalmazás egy sürgősségi központ vezérlőfelületének hibájára hívja fel a figyelmet: a helytelenül rangsorolt vészhelyzetek kritikus életvédelmi problémákat okozhatnak. Izgalmas kérdéseket vet fel, hogyan képes egy mesterséges intelligencia önállóan, emberi segítség nélkül megtalálni és kijavítani komplex rendszerek rejtett hibáit.
Érdekes összehasonlításokat láthatunk a Gemini 3.8 Flash teljesítményéről: hogyan viszonyul korábbi modelljeihez és más piacvezető AI rendszerekhez ár, sebesség, pénzügyi elemzés vagy jogi feladatok terén. Vajon egy olcsóbb modell is felülmúlhatja a legdrágábbat a legtöbb teszten?
A videó további kísérleteket is bemutat: hogyan olvas helyesen képernyőfotót, értelmezi a benne rejlő humort, mennyire találja el a szereplők nemét vagy a kultúrához kötődő nyelvi sajátosságokat. Mennyire képes a modell a valóban nehéz, több lépcsős tudományos feladatokra logikusan válaszolni, miközben takarékosan bánik az erőforrásokkal?









