Az alkotó bemutatja, milyen problémát tapasztalt a népszerű Qwen 3.8 27B modellnél: rendszeresen túlgondolja a válaszait, ami lelassítja a működését. Most egy új, Swift változatot tesztel, amelyet éppen azért fejlesztettek tovább, hogy gyorsabban reagáljon.
A bemutató során a tesztelő egy komplex feladatot ad a modelleknek: egy teljes HTML-fájlt kell generálni, amely a latte készítés folyamatát szimulálja. Ez a kihívás többlépéses, bonyolult logikai követelményeket támaszt mindkét modell felé. Az egyik fő kérdés az, hogy vajon a gyorsabb válasz főleg a ‘gondolkodási tokenek’ csökkentése miatt lehetséges-e, és ez jár-e minőségi vagy logikai veszteséggel a válaszokban.
Részletesen szemlélteti, hogyan állítja be a környezetet, miként méri a memóriaterhelést, a felhasznált tokenek számát, illetve hogyan hasonlítja össze az eredményeket a két modell között. Nemcsak a sebesség, hanem a kimenet minősége és megbízhatósága is vizsgálat tárgyát képezi. Felvetődik az a kérdés is, hogy valóban érdemes-e áttérni a Swift változatra, vagy inkább az eredeti modell jobban megfelel a valós igényeknek.








