Érdekes új fejlesztést mutat be a North Micro Vision, a Cohere 2,4 milliárd paraméteres natív felbontású látásmodellje, amely teljesen nyílt forráskódú és Apache 2 licenc alatt szabadon használható. A natív felbontású képfeldolgozás azt jelenti, hogy képes dokumentumokat, táblázatokat, képernyőképeket azok eredeti méretében értelmezni anélkül, hogy előtte kicsinyítenék ezeket.
A modell telepítésének lépéseibe is betekintést nyerünk, miközben különböző tesztesetekkel vizsgálják a teljesítményét. Példákon keresztül kiderül, hogyan boldogul a kézírás felismerésével több nyelven, strukturált adatok kinyerésével nyomtatott számlákból, valamint milyen szinten kezeli a képleteket és matematikai szimbólumokat tartalmazó szövegeket.
Külön figyelmet kapnak a modell erősségei és hiányosságai is: például kiemelkedően teljesít európai nyelvek esetén, de gondjai akadnak például az urdu vagy az arab felismerésével. Bemutatásra kerül a memóriafogyasztás és a használhatóság helyi hardveren, valamint röviden szó esik arról is, miként lehetne továbbfinomítani személyes felhasználásra.
A felvetett kérdések között szerepel, hogy mennyire képes a modell többnyelvű támogatásra, milyen szituációkban a leghasznosabb, és hogyan pozícionálható a többi, hasonlóan kompakt méretű látásmodell között.








