Az AI költségeinek csökkentése és az egyre gyorsabban fejlődő nyílt forráskódú modellek lehetőségei ma alapjaiban változtatják meg a vállalatok és fejlesztők AI-hoz való hozzáállását. A beszélgetés betekintést nyújt abba, hogyan jelennek meg az új, rendkívül hatékony, olcsón futtatható nyílt modellek (mint a DeepSeek Flash), és ezek hogyan teszik lehetővé, hogy a vállalatok saját igényeikre szabják az AI-jukat, miközben jelentősen visszaszorítják a költségeket.
Felmerül a helyi, lokálisan futtatott modellek kontra felhőalapú modellek kérdése, ahol a modern hardver (pl. Apple Silicon vagy Nvidia DGX Spark) már nagyobb, erősebb modellek futtatását is elérhetővé teszi akár egy átlagos fejlesztő számára is. Ezzel együtt egyre összetettebbé válik a modellek kihasználása, amikor különböző modellek és „harness”-ek ötvözésével hatékony, vegyes felhasználást lehet megvalósítani: az egyszerűbb feladatokat helyben, a bonyolultabbakat felhőben futtatva.
A videó érinti az open és zárt modellek közötti egyensúly változását, valamint azt, hogy mind a nagyvállalatok, mind a startupok egyre inkább a nyílt modellek felé fordulnak, ahol könnyen hozzáférhető az erőforrás, átgondolt orchestrációval és újfajta munkafolyamatokkal. Szóba kerül a biztonság, megbízhatóság és a modellek földrajzi eredet szerinti eltérései, amelyekre érzékenyek lehetnek az adott felhasználási területek.
Bepillantást kapunk, hogyan alakult ki az Olama fejlesztése, milyen mérföldkövek és fordulópontok szabják meg a nyílt modellek gyors elterjedését — miközben új startupok is lehetőséget kapnak arra, hogy olcsón, új feladatokra használják az AI-t láncolt, koordinált modellek segítségével.










