A
A
  • Angol
  • Magyar
  • 9 perc

Valós idejű mesterséges intelligencia próbája az Inclusion AI-tól

Egy új, teljes duplex mesterséges intelligencia rendszert próbáltak ki helyben futtatva, amely egyszerre képes hallgatni és beszélni, valamint a vizuális tartalmakat is értelmezi.

Az Inclusion AI által fejlesztett valós idejű mesterséges intelligencia rendszer új korszakot ígér a duális kommunikációban. A rendszer egyszerre képes hallgatni és beszélni, miközben a látott és hallott információkat is képes értelmezni. A fejlesztők szerint az alkalmazás képes háttérfeladatokat delegálni, hosszú videókra emlékezni, valamint különféle interaktív feladatokat ellátni.

Bemutatásra kerül, hogyan lehet ezt a modellt helyben futtatni grafikus felületen keresztül, saját script segítségével, és valós példákon keresztül tesztelik a válaszsebességet, illetve a rendszer reakcióidejét. Felmerül kérdésként, hogy mennyire működik valós időben, mennyire képes természetes beszélgetési élményt nyújtani, valamint hogyan birkózik meg összetettebb kérésekkel vagy hétköznapi helyzetekkel.

A technológiai háttér is szóba kerül: a modell az N Group és a Tsinghua Egyetem fejlesztése, amely több különálló mesterséges intelligencia modellt kombinál (pl. MiniCPM 4.5, SigLip 2, Whisper medium). Az architektúra egyik különlegessége, hogy egyidejűleg képes az interakciók kezelésére és bonyolultabb háttérműveletek koordinálására is. Ezek mellett szó esik a felhasználói tapasztalatokról is, kiemelve azokat a pontokat, ahol az ígéretek és a valós teljesítmény között eltérések tapasztalhatók.