A
A
  • Angol
  • Magyar
  • 10 perc

Streamlake agentikus kódgeneráló tesztelése: hibakeresés és kreatív kihívások

Két valós kihívásban, egy összetett hibakeresési és egy kreatív kódgenerálási feladatban mutatják be a Streamlake új kódgeneráló modelljének önálló képességeit.

Ebben a videóban a műsorvezető a CAT Coder Pro V2.5-öt, a Streamlake legújabb fejlesztésű, agentikus kódgeneráló modelljét teszteli, különös tekintettel a modell önálló hibakeresési képességére egy valós, teljes stack-es alkalmazásban. Az alkalmazás egy tengeri kikötői konténer- és hajóforgalom-kezelő rendszer, amelybe szándékosan elhelyeztek egy bugot: a rendszer hibásan engedélyezi olyan hajók dokkolását, amelyek merülése meghaladja a kikötő maximális biztonsági értékét.

A demonstráció során a modell kap egy meghatározott célt, de semmiféle részletes, lépésenkénti iránymutatásban nem részesül, teljesen autonóm módon kell feltárnia és javítania a hibát. Eközben bemutatásra kerül az Orchestra által szervezett applikációs hackathon, és a modellel kapcsolatos korábbi tapasztalatok is felidéződnek, összehasonlítva a V2.5 verziót a régebbi kiadásokkal.

Az első teszt során a modell nemcsak a valódi hibát kezeli sikeresen, hanem néhány, valójában nem létező problémát is megpróbál kijavítani. Felmerül a kérdés: mennyire megbízhatóak ezek az autonóm kódgeneráló modellek a való világban, főleg amikor feleslegesen vagy hibásan is módosítanak működő kódot?

A második kihívás már nem hibakeresés, hanem kreatív front-end kódgenerálás: az elvárás egy vízi csúszdarendszert szimuláló önálló HTML/CSS animáció volt, képek és külső könyvtárak nélkül. Itt megfigyelhető, hogy mennyire képes ugyanaz a modell egy alapvetően eltérő feladat – kreatív, vizuális megalkotás – elvégzésére.

A videó így több szempontból – hibakeresés, mesterséges intelligencia autonómia, kreatív kódgenerálás – vizsgálja, mire képesek a legújabb AI-alapú fejlesztőeszközök, és milyen kihívások merülnek fel használatuk során.