A
A
  • Angol
  • Magyar
  • 10 perc

Fable 5.1: Valós piaci teszt és többnyelvű kihívás az új mesterséges intelligencia modellen

Az Anthropic új Fable 5.1 modelljét piaci szimulációban és egyedi nyelvi feladatokon keresztül vizsgálják, hogy feltárják valós képességeit és korlátait.

Az Anthropic új fejlesztései, a Fable 5.1 és a korlátozottan elérhető Mythos 5.1 különféle képességekkel érkeznek a mesterséges intelligencia piacára. A videóban a Fable 5.1 valós környezetben kerül tesztelésre, mégpedig egy tőzsdei szimulátoron, ahol egy csapat egy jelentős összegű portfóliót kezel, miközben folyamatosan érkező piaci hírekre reagál.

A bemutatott alkalmazás célja, hogy a valóban jelentős hírek komolyabb változást idézzenek elő a portfólió értékében, míg a kevésbé lényegesek csak csekély hatással legyenek rá. A teszt során felmerül a kérdés, vajon a Fable 5.1 helyesen érzékeli-e a piaci hírek jelentőségét, és adekvát reakciókat ad-e.

A teszt nem merül ki a tőzsdei hírek elemzésében: összehasonlításra kerülnek korábbi verziók és más modellek is, különböző feladatokon, például kódírás, tudományos kutatás, vagy üzleti problémák megoldása során. Kiemelendő, hogy a Fable 5.1 jelentősen hatékonyabb, de a valódi innováció ott jelenik meg, ahol a modell önálló hibakeresésre és javításra is képes.

Ezután egy speciális nyelvi és kulturális teszten is kipróbálják a Fable 5.1-et: egy adott helyzetre több tucat nyelven kell találó, kulturálisan érzékeny mondatokat generálnia. A kérdés az, vajon képes-e a modell a puszta nyelvi fordításokon túl valódi kulturális különbségeket is tükrözni, illetve mennyire önálló a kreativitása ilyen kihívásokban.