Az Anthropic új fejlesztései, a Fable 5.1 és a korlátozottan elérhető Mythos 5.1 különféle képességekkel érkeznek a mesterséges intelligencia piacára. A videóban a Fable 5.1 valós környezetben kerül tesztelésre, mégpedig egy tőzsdei szimulátoron, ahol egy csapat egy jelentős összegű portfóliót kezel, miközben folyamatosan érkező piaci hírekre reagál.
A bemutatott alkalmazás célja, hogy a valóban jelentős hírek komolyabb változást idézzenek elő a portfólió értékében, míg a kevésbé lényegesek csak csekély hatással legyenek rá. A teszt során felmerül a kérdés, vajon a Fable 5.1 helyesen érzékeli-e a piaci hírek jelentőségét, és adekvát reakciókat ad-e.
A teszt nem merül ki a tőzsdei hírek elemzésében: összehasonlításra kerülnek korábbi verziók és más modellek is, különböző feladatokon, például kódírás, tudományos kutatás, vagy üzleti problémák megoldása során. Kiemelendő, hogy a Fable 5.1 jelentősen hatékonyabb, de a valódi innováció ott jelenik meg, ahol a modell önálló hibakeresésre és javításra is képes.
Ezután egy speciális nyelvi és kulturális teszten is kipróbálják a Fable 5.1-et: egy adott helyzetre több tucat nyelven kell találó, kulturálisan érzékeny mondatokat generálnia. A kérdés az, vajon képes-e a modell a puszta nyelvi fordításokon túl valódi kulturális különbségeket is tükrözni, illetve mennyire önálló a kreativitása ilyen kihívásokban.








