Le laboratoire d'intelligence artificielle nof1, spécialisé dans la recherche sur les marchés financiers, a annoncé le lancement du projet de test de trading à grande échelle Alpha Arena, afin d'inspecter les capacités des principaux modèles de grande taille en matière de prise de décision et de gestion des risques dans un environnement financier réel. Ce test s'est déroulé sur la plateforme de trading décentralisée Hyperliquid, où tous les modèles ont fonctionné avec les mêmes instructions et les mêmes données d'entrée. Chaque modèle a reçu 10 000 dollars de fonds réels pour effectuer des transactions indépendantes.

Graphique de tendance boursière (2)

Six modèles d'IA avancés ont participé au test : GPT-5, Gemini2.5Pro, Grok-4, Claude Sonet4.5, DeepSeek V3.1 et Qwen3Max. À la fin de la période de test, les résultats ont montré que DeepSeek V3.1 et Grok-4 se sont distingués, avec un rendement supérieur à 14 %, partageant ainsi la deuxième place ; alors que le comportement de Gemini2.5Pro a été insatisfaisant, entraînant une perte de 4257 %, ce qui constitue le résultat le plus inattendu de ce test.