El laboratorio de inteligencia artificial nof1, especializado en investigación en mercados financieros, anunció el lanzamiento del proyecto de prueba de trading con modelos grandes Alpha Arena, para evaluar la capacidad de toma de decisiones y control de riesgos de diferentes modelos grandes principales en un entorno financiero real. Esta prueba se llevó a cabo en la plataforma descentralizada Hyperliquid, todos los modelos operaron con la misma instrucción y entrada de datos uniforme, cada modelo recibió 10.000 dólares en fondos reales para realizar transacciones independientes.

Participaron en la prueba seis modelos de IA líderes, que son GPT-5, Gemini2.5Pro, Grok-4, Claude Sonet4.5, DeepSeek V3.1 y Qwen3Max. Al finalizar el período de prueba, los resultados mostraron que los más destacados fueron DeepSeek V3.1 y Grok-4, ambos con rendimientos superiores al 14%, compartiendo el segundo lugar; mientras que el desempeño de Gemini2.5Pro fue deficiente, experimentando una pérdida del 4257%, convirtiéndose en el resultado más inesperado de esta prueba.
nof1 indicó que el objetivo de Alpha Arena no es comparar simplemente la superioridad de los modelos, sino validar la estabilidad de las estrategias y los mecanismos de respuesta al riesgo de diferentes arquitecturas en mercados con alta volatilidad, proporcionando referencias técnicas y metodológicas para el futuro trading cuantitativo basado en IA. La puesta en marcha de este experimento también refleja que los grandes modelos están avanzando rápidamente de las tareas de comprensión y razonamiento de texto hacia escenarios reales de toma de decisiones financieras y gestión de activos.





