Higgs-Llama-3-70B es un modelo entrenado posteriormente basado en Meta-Llama-3-70B, optimizado específicamente para juegos de rol, al tiempo que mantiene una competitividad en la ejecución de instrucciones y el razonamiento en dominios generales. El modelo se entrenó mediante ajuste fino supervisado, combinando anotadores humanos y pares de preferencias construidos con un gran modelo de lenguaje privado, para optimizar iterativamente la alineación del comportamiento del modelo y hacerlo más cercano a los mensajes del sistema. En comparación con otros modelos instructivos, Higgs sigue más estrechamente su rol.