Meta Llama 3.3 es un modelo lingüístico extenso de preentrenamiento multilingüe (LLM) de 70 000 millones de parámetros, optimizado para casos de uso de diálogo multilingüe y que supera a muchos modelos de chat de código abierto y cerrados existentes en los puntos de referencia de la industria comunes. El modelo utiliza una arquitectura Transformer optimizada y emplea ajuste fino supervisado (SFT) y aprendizaje por refuerzo basado en retroalimentación humana (RLHF) para alinearse con las preferencias humanas de utilidad y seguridad.