Segun MarkTechPost (AI/ML News), Mistral AI ha lanzado una nueva versión de su modelo de inteligencia artificial, Mistral Large 4, conocido internamente como "Le Chonk", como prueba pública el 6 de octubre de 2026. Este modelo multimodal, basado en una arquitectura de mezcla de expertos (MoE), cuenta con un total de 1.05 billones de parámetros, activando aproximadamente 49 mil millones por token, y posee un decodificador visual de 1.6 billón de parámetros. Su ventana de contexto alcanza 1 millón de tokens, lo que permite procesar grandes volúmenes de información en una sola secuencia. La entrenamiento se realizó desde cero en 3.800 GPUs NVIDIA Grace Blackwell, ubicadas en centros de datos europeos propiedad de Mistral.
La disponibilidad del servicio se ha activado ya a través de su API, con un costo de 1,36 dólares por 1 millón de tokens de entrada y 4,18 dólares por 1 millón de tokens de salida. Sin embargo, los archivos del modelo aún no están disponibles para descarga, lo que impide que usuarios o empresas los implementen en entornos autogestionados. El desempeño destacado del modelo se observa en el ámbito de ciberseguridad, donde alcanza un 93 por ciento en Cybench y un 82 por ciento en CyberGym-E2E, posicionándolo entre los cinco mejores modelos globales en el índice de análisis artificial de ciberseguridad.
Este avance refleja un avance significativo en la capacidad de procesar datos multimodales —texto y imágenes— con eficiencia, y especialmente en tareas que requieren razonamiento y análisis detallado. La arquitectura combina instrucciones y razonamiento, lo que permite una respuesta más contextual y adaptada. Aunque el modelo no ha revelado el número exacto de expertos, el sistema de selección de capas (top-k routing) y la distribución de capas aún se entregan junto a los pesos, en una fase posterior.
Para el lector peruano, este desarrollo puede tener implicaciones directas en sectores clave como el de servicios financieros, la gestión de riesgos corporativos y el desarrollo de soluciones digitales en entidades públicas y privadas. En un entorno donde las empresas están cada vez más expuestas a amenazas cibernéticas, herramientas como esta pueden ayudar a fortalecer la defensa digital de sistemas críticos. Aunque el acceso aún está limitado por la disponibilidad de los modelos, su capacidad de procesar imágenes y texto en tiempo real abre puertas a aplicaciones en salud, educación o logística. El hecho de que el modelo esté entrenado con más de 160 idiomas, incluyendo todos los oficiales de la Unión Europea, también sugiere un potencial de adaptación a contextos multilingües, como el que existe en el Perú.
Este lanzamiento no solo marca un hito técnico, sino que también resalta la importancia de invertir en tecnologías que puedan ser aplicadas a la realidad local, especialmente en áreas donde la seguridad y la eficiencia operativa son esenciales.
