
Mistral presenta Large 4, un modelo de un billón de parámetros para ciberseguridad
La empresa francesa Mistral AI mostró el 6 de octubre su nuevo modelo insignia, Mistral Large 4, que en la compañía ya llaman “Le Chonk” por su tamaño. Tiene un billón de parámetros en total, aunque gracias a su arquitectura de mezcla de expertos solo activa 49.000 millones por consulta, lo que le permite responder sin necesitar toda esa potencia de golpe.
“Es la apuesta más fuerte de la compañía francesa hasta ahora para competir de cerca con los modelos de las grandes tecnológicas estadounidenses y chinas, en un terreno donde hasta ahora había quedado un escalón por detrás.”
El modelo es multimodal desde el diseño y por ahora se puede probar en una vista previa pública dentro de Mistral Studio, con las barreras de seguridad habituales activadas. Los pesos completos, la versión que cualquiera podría descargar y correr en sus propios servidores, van a liberarse recién a fin de octubre, después de un proceso de revisión con especialistas en ciberseguridad y organismos estatales.
Mistral lo entrenó con infraestructura propia en Europa y, según la compañía, usó 3.800 GPUs Nvidia, bastante menos que lo que suelen necesitar sus rivales chinos y muy por debajo de lo que insumen los modelos cerrados de Google, OpenAI o Anthropic. La apuesta de la empresa es posicionar a Large 4 como una herramienta para tareas de ciberseguridad, análisis financiero y diseño de chips, además de programación y tareas agénticas, con soporte para más de 160 idiomas.
Pierre Stock, VP de Ciencia de Mistral, explicó que antes de abrir los pesos van a trabajar con socios de confianza y gobiernos para que ese acceso sirva para defenderse de ataques y no para lanzarlos. Es la apuesta más fuerte de la compañía francesa hasta ahora para competir de cerca con los modelos de las grandes tecnológicas estadounidenses y chinas, en un terreno donde hasta ahora había quedado un escalón por detrás.


