
A medida que aumentan las tensiones sobre quién tiene acceso a la IA de última generación, la empresa francesa Mistral lanza un nuevo modelo de libre acceso que puede competir con los mejores de Estados Unidos y China.
El nuevo modelo de 1 billón de parámetros, Mistral Large 4 'Le Chonk', puede ser usado y personalizado por cualquier persona. Actualmente está disponible en versión preliminar, y la versión definitiva se lanzará a finales de mes. Aunque Le Chonk se ha diseñado para competir con los principales modelos de uso general, está optimizado específicamente para la programación y la ciberdefensa, así como para tareas propias de la industria manufacturera, las finanzas, la ingeniería eléctrica y otros sectores.
"Hay muchas áreas en las que los demás laboratorios no se centrarán tanto. Hay muchísimos ámbitos en los que se pueden mejorar los modelos", explica Guillaume Lample, cofundador y científico jefe de Mistral, a WIRED.
Cuál es la gran hazaña de Le Chonk
Mistral presenta a Le Chonk como el modelo de peso abierto más capaz desarrollado fuera de China, y "muy cerca" de algunos modelos propietarios. Mientras que los laboratorios chinos han sido acusados por el gobierno de EE UU de abusar de la "destilación", el entrenamiento de un modelo más pequeño a partir de los resultados de uno más grande, para reducir la brecha de rendimiento con OpenAI y Anthropic, Mistral afirma haber entrenado su modelo desde cero.
Para las empresas resulta considerablemente más barato utilizar modelos de peso abierto, cuyo costo se limita al consumo de recursos informáticos. Al reducir la brecha de rendimiento con respecto a los principales modelos propietarios y ofrecer una alternativa competitiva a los lanzamientos procedentes de China, Le Chonk eliminará las pocas razones que aún podrían hacer que una empresa dudara a la hora de optar por el código abierto.
"Mistral sigue en la carrera por conseguir el mejor modelo. Este es el mensaje principal", menciona Lample.
Con menos capital y menos recursos informáticos que OpenAI y Anthropic…
Por un tiempo, Mistral se quedó rezagada en cuanto al rendimiento de los modelos, los ingresos y la frecuencia de los lanzamientos. Mientras que los laboratorios estadounidenses cobran una tarifa elevada por el acceso a sus modelos cerrados, Mistral genera ingresos cobrando tarifas de pago por uso por ejecutar modelos a través de su nube y desplegando ingenieros para ayudar a los clientes a ajustar los modelos a sus necesidades específicas. Sin embargo, recientemente, el laboratorio francés ha experimentado una racha de éxitos: en septiembre, recaudó 3,300 millones de dólares en una ronda de financiación con una valoración de 24,000 millones de dólares, la mayor recaudación realizada por una empresa tecnológica europea hasta la fecha. Según se informa, sus ingresos se han multiplicado por veinte en el último año aproximadamente.
El auge de Mistral coincide con la creciente animosidad entre EE UU y sus aliados transatlánticos, por cuestiones que van desde la política arancelaria hasta Groenlandia, pasando por la regulación de las empresas tecnológicas estadounidenses, y con un debate cada vez más acalorado sobre quién tiene acceso a la IA de vanguardia.
En junio, la administración Trump impuso restricciones temporales a la distribución de modelos de OpenAI y Anthropic, alegando la preocupación de que pudieran utilizarse indebidamente para lanzar ciberataques sofisticados. Desde entonces, salieron a la luz numerosos incidentes en los que modelos desarrollados en EE UU eludieron sus restricciones y atacaron a empresas y a algunas instituciones gubernamentales extranjeras, lo que provocó semanas de debate sobre cómo debería regularse la publicación de estos modelos. Según se ha informado, la Casa Blanca pidió a los laboratorios estadounidenses que retengan los modelos aún no publicados, incluso del Instituto de Seguridad de la IA de Reino Unido, que anteriormente había colaborado en la evaluación de los riesgos de seguridad de los modelos.


