← Todos los insights

Análisis de noticiaEnfoque: España y Latinoamérica4 min de lectura

Mistral Large 4 es una API hoy y pesos abiertos a fin de mes. Use la ventana para decidir quién lo opera

Mistral lanzó Large 4 en preview pública, con 1 billón de parámetros y 52 mil millones activos, y promete pesos descargables para finales de octubre. Las semanas intermedias son una ventana de prueba.

Escuche este artículo · 5 min

Narración completa del artículo, generada con IA.

Una plántula joven creciendo desde el suelo, en duotono La Madre, junto a las palabras Alquilar hoy, tener mañana
Foto: rawpixel (CC0)

La mayoría de las decisiones empresariales sobre modelos obligan a un compromiso anticipado. Alquile una API alojada y acepte la custodia del proveedor sobre sus prompts, o descargue pesos abiertos y acepte el trabajo de ejecutarlos. Mistral Large 4, lanzado en preview pública el 6 de octubre, ofrece las dos cosas por un tiempo breve, una después de la otra: una API ahora y pesos descargables que, según Mistral, llegarán a fin de mes.

Esa secuencia es útil si un equipo trata las semanas intermedias como una ventana de evaluación y no como una decisión ya tomada.

Qué lanzó Mistral

Large 4 es un modelo de mezcla de expertos con alrededor de 1 billón de parámetros totales y 52 mil millones activos por token. Acepta texto e imágenes. Mistral pone precio a la preview de la API en US$ 1,36 por millón de tokens de entrada y US$ 4,18 por millón de tokens de salida, y orienta el modelo hacia ciberseguridad, ingeniería de software, flujos de trabajo agénticos, finanzas, derecho, manufactura y trabajo científico.

Mistral dice que entrenó el modelo desde cero en 3.800 GPU NVIDIA Grace Blackwell en sus propios centros de datos europeos, y que lo sirve en varias regiones, incluido un despliegue europeo que Mistral opera de extremo a extremo, “independientemente de otros proveedores de servicios digitales y bajo la legislación europea”. Los resultados de benchmark del anuncio, como 82% en una prueba de parcheo de vulnerabilidades y 93% en Cybench, son de Mistral.

El propio anuncio incluye dos advertencias. Los pesos están por llegar, no están aquí, y Mistral todavía no ha publicado su licencia. Y el entrenamiento con aprendizaje por refuerzo sigue “en curso”.

Cuatro formas de ejecutar el mismo modelo, según quién tiene la custodia

Mistral operaUsted opera

  1. API de Mistral, cualquier regiónDisponible en preview
  2. Despliegue europeo de MistralOperado por Mistral, bajo legislación europea
  3. Pesos en su nube privadaTras el lanzamiento, sujeto a licencia
  4. Pesos en su centro de datosCustodia total, responsabilidad total de operación
El modelo es el mismo a lo largo de la línea. Lo que cambia es quién ve los prompts, quién parchea el stack de servicio y quién responde cuando falla.

El modelo que usted prueba todavía está cambiando

“En curso” tiene un significado práctico. El modelo que un equipo evalúa a través de la API en octubre puede no ser el mismo cuyos pesos descargue a fin de mes, y puede no comportarse igual una vez servido sobre un stack distinto con una cuantización distinta.

Así que los resultados de la preview son provisionales. Congele ahora el conjunto de evaluación, ejecútelo contra la API y vuelva a ejecutar el mismo conjunto sobre los pesos publicados, en la configuración de servicio que usaría de verdad. Como escribimos sobre la retirada de modelos, un cambio de modelo es un lanzamiento, y este lleva un cambio incorporado en su lanzamiento.

Cuatro preguntas que responder antes de que lleguen los pesos

¿Qué permite la licencia? Hasta que se publique, ningún plan de autoalojamiento es real. El uso comercial, la redistribución, el fine-tuning y cualquier restricción de uso deciden si el lado derecho de la línea anterior existe para usted o no.

¿Puede servirlo? Solo 52 mil millones de parámetros están activos por token, pero un despliegue estándar sigue manteniendo el billón completo en memoria, del orden de un terabyte de memoria de acelerador a precisión de 8 bits. Eso es un clúster de varias GPU, no una estación de trabajo.

¿Quién lo opera? Esta semana, al escribir sobre Beam de Reflection, sostuvimos que con pesos abiertos, la responsabilidad de operación pasa a usted: la capacidad, el parcheo, la monitorización y la evaluación pasan a ser trabajo de su equipo. Large 4 es una prueba más grande del mismo argumento. Para las empresas de España y del resto de la UE, el despliegue europeo de Mistral, operado bajo legislación europea, es una opción real de custodia para la API alojada, junto con las obligaciones del RGPD. Para las empresas de América Latina (México, Colombia, Chile, Argentina), ese despliegue europeo sigue siendo una jurisdicción extranjera, no residencia local: la custodia local exige autoalojar los pesos.

¿Qué precio tiene que superar? La preview alojada fija un punto de referencia. Un despliegue autoalojado tiene que superar US$ 1,36 y US$ 4,18 por millón de tokens con su volumen real, incluida la capacidad ociosa y las personas que lo operan, o bien ofrecer una custodia que la API no puede.

Los pesos abiertos son lo que hace noticiable a Large 4. Para una empresa, la parte más valiosa puede ser el mes anterior: la oportunidad de medir el modelo en sus propias tareas mientras la opción alojada sigue siendo la barata de probar, y de decidir quién debería ejecutarlo con evidencia en la mano.

¿Tiene un caso de uso de IA detenido entre el prototipo y la producción?

Cuéntenos qué quiere poner en marcha. Le respondemos con próximos pasos honestos.

Conversemos sobre un caso de uso