Un consorcio de investigación alemán liberó Soofi S 30B-A3B, un modelo de lenguaje abierto entrenado por completo en la infraestructura de nube de Deutsche Telekom en Múnich. El modelo, cuyos detalles figuran en su ficha oficial, supera a todos sus competidores plenamente abiertos tanto en pruebas de rendimiento en alemán como en inglés.
La cifra que da nombre al modelo apunta a su tamaño: 31.600 millones de parámetros, los valores internos que una red neuronal ajusta durante el entrenamiento y que determinan cómo responde. Pero Soofi S no los usa todos a la vez. Emplea una arquitectura híbrida de mezcla de expertos, que activa solo una fracción de esos parámetros por cada token procesado, lo que reduce el costo de cómputo sin sacrificar capacidad.
Eficiencia sostenida en contextos largos
Ese diseño busca mantener el rendimiento estable incluso cuando el modelo procesa textos muy extensos. En la práctica, significa que la velocidad de generación no se desploma al trabajar con entradas largas, un problema habitual en modelos de gran tamaño. El enfoque recuerda al que popularizó DeepSeek con su arquitectura de expertos, aunque aquí el foco está puesto en el idioma alemán.
El conjunto de datos de entrenamiento se inclinó deliberadamente hacia el alemán, una decisión poco común en un sector dominado por modelos entrenados mayoritariamente en inglés. Aun así, el modelo no perdió terreno en inglés: según sus responsables, encabeza los resultados frente a rivales de código plenamente abierto en ambos idiomas.
Un proyecto abierto y europeo
Los pesos del modelo —el resultado numérico del entrenamiento que permite reutilizarlo— están disponibles en la colección del proyecto en Hugging Face, junto con algunos puntos de control intermedios. El consorcio también publicó un informe técnico sobre el preentrenamiento, en el que documenta el proceso.
El uso de infraestructura de Deutsche Telekom en Múnich subraya un punto sensible para Europa: la dependencia de proveedores de cómputo estadounidenses. Entrenar un modelo competitivo en servidores locales y liberarlo de forma abierta responde a la aspiración de varios gobiernos y empresas del continente de contar con capacidades propias de inteligencia artificial, sin depender por completo de las grandes tecnológicas.
El investigador Michael Fromm, vinculado al proyecto, compartió detalles del lanzamiento en una publicación en X. El consorcio mantiene además un canal de Discord donde reúne a la comunidad interesada en probar y ajustar el modelo.
Qué significa para el sector
Soofi S llega a un terreno cada vez más disputado por los modelos abiertos, donde iniciativas chinas y estadounidenses marcan el ritmo. La novedad europea no compite por tamaño con los sistemas cerrados más grandes, sino por eficiencia y por atender bien un idioma específico, algo que los modelos generalistas suelen resolver a medias.
Para desarrolladores y empresas de habla alemana, disponer de un modelo abierto afinado a su lengua abre la puerta a aplicaciones locales sin enviar datos a servicios de terceros. La prueba de fondo será cómo se comporta fuera de los benchmarks, en tareas reales donde la calidad del idioma y la coherencia importan tanto como los números de un tablero de resultados.
