Los agentes de Inteligencia Artificial ya no se limitan a responder preguntas. En sectores como la banca, los seguros o la salud empiezan a evaluar préstamos, asesorar a clientes, calcular precios o gestionar reclamaciones. El problema es que estas decisiones están sometidas a leyes y normativas concretas y, a medida que aumenta el número de agentes desplegados, controlar manualmente cada una de sus interacciones resulta imposible.
Alinia AI quiere poner orden a este problema. Alinia es una startup especializada en alineamiento legal: una capa de control que supervisa en tiempo real si los agentes de IA están actuando de acuerdo con las normas que les corresponden. Y acaba de lanzar Seny, un modelo de IA diseñado específicamente para evaluar y monitorizar el comportamiento de estos agentes frente a normativas concretas, en diferentes países e idiomas.
La diferencia frente a los sistemas de seguridad genéricos es precisamente su especialización. No se trata de detectar si un modelo genera una respuesta peligrosa, sino de determinar, por ejemplo, si una recomendación financiera cumple la normativa aplicable o si una decisión sobre la solvencia de un cliente se ajusta a las reglas que regulan ese proceso. Seny se ha entrenado con corpus legislativos de distintas jurisdicciones e idiomas, seleccionados con apoyo de expertos legales, y está optimizado para clasificación de riesgos y razonamiento jurídico.
El sistema funciona como base para crear “jueces” especializados en distintas políticas y sectores. Estos pueden actuar como auditores durante la ejecución de un proceso, como guardarraíles que frenan determinadas acciones o como sistemas de evaluación posteriores. La compañía los está orientando especialmente a sectores altamente regulados como banca, seguros y salud.
Un modelo pequeño para controlar modelos grandes
Una de las claves de Seny está en su tamaño. Se trata de un modelo de lenguaje de 4.000 millones de parámetros, muy inferior al de los grandes modelos de propósito general, pero entrenado para una tarea mucho más concreta. Esa especialización permite a Alinia apostar por una combinación de velocidad, precisión y coste adecuada para controles que deben ejecutarse sobre cada interacción de un agente.
La compañía sitúa su latencia mediana en 151 milisegundos y señala que sus jueces pueden llegar a ser entre 5 y 17 veces más rápidos que algunos modelos comparables que ha evaluado. En determinados despliegues en VPC, asegura que puede reducirla hasta los 50 milisegundos. La importancia de esa velocidad es evidente: cuanto menos tarda el control, más viable resulta supervisar todas las interacciones de un agente en lugar de revisar únicamente una muestra.
Alinia también ha obtenido resultados comparables a modelos de frontera en distintos dominios especializados y ha conseguido mejoras consistentes en nueve idiomas, entre ellos español, catalán, inglés, francés y alemán. Además, con el lanzamiento de Seny ha publicado benchmarks públicos de asesoramiento legal y fiscal para facilitar la comparación de su tecnología con otras soluciones.
El proyecto cuenta con el respaldo de EuroHPC AI Factory y ha sido desarrollado en el supercomputador MareNostrum 5 del Barcelona Supercomputing Center (BSC). Para Alinia, el objetivo es que el cumplimiento normativo deje de ser una revisión posterior y pase a formar parte de la propia infraestructura con la que funcionan los sistemas autónomos.
La oportunidad que persigue la compañía es clara: a medida que las empresas deleguen más decisiones en agentes de IA, también necesitarán saber qué están haciendo esos agentes y demostrar que lo hacen dentro de la ley. Alinia quiere convertirse en esa capa de supervisión.