Una puerta de entrada a la IA. Tus reglas en ella.
KLIA enruta cada petición al modelo adecuado y aplica identidad, permisos y cuotas antes de que el dato salga de tu perímetro. Modelos abiertos en tu infraestructura, proveedores europeos o APIs externas: la misma interfaz, tu política.
El orden importa: nada se enruta antes de saber quién pregunta, qué tiene permitido y cuánto le queda.
01
Identidad
Token personal o JWT con ámbitos. Se resuelve la persona, su equipo y su organización.
02
Permisos
Los modelos se habilitan en cascada: la organización abre, el equipo acepta, el token concreta.
03
Cuota
Consumo contabilizado en tiempo real. Límite por periodo, por persona o por servicio.
04
Enrutado
Al modelo elegido: local en tu GPU, proveedor europeo o API externa. La misma interfaz en los tres casos.
05
Registro
Quién, qué modelo, cuánto y con qué coste. Trazas y métricas en OpenTelemetry, más informes por equipo listos para repercutir.
Compatible con la API de OpenAI. Opencode, Kilo, Cherry Studio, LibreChat, Jan o Lobechat funcionan cambiando solo el base_url y el token. Y con OpenTelemetry: la observabilidad entra en tu stack, no en otro panel más.
Hub de MCP · artefactos
Las herramientas también pasan por la puerta
KLIA no solo enruta inferencia. Es un hub de servidores MCP remotos —propios y de terceros— gobernado por organización y equipo, con un almacén temporal de artefactos en medio.
Un único punto de acceso a MCP
Los servidores MCP se dan de alta una vez y se exponen a los equipos con la misma identidad, los mismos permisos y la misma cuota que los modelos. Nadie reparte credenciales de servidores de terceros por ahí.
Artefactos que no vuelven al cliente
Encadenar herramientas obliga normalmente a que cada resultado intermedio viaje de vuelta al cliente y otra vez al servidor. KLIA lo deposita en un almacén temporal: una tool deja el artefacto y otra lo recoge, dentro del perímetro.
Es lo que convierte a KLIA en plataforma y no en un proxy con métricas.
Más listo que un OCR. Más exacto que un VLM.
Un OCR moderno lee cada carácter con precisión, pero no entiende lo que lee. Un modelo de visión entiende el documento, pero puede inventarse un dígito y decirlo con total aplomo. KLIA cai los pone a trabajar en paralelo, cruza campo a campo lo que dice cada uno y aplica encima validadores deterministas y reglas a medida de tu negocio. Tres capas que se corrigen entre sí, dentro de tu red y sin contador de tokens de por medio.
Sin facturación por documento. El coste no crece con el volumen, porque corre en tu propio hardware.
En tu red
El 100 % del ciclo del dato ocurre dentro de tu infraestructura. Ni el documento ni lo extraído salen a servicios externos.
Horas, no meses
Una tipología documental nueva queda operativa en horas con few-shot, con unos pocos ejemplos y sin reentrenar modelos.
El rendimiento depende del tipo de documento, su complejidad y el número de campos a extraer. Escala añadiendo GPU o distribuyendo los servicios en varios nodos, y exporta la traza de cada procesado en OpenTelemetry.
AMI · Asistente Municipal Inteligente
El ayuntamiento, respondiendo a las once de la noche
Un asistente conversacional para consistorios. Resuelve dudas sobre trámites, servicios, turismo y atención ciudadana usando únicamente lo que el propio ayuntamiento ha publicado — y enseñando de dónde ha sacado cada respuesta.
No improvisa
Responde a partir del contenido real del portal municipal y de las webs relacionadas, como el portal de turismo o la sede electrónica. Si algo no está publicado, lo dice y deriva al canal de atención, en vez de inventarse un plazo o una tasa.
Enseña las fuentes
Cada respuesta lleva los enlaces a las páginas consultadas. El ciudadano puede comprobarlo y el ayuntamiento puede auditarlo.
En el idioma que haga falta
El conjunto de idiomas se configura: castellano, inglés, lenguas cooficiales —catalán, gallego, euskera— o cualquier otro. Siempre sobre el mismo contenido, sin mantener una base de conocimiento por idioma.
Tarifa plana de tokens
El consumo de tokens va incluido en el precio, sin restricciones por volumen. El único límite es el de uso razonable, para frenar abusos y ataques automatizados.
Demo pública Ayuntamiento de Villa Laude
Villa Laude, un municipio de fantasía
Hemos construido un ayuntamiento ficticio completo — con su Balneario del Volcán Dormido, su Lago de los Peces Voladores y su Museo de Objetos Imposibles — para que puedas probar AMI sobre contenido municipal real sin pedirle datos a ningún consistorio.
Trámites, turismo, agenda y eventos publicados de verdad
El idioma se configura, siempre sobre el mismo contenido
Cada respuesta con el enlace a la página consultada
¿Hasta qué hora abre el balneario los sábados de verano?
El Balneario del Volcán Dormido ha ampliado su horario de tarde durante los fines de semana de verano. Las piscinas termales tienen nuevos turnos de tarde y se han añadido visitas guiadas al mirador del cráter.
Online no: el certificado de empadronamiento se obtiene de forma inmediata y es gratuito. Si prefiere hacerlo presencialmente, el plazo es de hasta 2 días hábiles y sí conviene pedir cita previa.
Sin fuente publicada, sin respuestaVerificación anti-bot · cuota por sesión
Despliegue
Donde tú decidas
KLIA no necesita salir de tu red. El dato tampoco.
En tu servidor
Docker Compose y una GPU. Levantado en una tarde, suficiente para un equipo entero.
docker compose up -d
En tu clúster
Kubernetes con Helm, alta disponibilidad y escalado por carga.
helm install klia klia/klia
Sin salida a Internet
Solo modelos locales, sin proveedor externo. Para entornos donde el dato no puede salir bajo ningún concepto.
providers: local-only
KLIA no añade superficie de cumplimiento. Corre dentro del perímetro que ya tienes acreditado, con tu identidad y tus políticas. No hay un tercero que auditar.
Quién hay detrás
KLIA es un producto de LAUDE
LAUDE es una consultora de software especializada en inteligencia artificial aplicada: IA estructurada, supervisada y medida, integrada en la operación real de la organización. KLIA, KLIA cai y AMI son producto propio, con posibilidad de personalización a través de los servicios profesionales de LAUDE. No todo es configurable, pero se puede hablar.