Entorno de demostración. El corpus proviene de material público del Congreso y es parcial: alcanza para mostrar cómo funciona el sistema, no para consultar el registro completo. Los enlaces de esta instancia no son permanentes: lo citable es el URN de cada evidencia.

Modelos utilizados

Qué modelos intervienen, en qué versión y para qué.

Registro de versiones

Cada resultado derivado guarda el modelo, su versión, la versión del pipeline y la fecha de procesamiento, de modo que cualquier resultado histórico se pueda reconstruir.

Cuando una respuesta guardada se reabre y las versiones cambiaron desde entonces, la interfaz lo advierte.

Qué modelos hay

El sistema usa un modelo de reconocimiento de voz para la transcripción auxiliar, un componente propio de alineamiento, un motor de diarización, un resolutor de identidad, un modelo de embeddings para la búsqueda semántica y un modelo de lenguaje para redactar respuestas sobre los fragmentos recuperados.

Ninguno de esos modelos genera texto oficial: el texto oficial viene de la versión taquigráfica.

Pendiente de definición

La elección concreta de proveedores y modelos, y la política sobre qué clases de información pueden procesarse con servicios externos, están pendientes de decisión institucional.

Los identificadores que aparecen en el entorno de demostración son ficticios.