Sistema de evaluación asistida por IA

Evaluación de proyectos trazable, reproducible y auditable

Convertimos las bases y criterios de una convocatoria en un sistema de evaluación donde la IA aporta evidencia y análisis, pero la decisión permanece bajo control del evaluador.

Compatible con los marcos metodológicos del BID, Banco Mundial, CAF, Unión Europea y agencias de cooperación internacional

8Agentes especializados
3Capas de evaluación
100+Proyectos por convocatoria
Para el evaluador

Lo que cambia en su trabajo desde el primer proyecto

El sistema no reemplaza el criterio del evaluador — lo potencia, lo estructura y lo protege.

100×

Velocidad de evaluación

El sistema lee, indexa y estructura el paquete documental completo en minutos. El evaluador llega al análisis sustantivo sin haber leído 200 páginas — solo lo que importa, ya organizado.

Criterio sostenido en toda la convocatoria

El mismo marco metodológico, los mismos criterios y la misma rúbrica se aplican a todos los proyectos — desde el primero hasta el último. Sin variaciones por fatiga, contexto o momento del proceso.

📄

Cada decisión, respaldada

Cualquier puntaje que el evaluador asigna queda vinculado a la evidencia que lo sustenta: documento, página, fragmento citado. Si alguien pregunta por qué, la respuesta ya está construida.

Foco en lo que requiere criterio humano

El trabajo mecánico — lectura, organización, estructuración — lo hacen los agentes. El evaluador dedica su tiempo a lo que solo él puede hacer: el juicio experto sobre la propuesta.

El output central

La Matriz de Evaluación, en el centro

Los agentes trabajan para construir la matriz — no al revés. El evaluador ve en una sola pantalla el análisis de la IA con su evidencia, y el espacio para registrar su propio puntaje y criterio. Todo queda documentado con trazabilidad completa.

Matriz de Evaluación — Proyecto #047

Evaluación técnica · 3 criterios
Criterio 2.1 — Pertinencia de la propuesta 15 puntos máximo
Análisis IA
12/15
Evidencia: Documento técnico, páginas 23, 41 y 67. La propuesta identifica adecuadamente el problema central y su cadena causal.

Debilidad detectada: No presenta evidencia cuantitativa suficiente sobre la magnitud del problema en las comunidades objetivo.
↗ Abrir p.23 del documento
Decisión del evaluador
12/15
Fundamentación: Coincido con el análisis. La pertinencia está bien argumentada aunque falta sustento cuantitativo de la magnitud del problema.
✓ Puntaje registrado con fundamentación
Criterio 3.1 — Capacidad institucional del ejecutor 10 puntos máximo
Análisis IA
8/10
Evidencia: Propuesta Técnica, p. 87. La organización acredita experiencia en 3 proyectos similares ejecutados entre 2019-2024.
↗ Abrir p.87 del documento
Decisión del evaluador
7/10
Fundamentación: Los proyectos referenciados son de menor escala que el actual. Ajusto el puntaje a la baja.
↓ Puntaje ajustado por criterio del evaluador — justificación registrada
Los agentes

Pipeline de 8 agentes especializados

Cada agente tiene un rol único. El evaluador humano supervisa y corrige en cada etapa. El pipeline nunca se modifica durante una convocatoria activa — reglas versionadas y bloqueadas.

⚙️

Antes de todo

Motor de Reglas de la Convocatoria

El administrador configura el sistema de evaluación específico de esta convocatoria antes de que comience el proceso. Cada convocatoria define sus propias reglas — criterios, ponderaciones, umbrales y requisitos. Una vez iniciada la evaluación, toda la configuración queda registrada y protegida.

Tipo de proceso
Convocatoria · Fondo · Consultoría · Bienes · Obras · Servicios
Documento rector
Bases / TDR / Solicitud de Propuestas / DEL
Requisitos obligatorios
Checklist Sí/No · Causales de rechazo parametrizadas
Criterios técnicos
Configurables · Subcriterios · Ponderaciones · Puntaje máximo
Puntaje técnico mínimo
Umbral configurable por proceso
Evaluación financiera
Fórmula configurable por tipo de proceso
Elegibilidad
Reglas específicas de la convocatoria
Comité evaluador
Integrantes · Roles · Segregación de funciones
Conflictos de interés
Declaración obligatoria antes de evaluar
Resultado esperado
Ranking · Recomendación · Instancias de aclaración
🔒

Consistencia garantizada: Una vez iniciada la evaluación, todos los parámetros quedan registrados y protegidos. Los proyectos de una misma convocatoria se evalúan siempre bajo exactamente la misma configuración — desde el primero hasta el último. Cualquier mejora o ajuste se aplica a convocatorias futuras, nunca a una evaluación en curso.

A0
Verificador de Admisibilidad y Elegibilidad

El primer filtro. Antes de cualquier análisis de calidad, determina si la propuesta puede ser evaluada. Una propuesta técnicamente excelente puede quedar excluida por incumplir un requisito obligatorio — y ese rechazo debe ocurrir antes, no después del análisis.

Presentado → Admisible → Elegible → Técnicamente evaluable → Evaluado → Clasificado → Recomendado / No recomendado
OutputEstado formal de la propuesta + causales de inadmisibilidad si aplica. Solo las propuestas que pasan continúan al pipeline.
A1
Lector / Indexador

Ingiere el paquete documental completo — PDFs, Word, Excel, documentos escaneados con OCR. Extrae y estructura la cadena de resultados, indicadores, supuestos y riesgos declarados. Usa modelo local para eficiencia en volúmenes masivos.

OutputMapa estructurado del proyecto. El evaluador parte del resumen, no de 200 páginas.
A2
Verificador de Coherencia

Analiza la lógica interna: coherencia vertical de la cadena de resultados, coherencia horizontal de indicadores, credibilidad de supuestos en el contexto del país. Detecta inconsistencias que un lector lineal puede pasar por alto.

OutputInforme de coherencia con semáforo por dimensión y preguntas para el presentante.
A3
Especialista Temático

Agente dinámico que se instancia según el sector. Evalúa la viabilidad técnica con criterio experto del dominio: infraestructura, energía, agua, educación, salud, clima, tecnología. Su expertise se profundiza con cada proyecto del sector — dentro de convocatorias futuras, nunca modificando la actual.

OutputDictamen técnico sectorial con riesgos no declarados y comparación contra proyectos similares.
A4
Analista Económico / Financiero

Verifica el análisis costo-beneficio o costo-efectividad: supuestos del modelo, tasa de descuento, horizonte temporal, estimación de beneficiarios. Evalúa también la propuesta financiera según la fórmula configurada en el Motor de Convocatoria.

OutputRating de calidad del análisis económico + posición percentil contra proyectos similares del portafolio.
A5
Verificador de Cumplimiento Formal

Verifica el cumplimiento formal de cada propuesta punto por punto, usando las reglas cargadas en la configuración de la convocatoria. Responde una sola pregunta por cada requisito: ¿cumple o no cumple? Las condiciones obligatorias son binarias — no hay evaluación parcial de lo que debe cumplirse al 100%.

OutputChecklist ítem por ítem con evidencia citada (documento + página). Causales de exclusión si aplica.
A6
Aplicador de Matriz y Scoring

Aplica los criterios técnicos de la convocatoria sobre el análisis acumulado de los agentes anteriores y genera los puntajes sugeridos, cada uno respaldado por evidencia obligatoria. Al mismo tiempo, posiciona el proyecto en el contexto del portafolio — mostrando cómo se ubica frente a las demás propuestas en las mismas dimensiones.

OutputMatriz de evaluación con puntajes sugeridos, evidencia citada y vista comparativa del portafolio.
↓ Revisión humana · Puntaje final del evaluador · Ranking ↓
A7
Agente de Integridad y Auditoría

Agente transversal que opera durante todo el pipeline. Registra y controla la integridad del proceso: identidad del evaluador, fecha y hora de cada acción, conflictos de interés, modificaciones de puntajes, cambios posteriores a la evaluación, overrides de IA con su justificación, diferencias entre evaluadores, e intervención del supervisor.

Controla
Conflictos de interés · Modificaciones de puntajes · Acceso a documentación · Versiones aplicadas · Criterios usados · Overrides con justificación · Diferencias entre evaluadores · Intervención del supervisor · Confidencialidad hasta la Notificación de Intención de Adjudicación
OutputLog de auditoría completo del proceso evaluador. Disponible para comités de adquisiciones, auditoría e integridad.
Metodología de evaluación

Tres capas diferenciadas — sin mezclar

Un error frecuente en evaluaciones asistidas por IA es transformar automáticamente cualquier característica positiva en "puntos", cuando las bases establecen que determinada condición solo debe verificarse como cumple/no cumple. El sistema separa estrictamente estas tres capas.

1

Requisitos de Admisión

¿Cumple o no cumple?

Verificación binaria de requisitos obligatorios. No hay grises ni puntajes parciales. Una propuesta que no cumple un requisito obligatorio sale del proceso — independientemente de su calidad técnica.

  • Requisitos formales documentales
  • Elegibilidad del presentante
  • Causales de exclusión de la convocatoria
  • Declaraciones requeridas
2

Evaluación Técnica

¿Qué calidad tiene?

Análisis de la calidad sustantiva de la propuesta según los criterios y ponderaciones configurados para la convocatoria. La IA sugiere puntajes con evidencia obligatoria — el evaluador revisa y decide el puntaje final.

  • Criterios técnicos específicos del proceso
  • Puntajes con evidencia citada y página
  • Puntaje mínimo aprobatorio configurable
  • Revisión y aprobación humana
3

Inteligencia de Portafolio

¿Cómo se posiciona?

Vista comparativa de apoyo a la decisión — complementaria al puntaje oficial. Muestra cómo se ubica cada propuesta en el contexto del portafolio completo de la convocatoria, sin modificar los puntajes individuales.

  • Posición en el ranking del portafolio
  • Distribución de puntajes por criterio
  • Comparación del análisis IA vs. decisión del evaluador
  • Tendencias y outliers del portafolio
Trazabilidad

Todo puntaje requiere evidencia

Cada valoración del sistema incluye obligatoriamente la referencia al fragmento del documento que la respalda. El evaluador puede acceder directamente a la página correspondiente con un clic — haciendo el proceso completamente verificable.

Estructura de cada valoración

Criterio Puntaje Argumentación Evidencia Documento Página Evaluador
Ejemplo de valoración completa
8/10 Capacidad institucional del ejecutor
📄 Propuesta Técnica, p. 87
"La organización acredita experiencia en proyectos de similar envergadura ejecutados en el período 2019-2024, con desembolsos verificables y evaluaciones de cierre disponibles."
↗ Abrir página 87 directamente
Integridad del proceso

El evaluador decide — el sistema registra todo

El evaluador tiene plena autonomía para revisar el análisis de los agentes, ajustar puntajes y registrar su criterio. Cada acción queda documentada con fecha, hora y fundamentación — generando un historial completo del proceso de evaluación.

🤖

La IA propone

Puntaje sugerido basado en el análisis del documento, con evidencia citada y argumentación detallada.

12/15 · Criterio 2.1
Evidencia: Doc. técnico, p. 23
👤

El evaluador decide

Revisa el análisis, puede aceptarlo o ajustarlo. Cualquier modificación requiere fundamentación registrada.

11/15 · Criterio 2.1
"Ajusto por falta de evidencia cuantitativa" — registrado

📋 Historial completo del proceso

Cada puntaje registrado, cada ajuste al análisis de la IA, cada fundamentación del evaluador queda almacenado con fecha, hora e identidad del evaluador. El proceso es completamente reconstruible en cualquier momento — para revisiones internas, auditorías o consultas posteriores.

Gobernanza del conocimiento

Biblioteca Institucional de Criterios Validados

El sistema no "aprende" automáticamente entre convocatorias. Las correcciones de los evaluadores se someten a un proceso de validación institucional antes de incorporarse al corpus — con trazabilidad completa de quién propuso qué, cuándo, y bajo qué autorización.

Corrección del evaluador
Propuesta de regla institucional
Revisión por supervisor
Aprobación formal
Versionado e incorporación al corpus

Ejemplo de regla institucional aprobada

ReferenciaRegla 2026-047 Propuesta porEvaluadora X — Especialista en agua y saneamiento Validada porCoordinadora del Comité Evaluador Fecha15 de agosto de 2026 Aplicable aProyectos de agua en zonas rurales andinas — convocatorias futuras ContenidoVerificar disponibilidad de operadores locales calificados para operación y mantenimiento post-proyecto
⚠️

Gobernanza documentada: El conocimiento incorporado al sistema tiene trazabilidad completa — quién lo propuso, quién lo validó, cuándo fue aprobado y a qué tipo de procesos aplica. Cada regla institucional es un activo documentado, no una modificación silenciosa del sistema.

Aprendizaje institucional

El criterio del evaluador mejora el sistema

Cada corrección u observación del evaluador puede impactar en tres niveles distintos. El evaluador decide siempre qué alcance tiene su feedback — nada ocurre de forma automática sin su intervención explícita.

💬

Retroalimentación en lenguaje natural

El evaluador escribe lo que piensa. El sistema lo procesa, registra y actúa según el nivel correspondiente.

Nivel 1 — Inmediato

Impacta este proyecto

El agente relee su análisis incorporando la corrección y genera una versión revisada. El evaluador ve el diff entre versiones. Todo queda registrado en el log de auditoría del A7.

"Este análisis no considera el riesgo político, crítico en este país." → El A2 regenera el informe incluyendo el riesgo político como dimensión explícita.
Nivel 2 — Convocatoria activa

Se propaga al portafolio

Si la corrección aplica a otros proyectos del mismo fondo, el evaluador puede propagarla. El evaluador decide explícitamente — nunca ocurre de forma automática.

"En todos los proyectos de este fondo, el riesgo cambiario debe considerarse." → El evaluador propaga la regla a los proyectos pendientes de la convocatoria.
Nivel 3 — Institucional

Propuesta a la Biblioteca

La corrección se propone como regla institucional — pasa por revisión, aprobación y versionado antes de incorporarse. Nunca se aplica automáticamente a convocatorias futuras sin validación.

"Para agua rural andina, verificar operadores locales calificados." → Propuesta Regla 2026-047, en proceso de validación.
Gestión de evaluadores

El conocimiento de cada evaluador importa

El sistema tiene en cuenta la experiencia y el expertise de cada evaluador para ponderar sus contribuciones a la Biblioteca Institucional. Este mecanismo opera de forma silenciosa.

Datos del perfil

  • Nombre, cargo y nivel institucional
  • Área de la organización
  • Años de experiencia en evaluación
  • Sectores de especialización declarados
  • Países o subregiones de mayor expertise
  • Tipo de operaciones habituales
  • CV adjunto — el sistema lo procesa automáticamente

Historial calculado

  • Proyectos evaluados por sector
  • Frecuencia de uso del sistema de feedback
  • Consistencia histórica de correcciones
  • Sectores donde su feedback produjo mejoras verificables
  • Peso en ponderación de reglas institucionales — solo visible para el administrador

Cómo se usa la jerarquía

  • Correcciones contradictorias entre evaluadores se ponderan por expertise del dominio
  • Evaluadores senior en su sector tienen mayor peso al proponer reglas institucionales
  • Contradicciones irresolubles se escalan al administrador
  • Segregación de funciones garantizada por el A7

Lo que el evaluador nunca ve

  • Su peso relativo en el modelo
  • Comparaciones con otros evaluadores
  • Rankings o posiciones relativas
  • Indicadores de "confianza" en su criterio
  • Cualquier señal de jerarquía — la interfaz es completamente neutral
🔒

Privacidad del diseño: La jerarquía silenciosa existe para que el aprendizaje institucional sea de calidad — no para crear rankings visibles que generarían fricción política. El evaluador experimenta el sistema como una herramienta neutral. La ponderación ocurre solo en la capa de consolidación de la Biblioteca Institucional.

Estructura de datos

Fondo / Convocatoria → Proyecto

El sistema organiza el trabajo en dos niveles jerárquicos. La configuración del Motor de Convocatoria se define una vez a nivel del fondo y se hereda automáticamente por todos los proyectos.

Nivel 1 — Contenedor padre

Fondo / Convocatoria

Agrupa todos los proyectos. El Motor de Reglas, el framework metodológico y los evaluadores se configuran aquí una sola vez — y quedan bloqueados al iniciarse la evaluación.

Nombre del fondo Fecha de cierre Evaluadores y roles Motor de Reglas completo Framework metodológico Conflictos de interés
⬇ Todo lo configurado aquí se hereda por los proyectos hijos y queda bloqueado al inicio de la evaluación.
Nivel 2 — Unidad de evaluación

Proyecto individual

La unidad que recorre el pipeline completo de 8 agentes. Tiene su propia ficha, sus archivos, y su dictamen final. Importación masiva de 1 a 100+ proyectos con asociación automática de archivos.

Denominación Monto solicitado País / países Organización presentante Sector temático Tipo de operación Evaluador asignado Archivos adjuntos
El flujo completo

De la convocatoria al dictamen auditado

El ciclo completo de evaluación, desde la configuración del Motor de Convocatoria hasta el dictamen firmado, trazable y disponible para auditoría.

1
Motor de Convocatoria

Configuración y congelamiento de reglas

El administrador configura el Motor de Reglas completo: tipo de proceso, documento rector, requisitos obligatorios, criterios técnicos, ponderaciones, fórmula financiera, comité evaluador y conflictos de interés. Al iniciar la evaluación, todo queda versionado y bloqueado.

AdministradorUna vez por convocatoriaReglas bloqueadas al inicio
2
Importación masiva

Carga de 1 a 100+ proyectos

Importación batch con asociación automática de archivos al proyecto correcto por estructura de carpetas o planilla de mapeo. Cada proyecto queda registrado con su ficha completa.

Importación batchPDF · Word · ExcelMulti-archivo por proyecto
3
A0 — Primer filtro

Admisibilidad y elegibilidad

El A0 verifica si cada propuesta puede ser evaluada. Las que no cumplen requisitos obligatorios quedan excluidas con causal documentada — antes de cualquier análisis de calidad. Solo las admisibles continúan.

AutomáticoBinario: pasa / no pasaCausal documentada
4
Pipeline A1 → A6

Los 6 agentes de análisis

Pipeline asincrónico. A1 lee e indexa, A2 verifica coherencia, A3 evalúa la viabilidad técnica sectorial, A4 analiza la economía, A5 corre el compliance formal (Capa 1), A6 aplica la matriz y el scoring (Capas 2 y 3).

AsincrónicoParalelo para múltiples proyectosNotificación al completar
5
Revisión humana

El evaluador revisa y registra su criterio

El evaluador recibe la matriz con el análisis de los agentes. Puede aceptar los puntajes sugeridos o ajustarlos — en ese caso debe registrar su fundamentación. Cada acción queda documentada con identidad, fecha y hora.

Human-in-the-loopAjustes con fundamentación obligatoriaHistorial completo
6
Ranking y recomendación

Puntaje final y posición en el portafolio

Con los puntajes del evaluador registrados, el sistema genera el ranking del portafolio y el dashboard comparativo. El coordinador del proceso tiene una visión completa de todas las propuestas en las mismas dimensiones de análisis.

Ranking del portafolioDashboard comparativoPuntaje oficial vs. inteligencia de portafolio
7
A7 — Integridad y Auditoría

Log completo del proceso — disponible para auditoría

El A7 genera el log de auditoría completo: quién evaluó, qué framework aplicó, qué puntajes asignó, qué overrides realizó y con qué justificación, qué discrepancias hubo y cómo se resolvieron. Disponible para comités de adquisiciones, auditoría e integridad.

Trazabilidad completaOverrides con justificaciónConfidencial hasta adjudicación
Alcance

Una plataforma que se adapta a cada proceso

El sistema se configura con el documento rector de cada convocatoria — sin suponer criterios predeterminados. El mismo motor de evaluación puede operar con los marcos metodológicos del BID, el Banco Mundial, la CAF, la Unión Europea o cualquier agencia de cooperación internacional.

⚙️

Adaptable a cualquier convocatoria

BID · Banco Mundial · CAF · Unión Europea · Agencias de cooperación · Gobiernos. Los criterios, ponderaciones y requisitos se configuran a partir del documento rector de cada proceso — sin imponer una metodología única.

🏛️

Diseñado para el escrutinio institucional

Evaluación con evidencia citada, configuración protegida durante la convocatoria, Biblioteca de Criterios con gobernanza documentada y registro completo de auditoría — construido para responder cualquier pregunta de un comité de revisión.

📈

Un activo que crece con el uso

Cada convocatoria evaluada enriquece la Biblioteca Institucional de Criterios Validados. El conocimiento acumulado, con trazabilidad completa, se convierte en el principal diferencial de la plataforma con el tiempo.