La escalera de complejidad
Conocer la anatomía de un prompt sólido puede producir un efecto indeseado: empezar a tratar cada interacción como si necesitara una especificación completa de varias páginas.
Eso sería un error.
Una de las ideas centrales de Clases UDD.pdf es precisamente la contraria: subimos de nivel sólo cuando el nivel anterior deja demasiadas decisiones abiertas.
La complejidad debe tener una razón.
No existe un premio por escribir el prompt más largo.
Comienza con el nivel más simple que pueda resolver correctamente la tarea y agrega una nueva capa únicamente cuando puedas explicar qué problema concreto de la versión anterior estás corrigiendo.
La escalera completa
El marco pedagógico del curso utiliza once niveles:
1. Pedido mínimo
↓
2. Tarea clara
↓
3. Objetivo y perspectiva
↓
4. Contexto
↓
5. Documentos y evidencia
↓
6. Criterios y restricciones
↓
7. Formato de salida
↓
8. Ejemplos
↓
9. Trabajo por pasos
↓
10. Salidas estructuradas
↓
11. Prompt maestro
No es una clasificación universal de la industria. Es una secuencia didáctica para aprender qué gana una instrucción cuando incorporamos control adicional.
La mejor manera de entenderla es mantener el mismo caso y observar por qué aparece cada escalón.
Nivel 1 — Pedido mínimo
Revisa este contrato.
Este nivel tiene una gran ventaja: fricción mínima.
Puede servir cuando:
- queremos explorar;
- todavía no sabemos exactamente qué preguntar;
- el riesgo de una respuesta imperfecta es bajo;
- pensamos continuar conversando.
El límite es evidente: el sistema debe completar casi todo lo demás.
Pregunta para subir de nivel:
¿La operación esperada puede interpretarse de varias maneras relevantes?
Si sí, necesitamos una tarea más clara.
Nivel 2 — Tarea clara
Identifica las cláusulas que permiten al proveedor terminar o suspender el servicio.
Hemos convertido “revisar” en una operación observable.
El sistema sabe qué buscar y qué dejar fuera.
El límite aparece si todavía no sabemos para qué hacemos la búsqueda o desde qué posición debe evaluarse.
Pregunta para subir de nivel:
¿El mismo hallazgo podría ser valorado de manera distinta según el propósito o la parte interesada?
Si sí, agregamos objetivo y perspectiva.
Nivel 3 — Objetivo y perspectiva
Identifica las cláusulas que permiten al proveedor terminar o suspender el servicio.
Analiza desde la posición del cliente.
Objetivo: detectar riesgos que puedan afectar continuidad operacional antes de aprobar el contrato.
Ahora la tarea tiene dirección profesional.
Una cláusula de suspensión deja de ser sólo una frase contractual y se observa en relación con una decisión concreta.
El límite aparece si existen hechos externos al documento que cambian materialmente la evaluación.
Pregunta para subir de nivel:
¿Hay hechos del caso que el contrato no contiene pero que cambian la importancia de los hallazgos?
Nivel 4 — Contexto
Contexto:
- el servicio será utilizado en un proceso operativo crítico;
- no existe un proveedor alternativo listo para reemplazarlo;
- una migración completa puede tomar varios meses.
Ahora una cláusula de suspensión o terminación puede evaluarse con mayor precisión práctica.
El límite aparece si trabajamos con varias fuentes y necesitamos demostrar de dónde sale cada afirmación.
Pregunta para subir de nivel:
¿La tarea depende de documentos concretos cuya función y evidencia deben quedar claras?
Nivel 5 — Documentos y evidencia
Documentos:
- contrato.pdf: documento principal;
- anexo_sla.pdf: anexo vinculante sobre niveles de servicio;
- propuesta.pdf: úsala sólo para detectar divergencias con lo ofrecido.
Para cada hallazgo indica:
- documento;
- cláusula o sección;
- fragmento relevante.
Esta capa añade procedencia y trazabilidad.
Ya no basta con producir una conclusión. Debe existir una ruta de vuelta hacia la fuente.
El límite aparece cuando necesitamos priorizar, clasificar o excluir conductas.
Pregunta para subir de nivel:
¿La tarea exige una evaluación cuya regla todavía no está definida o límites que conviene hacer explícitos?
Nivel 6 — Criterios y restricciones
Criterios de prioridad:
- impacto operativo;
- amplitud de la facultad del proveedor;
- posibilidad de mitigación;
- plazo de aviso;
- derecho del cliente a terminar.
Restricciones:
- no inventes cláusulas;
- no presentes contexto como evidencia contractual;
- si falta un anexo necesario, indícalo;
- no adoptes todavía la decisión final de aprobación.
Esta capa transforma palabras como “riesgo” o “importante” en algo más operativo y limita conductas que deteriorarían la confiabilidad.
El límite puede ser simplemente de usabilidad: la respuesta contiene buena información, pero está desordenada.
Pregunta para subir de nivel:
¿Necesitamos una forma estable para leer, comparar o revisar el resultado?
Nivel 7 — Formato de salida
Devuelve una tabla con:
- cláusula;
- tema;
- hallazgo;
- evidencia;
- impacto;
- información faltante;
- pregunta para la contraparte.
Después de la tabla, incluye una síntesis de máximo cinco prioridades.
El formato no mejora por sí solo el contenido, pero puede volverlo mucho más utilizable.
El límite aparece cuando ciertas categorías o niveles de detalle siguen interpretándose de manera inconsistente.
Pregunta para subir de nivel:
¿Las instrucciones abstractas no bastan para mostrar cómo debe verse una buena respuesta?
Nivel 8 — Ejemplos
Podemos agregar una demostración:
Ejemplo de salida esperada:
Cláusula:
"El proveedor podrá suspender el servicio por incumplimiento de pago con cinco días de aviso."
Hallazgo:
Existe facultad de suspensión por mora.
Impacto:
MEDIO. La continuidad puede verse afectada antes de que una controversia sobre facturación sea resuelta.
Información faltante:
No se observa en este fragmento un período de subsanación adicional.
El ejemplo comunica granularidad, tono, relación entre evidencia y análisis, y aplicación del criterio.
El límite aparece cuando la tarea ya contiene varias operaciones dependientes que conviene separar.
Pregunta para subir de nivel:
¿Estamos pidiendo localizar, interpretar, evaluar, verificar y redactar todo al mismo tiempo?
Nivel 9 — Trabajo por pasos
Etapa 1: localiza cláusulas relevantes.
Etapa 2: verifica ubicación y evidencia.
Etapa 3: clasifica por materia.
Etapa 4: evalúa impacto.
Etapa 5: formula preguntas de negociación.
La división hace visibles los productos intermedios y permite introducir revisión entre etapas.
El límite aparece cuando necesitamos que esos productos tengan una estructura suficientemente estable para ser procesados o validados.
Pregunta para subir de nivel:
¿La salida debe alimentar otra operación, un sistema o una validación formal?
Nivel 10 — Salidas estructuradas
Podemos pedir JSON:
{
"hallazgos": [
{
"id": "H1",
"clausula": "...",
"tema": "...",
"evidencia": "...",
"riesgo": "alto|medio|bajo",
"informacion_faltante": null
}
]
}Ahora la forma de la respuesta puede ser tratada como datos.
Pero la estructura no resuelve por sí sola la repetición de una instrucción compleja.
Pregunta para subir de nivel:
¿Esta misma configuración debe utilizarse recurrentemente y ya contiene suficientes reglas como para justificar una especificación consolidada?
Nivel 11 — Prompt maestro
Un prompt maestro reúne en una sola especificación los elementos relevantes de una tarea compleja.
MISIÓN
Preparar una revisión contractual verificable.
OBJETIVO
...
PERSPECTIVA
...
DOCUMENTOS
...
CONTEXTO
...
TAREA
...
CRITERIOS
...
RESTRICCIONES
...
PROCEDIMIENTO
...
FORMATO
...
CONTROL FINAL
...
El prompt maestro no es “el mejor nivel” por definición. Es útil cuando la complejidad ya existe en la tarea y conviene hacerla explícita y mantenible.
La escalera no es un camino irreversible
Es importante no imaginar que una vez alcanzado un prompt maestro debemos utilizarlo para todo.
Un abogado puede usar:
Traduce al inglés conservando la numeración.
para una tarea sencilla y, cinco minutos después, un prompt de varias secciones para una revisión contractual crítica.
La complejidad pertenece al encargo, no al prestigio del usuario.
Una segunda lectura: qué gana cada nivel
| Nivel | Qué añade | Qué problema reduce |
|---|---|---|
| Pedido mínimo | intención básica | fricción de inicio |
| Tarea clara | operación | ambigüedad sobre qué hacer |
| Objetivo/perspectiva | finalidad y posición | relevancia mal orientada |
| Contexto | hechos del caso | análisis desconectado de la realidad |
| Documentos/evidencia | procedencia y soporte | afirmaciones difíciles de verificar |
| Criterios/restricciones | regla y límites | clasificación arbitraria y desborde |
| Formato | organización | resultados difíciles de usar |
| Ejemplos | demostración | criterios abstractos mal calibrados |
| Pasos | descomposición | mezcla de operaciones y propagación de errores |
| Salida estructurada | forma estable | dificultad para validar o reutilizar datos |
| Prompt maestro | consolidación | reconstrucción repetida de una especificación compleja |
Esta tabla muestra algo importante: cada escalón responde a una limitación distinta. Si esa limitación no existe, la capa puede ser innecesaria.
Complejidad funcional y complejidad ornamental
Podemos hacer crecer un prompt de dos maneras.
Crecimiento funcional
Para cada hallazgo indica documento, cláusula y fragmento relevante.
Agrega trazabilidad.
Crecimiento ornamental
Trabaja con rigor extremo, excelencia absoluta, máxima profundidad, precisión impecable y el nivel profesional más alto posible.
Agrega palabras, pero poca especificación verificable.
Una técnica de depuración consiste en preguntar, línea por línea:
¿Qué decisión diferente debería tomar el sistema gracias a esta frase?
Si no podemos responder, quizá la frase no aporta control real.
La escalera como método de diagnóstico
Supongamos que un prompt ya existe, pero sus resultados son insatisfactorios.
No necesitamos reescribir todo desde cero. Podemos diagnosticar dónde está la falla.
El sistema responde sobre temas equivocados.
Revisar tarea y alcance.
Analiza desde una posición incorrecta.
Agregar o reforzar perspectiva.
Ignora un hecho relevante del negocio.
Agregar contexto.
Inventa ubicaciones o mezcla documentos.
Revisar documentos, evidencia y restricciones.
La clasificación “alto/medio/bajo” parece arbitraria.
Definir criterios o aportar ejemplos.
La respuesta mezcla extracción con evaluación y no sabemos dónde apareció el error.
Dividir trabajo por etapas.
La salida no puede importarse o validarse.
Definir estructura.
La escalera funciona así como un pequeño método de debugging de instrucciones.
Aplicación paralela: investigación jurídica
El mismo principio funciona fuera de contratos.
Nivel mínimo
Busca información sobre responsabilidad por decisiones automatizadas.
Tarea clara
Identifica decisiones judiciales que discutan responsabilidad por decisiones automatizadas.
Objetivo y perspectiva
El objetivo es preparar un estado de la cuestión para un informe interno sobre riesgo regulatorio.
Fuentes y evidencia
Usa sólo fuentes judiciales o institucionales verificables. Para cada decisión incluye tribunal, fecha, identificación y enlace o referencia comprobable.
Criterios
Prioriza decisiones que discutan deber de explicación, revisión humana o atribución de responsabilidad.
Formato
Devuelve una matriz comparativa y separa holding, argumentos de las partes y comentario propio.
La lógica no depende del contrato. Depende de traducir una tarea compleja en capas de especificación.
Un error frecuente: saltar de inmediato al prompt maestro
Cuando alguien aprende prompting suele intentar construir una gran plantilla universal:
Actúa como abogado experto...
Considera todas las leyes...
Revisa absolutamente todo...
Entrega todo tipo de riesgos...
El problema es que una instrucción universal empieza a acumular excepciones y objetivos incompatibles.
Un prompt maestro debe surgir después de haber identificado una práctica estable, no antes.
Si todavía no sabemos qué criterios importan o qué output necesitamos, consolidar el prompt sólo congela incertidumbre.
Otro error: confundir “más control” con “más confiabilidad total”
Subir la escalera mejora especificación, pero no elimina otras fuentes de error.
Incluso un prompt maestro puede trabajar con:
- documentos incompletos;
- criterios equivocados;
- información desactualizada;
- un modelo inadecuado;
- una aplicación sin las herramientas necesarias.
Por eso la escalera debe leerse como una arquitectura de instrucción, no como una teoría completa de confiabilidad.
Caso conductor: el crecimiento completo
Podemos visualizar la acumulación del caso del proveedor de IA:
"Revisa este contrato"
↓
identificar riesgos
↓
desde el cliente para aprobación
↓
considerando criticidad del servicio
↓
usando contrato + anexos con evidencia
↓
aplicando criterios + restricciones
↓
en matriz de hallazgos
↓
con ejemplos de clasificación
↓
separando extracción / revisión / evaluación
↓
con salida JSON si debe procesarse
↓
prompt maestro reutilizable
Cada paso añade algo que antes faltaba.
Esa es la lógica que debe conservarse en todo el handbook: una nueva abstracción aparece porque la anterior ya no basta.
Qué debes recordar
La escalera de complejidad enseña una regla de diseño:
comienza simple, identifica el límite y agrega sólo la capa que resuelve ese límite.
Un prompt breve puede ser excelente. Un prompt maestro puede ser excelente. La pregunta es si su complejidad corresponde a la tarea.
La secuencia completa —pedido mínimo, tarea, objetivo, contexto, documentos, evidencia, criterios, restricciones, formato, ejemplos, pasos, estructuras y consolidación— no debe entenderse como burocracia, sino como un repertorio de controles disponibles.
El problema que todavía queda abierto
Uno de esos controles merece tratamiento propio.
A veces podemos describir durante varios párrafos qué significa una “buena respuesta” y seguir obteniendo resultados inconsistentes. En esos casos, mostrar una instancia concreta puede comunicar el patrón mejor que seguir agregando definiciones.
El siguiente nodo estudia zero-shot, one-shot y few-shot prompting, y la diferencia entre ejemplos positivos y negativos.