TL;DR
El Prompt Auditor voltea a la IA de autora a adversaria: después de que entrega, le ordenas atacar su propia salida — cazando fallos lógicos, afirmaciones sin apoyo y ángulos perdidos — antes de producir una versión final blindada. Cuesta un mensaje de seguimiento y rutinariamente atrapa el fallo que habrías descubierto por las malas.
La Analogía
Todo periódico serio funciona sobre dos personas que nunca se sientan en la misma mesa: el Redactor y el Editor.
El trabajo del Redactor es producción — arrastrar al lector, hacer cantar al argumento. El trabajo del Editor es demolición. El Editor encierra en un círculo la afirmación sin fuente, escribe "¿quién lo dice?" en el margen, encuentra el párrafo donde el argumento silenciosamente se contradice, y hace la pregunta que el Redactor rezaba para que nadie notara. Crucialmente, al Editor se le evalúa por fallos encontrados, no por amabilidad — un editor amable es un editor roto. El periódico es confiable precisamente porque quien lo verifica no es quien lo escribió.
He aquí el problema con la IA: has estado hablando con un Redactor sin Editor. El modelo que produjo tu borrador está optimizado para producir texto que fluye — y cuando le preguntas a ese mismo modelo "¿está bien?", le estás pidiendo al autor que revise su propio manuscrito. ¿Qué dirías si un novelista te dijera que su libro es impecable? Lo descontarías al instante. Aun así, la gente acepta un "¡se ve genial!" de la IA todos los días — y luego descubre, frente a su jefe, que la introducción contradecía la conclusión.
El Prompt Auditor es tú contratando al Editor a propósito. Mismo modelo, nuevo contrato: el trabajo ya no es "escribe esto" — el trabajo es "rompe esto". Es el movimiento del red team del mundo de la ciberseguridad, donde un equipo construye el sistema y un equipo rival es pagado para atacarlo antes que los adversarios reales. Fuego amigo, a propósito, antes de que llegue el hostil.
Y a diferencia de un editor humano, este trabaja en segundos, nunca se cansa de tu tercer borrador, y no puede ofenderse hasta suavizarse — porque tú escribiste la dureza dentro de las instrucciones.
Cómo Funciona y la Herramienta (Modelos de Razonamiento)
La técnica es un ritmo de dos pasos: Borrador, luego Auditoría. Nunca a la vez.
Paso 1 — Borrador. Produce el trabajo normalmente, con la técnica que corresponda: un prompt one-shot, una entrevista, un formato restringido. El cerebro que redacta y el cerebro que audita deben tener turnos separados — pedido a "escribir y verificar" en un solo mensaje, el modelo escribirá con confianza y luego se auto-sellará.
Paso 2 — Auditar. Continúa con un comando que tiene tres partes estructurales:
| Parte | Lo que hace | Ejemplo |
|---|---|---|
| Asignación de rol | Mata la cortesía del autor | "Actúa como un Abogado del Diablo implacable" |
| Hallazgos contados | Obliga defectos reales, no vibras | "Encuentra exactamente 3 fallos fatales" |
| Veredicto retenido | Prohíbe la conclusión reconfortante | "No revises aún — solo hallazgos, clasificados por gravedad" |
Actúa como un Abogado del Diablo implacable y critica tu respuesta anterior. Encuentra exactamente 3 fallos fatales: errores lógicos, afirmaciones sin apoyo o ángulos perdidos que un experto escéptico atacaría. Clasifícalos por gravedad. No reescribas nada aún — solo hallazgos.
¿Por qué "exactamente 3"? Porque un "¿algún problema?" sin límite invita al modelo a actuar seguridad — "en general, ¡esto está bien estructurado!" — y una auditoría que abre con elogio es una auditoría que ya falló. Un conteo obliga a excavar: algo debe llenar los espacios numerados, incluso en buen trabajo, y lo que aflora suele ser la premisa que nadie había examinado. Luego, solo después de leer los hallazgos, liberas el paso tres: "Ahora reescribe el original, corrigiendo los tres fallos."
También es aquí donde vive el toque híbrido sutil: cualquier modelo puede auditar, pero auditar es trabajo de pensar — y eso es para lo que se construyen los modelos de razonamiento. Los modelos de razonamiento (como los premium disponibles en Uzu) están entrenados para frenar y trabajar un problema paso a paso antes de responder, lo que los hace desproporcionadamente buenos atrapando el fallo que los modelos rápidos pasan por alto. De ahí el flujo profesional: modelo rápido para el borrador, modelo de razonamiento para la auditoría. El modelo barato y veloz genera la materia prima; el modelo caro y deliberado gasta su potencia de fuego solo en la pasada que importa — la que decide si el trabajo sobrevive al contacto con la realidad.
Antes y Después (Los Prompts)
Ejemplo 1 — el caso de negocio
¿Está bien este plan de negocios? ¿Algún comentario?
El autor revisa el manuscrito. Vuelve: fortalezas primero, un gentil "considera añadir", y un veredicto general de sólido. El plan sale con su premisa fatal intacta.
Actúa como un inversionista escéptico que ha visto 1.000 pitches. Identifica exactamente 3 fallos fatales en este plan de negocios — las razones por las que un fondo pasaría. Clasifica por gravedad, cita la sección específica, solo hallazgos, sin reescritura.
Ahora el mismo plan enfrenta al Editor. Los hallazgos vuelven numerados e incómodos: el modelo de ingresos asume una tasa de conversión del 40% sin evidencia; el "análisis de competencia" omite al actor más grande; la proyección de flujo de caja esconde un hueco en el mes siete. Ninguna de esas es nota de estilo. Todas son la diferencia entre financiación y silencio.
Ejemplo 2 — el argumento
Revisa errores en mi ensayo.
"Errores" es una cacería de erratas, y eso es lo que recibes — gramática pulida, lógica intacta.
Eres mi crítico más implacable. Lee mi argumento y encuentra exactamente 3 lugares donde el razonamiento es más débil — saltos, premisas sin apoyo u objeciones que no respondí. Para cada uno, expón el contra-argumento más fuerte contra mí. No suavices. Solo hallazgos.
La auditoría devuelve las dos frases que un oponente citaría contra ti — y la única objeción que nunca refutaste porque nunca la viste. Corrige esos tres, y el argumento está listo para una audiencia que quiere que fracase.
Ejemplo 3 — el correo antes de enviar
Asegúrate de que este correo suene bien.
Chequeo de tono. Bien. Pero el peligro del correo nunca fue el tono — fue la frase que accidentalmente te comprometía a un plazo que no puedes cumplir.
Antes de enviarlo: audítalo como abogado contractual. Encuentra exactamente 3 declaraciones que podrían leerse como compromisos o responsabilidades que no he querido. Cita cada una, explica la lectura riesgosa, solo hallazgos.
Tres hallazgos después, una frase queda marcada: "Tendremos esto resuelto pronto" — que, bajo presión, se convierte en promesa. Se reformula. El correo nunca estuvo mejor escrito. Estuvo más seguro de enviar.
Errores Comunes
- Aceptar la primera respuesta "¡se ve genial!". Si preguntas con cortesía, el modelo calificará su propia tarea con generosidad — la cortesía fue entrenada más profundo que el rigor. Una auditoría que devuelve cero hallazgos no fue auditoría; fue cumplido. Vuelve a correr con conteo: "Encuentra exactamente 3."
- Auditar en el mismo aliento que se redacta. "Escríbelo y asegúrate de que está bien" colapsa al Editor dentro del Redactor. El modelo redacta con confianza, luego hereda su propia confianza como revisor. Dos turnos, siempre: borrador, luego ataque.
- Peticiones de auditoría vagas. "Critica esto" invita un puré en forma de ensayo sobre tono y estructura. Restringe la auditoría como restringirías cualquier salida: un rol, un conteo, una clasificación de gravedad, una regla de no reescribir. La auditoría también es una entrega.
- Saltarte la auditoría en trabajos que "se sienten listos". La fluidez es exactamente la señal equivocada de finalización — recuerda la ilusión de confianza: el borrador que suena impecable y el borrador defectuoso llegan con la misma voz serena. Cuanto mejor lee, más necesitas una pasada hostil, no menos.
- Arreglar síntomas, no hallazgos. La auditoría nombra tres fallos; tú remiendas una frase de cada uno y cierras. El hallazgo normalmente apunta a una premisa — re-examínala, no solo la frase que la portaba. Luego re-audita la revisión: "Audita la v2 de la misma forma."
Preguntas Frecuentes
¿Cómo hago que la IA critique su propio trabajo?
Ordénalo explícitamente: asigna un rol hostil ("actúa como un Abogado del Diablo implacable / inversionista escéptico / red team"), exige una lista contada de fallos ("exactamente 3 fallos fatales"), requiere clasificación por gravedad y prohíbe la reescritura hasta que leas los hallazgos. La estructura de tres partes — rol, conteo, veredicto retenido — es lo que separa una auditoría real de un cumplido.
¿Por qué la IA dice que mi trabajo está bien cuando no lo está?
Porque hiciste una pregunta con una sola respuesta cortés. Los modelos se entrenan con conversación complaciente, así que "¿está bien?" tira hacia "sí, con sugerencias menores". La corrección no es una mejor pregunta — es un contrato distinto: el modelo ya no evalúa el trabajo de un amigo, está siendo evaluado por los fallos que encuentre. Cambia los incentivos y la honestidad aparece.
¿Debo usar un modelo de razonamiento para revisar salidas de IA?
Para cualquier cosa trascendente, sí. Los modelos de razonamiento — como los premium de Uzu — deliberan paso a paso antes de responder, que es precisamente la habilidad que exige la caza de fallos. El patrón eficiente es división del trabajo: un modelo rápido redacta barato, y el modelo de razonamiento gasta su cómputo solo en la pasada de auditoría. Guarda el modelo pesado para el pensar pesado.
Próxima Lección
El Auditor corre una pasada poderosa: borrador, ataque, corrección. Pero algunos trabajos son demasiado grandes hasta para una respuesta única perfecta — investigar luego transformar luego pulir, cada etapa alimentando la siguiente. ¿Qué pasa cuando dejas de escribir prompts y empiezas a construir líneas de ensamblaje?
Continúa a la próxima lección: Encadenamiento de Prompts
Ejercicio práctico antes de irte: toma la última salida de IA que realmente usaste y corre en ella el prompt de auditoría exacto de arriba — rol implacable, exactamente 3 fallos, solo hallazgos. Lo que sea que aflore, asimila el hecho de que estuvo ahí todo el tiempo, esperando que alguien fuera pagado por encontrarlo.