Ingeniería de prompts y seguridad de IA

Desde tecnicas Zero-shot, Few-shot y CoT hasta Guardrails y defensa contra inyeccion de prompts — ingenieria de prompts y seguridad de IA para AIF-C01.

¿Qué es la Ingeniería de Prompts?

La ingeniería de prompts es la práctica de diseñar texto de entrada (prompts) para obtener resultados deseados de los modelos de IA — sin modificar el modelo en sí.

Es como dar instrucciones precisas a un chef: "Haz algo rico" da resultados impredecibles. "Bajo en calorías, vegetariano, sin picante, listo en 20 minutos" obtiene exactamente lo que quieres.

En AIF-C01, la ingeniería de prompts aparece en el Dominio 2 y el Dominio 3.

---

 

Las 4 Técnicas Principales de Prompts

Zero-shot Solicitar una tarea sin ejemplos. El enfoque más simple y rápido. Mejor para: clasificación simple, resumen, traducción.

Few-shot Proporcionar 2–5 ejemplos antes de tu solicitud real. Muestra a la IA el formato y patrón que deseas. Mejor para: tareas críticas de formato, escritura con estilo específico.

Chain-of-Thought (CoT) Guiar al modelo a razonar paso a paso. Mejora dramáticamente la precisión para matemáticas y lógica compleja. Frases de activación: "Pensemos paso a paso" / "Razona esto sistemáticamente"

System Prompt Capa de instrucciones oculta que establece el rol, persona y reglas del modelo. Los usuarios normalmente no lo ven.

!Las 4 técnicas principales de ingeniería de prompts

Amenazas de Seguridad de Prompts

Inyección de Prompts: Los atacantes insertan texto malicioso para anular las reglas del prompt del sistema. Filtración de Prompts: Los atacantes engañan al modelo para que revele el contenido del prompt del sistema. Jailbreaking: Los atacantes intentan eludir las pautas de seguridad de la IA.

Defensa: Bedrock Guardrails + validación de entradas + prompts de sistema endurecidos.

---

 

Referencia Rápida del Examen

| Concepto | Punto del Examen | |---------|-----------------| | Zero-shot | Sin ejemplos, adecuado para tareas simples | | Few-shot | 2–5 ejemplos, mejor para tareas críticas de formato | | Chain-of-Thought | Razonamiento paso a paso, mejora la precisión | | System Prompt | Preestablece rol/reglas del modelo, oculto para usuarios | | Temperatura | Menor = predecible, Mayor = creativo | | Bedrock Guardrails | Filtro de seguridad bidireccional con enmascaramiento de PII | | Inyección de Prompts | Entrada maliciosa anula reglas del prompt del sistema |

Volver a la lista del blog