Fundamentos de laEvaluación de Prompts
«Todo buen prompt merece ser explorado.»
-
Más claridadIdeas mejor definidas. -
Mejores resultadosRespuestas más útiles. -
Aprendizaje continuoExplora, prueba y mejora.
Generá tu CSV de pruebas
Vamos a crear un archivo CSV con preguntas de prueba para que puedas evaluar tus prompts en el siguiente paso.
Copiá este prompt
Pegalo en tu IA favorita (ChatGPT, Claude, Gemini, etc.) para que genere un CSV con preguntas de prueba.
…
Cargá tu CSV
Subí el archivo que generaste. Lo leemos acá mismo, en tu navegador: tu CSV no se sube a ningún servidor.
Traé los contextos de prueba
Cada fila del CSV es un contexto distinto donde vamos a observar al espécimen: el prompt de tu aplicación. Arrastrá el archivo a la bandeja o hacé click para elegirlo.
Corré la evaluación
Antes de tirar el dataset contra el modelo, frená un minuto y revisá si el prompt que vas a probar tiene buenas instrucciones.
Pasá el dataset por tu modelo
Agarrá el CSV y pedile al modelo que vaya iterando sobre cada pregunta con el prompt que querés evaluar.
Guardá esas respuestas: son el material que después va a revisar el grader contra los criterios del dataset.
Antes de correr: afiná el prompt
Un dataset no arregla un prompt flojo. Primero revisá objetivo, contexto, restricciones, formato esperado y ejemplos.
Leer guía de Prompt EngineeringSubí el análisis del grader
Cuando ya tengas las respuestas evaluadas, cargá el CSV del grader para revisar qué tan bien sobrevivió tu prompt al dataset.
Copiá el prompt del grader
Pegalo en tu IA junto con el dataset y las respuestas que generaste, para que devuelva el CSV de análisis que vas a subir acá abajo.
…
Traé el informe del grader
Subí el CSV con el análisis por respuesta para cerrar la expedición.