El Entrenador de Evaluación Kirkpatrick skill para Claude
Das tu objetivo de formación y el cambio de comportamiento que quieres ver, y recibes un plan de medición con los cuatro niveles de Kirkpatrick: una encuesta de satisfacción, criterios para una prueba previa y una posterior, un esquema de observación para el día 30, 60 y 90 con indicadores de comportamiento para los responsables, y el enlace con tres a cinco KPI de empresa ya existentes. Cada cifra viene de ti o aparece como [COMPLETAR] en el plan, con una propuesta de cómo conseguirla. La skill no inventa puntuaciones objetivo ni porcentajes de ROI.
las reglas de arriba vienen del zip de esta página · SKILL.md pesa 9.828 bytes
Objetivo de formación dentro, plan de medición fuera
reg. K.001Este es el ejemplo desarrollado que aparece en el propio SKILL.md, aquí mostrado de forma resumida. Fíjate en las cifras y los valores objetivo. Están ahí, pero nunca como afirmación de la skill: la puntuación objetivo la fija el cliente, la mejora mínima se confirma, y donde no hay medición inicial aparece simplemente [COMPLETAR].
Qué es el Entrenador de Evaluación Kirkpatrick
El Entrenador de Evaluación Kirkpatrick es una skill gratuita de nuestra propia biblioteca de skills para Claude. Una skill es un archivo de instrucciones, SKILL.md, que le da a un asistente de IA una forma de trabajar fija para una tarea. Nada de software que instalas, ni suscripción, ni conexión con tu LMS: un solo archivo de texto de 1.390 palabras que le dice a Claude cómo funcionan los cuatro niveles de Kirkpatrick, qué te tiene que preguntar, en qué orden se construye el plan de medición y qué cifras no puede inventarse bajo ningún concepto. Descargas el zip en la parte superior de esta página, lo colocas en tu entorno de IA, y a partir de ese momento Claude construye planes de medición con esta lógica.
El problema que resuelve la skill está señalado en el propio archivo y es reconocible para cualquiera que haya organizado alguna vez una formación. Una encuesta de satisfacción te dice cómo se sintió la gente. Los niveles 3 y 4 te dicen si algo ha cambiado de verdad. La mayoría de las evaluaciones se quedan en el nivel 1, y entonces solo queda un grupo de participantes contentos y una dirección que pregunta qué ha aportado. Esta skill lleva el plan de medición hasta las cifras que mira esa dirección, sin fingir que eso demuestra que la causa fue la formación.
Está escrita para formaciones, onboarding, procesos de cumplimiento y programas de adopción de IA. No hace falta conocer Kirkpatrick de antemano: los niveles, la lógica de diseño y las trampas están en el archivo. Forma parte de la biblioteca de skills NL que ponemos a disposición de forma gratuita desde el servicio IA y automatización, sin cuenta y sin correo comercial después. Si eres nuevo con las skills, qué son las skills de Claude NL explica primero qué es exactamente lo que descargas.
Hay algo que debes saber de antemano, y el archivo es estricto en esto: esto es un marco de medición, no un diseño didáctico ni una investigación científica de efectos. El plan de medición hace que el efecto sea plausible y discutible. Sin grupo de control muestra correlación y no causa, y esa frase, según la skill, también debe aparecer en tu informe.
Por qué las evaluaciones se quedan estancadas en el nivel 1
Casi toda formación termina con un formulario. Si fue útil, si el formador estuvo bien, cómo fueron las instalaciones. Ese formulario es fácil de enviar, casi siempre vuelve con una nota decente, y no dice absolutamente nada sobre lo que pasa el lunes en el puesto de trabajo. Cuatro causas mantienen ese patrón, y la skill las aborda todas.
La medición se piensa después de todo. Para entonces la formación ya está diseñada, los participantes ya están elegidos y el momento para una medición inicial ya ha pasado. El New World Kirkpatrick Model le da la vuelta a esto: empiezas por el nivel 4, el resultado de negocio deseado, y trabajas hacia atrás hasta lo que la gente debe hacer, saber y experimentar. Esa secuencia se sigue al pie de la letra: primero la pregunta de qué resultado debe tocar la formación, y solo después se construye el nivel 1.
No hay un comportamiento señalable. Sin una descripción concreta de qué hace la gente de forma distinta tras la formación, no hay nada que observar. Por eso la skill hace esa pregunta primero, y por eso no sigue adelante sin una respuesta. En el archivo está dicho sin rodeos: sin comportamiento señalable no hay plan de medición.
Los indicadores son sentimiento, no comportamiento. Muestra compromiso no es un indicador, porque dos responsables verán ahí cosas distintas. Comparte cada semana una forma de trabajar con el equipo sí lo es, porque ocurrió o no ocurrió. Se niega a entregar esquemas de observación sin comportamiento observable, y precisamente en esa diferencia se atascan la mayoría de las mediciones de comportamiento.
Y el nivel 4 se salta o se exagera. Se salta porque es difícil, o se le atribuye a la formación toda una subida de KPI. Ninguna de las dos cosas ocurre aquí, y es una elección deliberada. Vincula de tres a cinco KPI existentes con su fuente de datos y su frecuencia de medición, y señala en el mismo momento qué otros factores mueven ese mismo KPI.
En forma de diff, con indicadores del ejemplo de la skill. A la izquierda lo que suele aparecer en un formulario de observación, a la derecha lo que realmente puedes marcar.
Diseñado de arriba hacia abajo
reg. K.002Los cuatro niveles tal como aparecen en el SKILL.md, pero en el orden en que la skill los diseña. Medir se hace de abajo hacia arriba, de reacción a resultado. Diseñar se hace al revés: empiezas por el resultado de negocio y trabajas hacia atrás. La fila destacada arriba es, por tanto, el punto de partida de la skill, no la meta final.
Lo que realmente hay en el SKILL.md
Una skill vale lo que valen sus instrucciones, así que aquí las describimos sin más. El archivo se abre con un frontmatter que indica cuándo debe activarse Claude. No solo con las preguntas obvias como kirkpatrick, evaluar formación, plan de medición para una formación o justificar un presupuesto de formación, sino también con quejas: no sé si mi formación aporta algo, solo enviamos un formulario de satisfacción, todos estaban entusiasmados pero nadie hace nada distinto, tras la formación todo vuelve a caer, mis evaluaciones solo dicen algo sobre los bocadillos. Quien le diga algo así a Claude con la skill cargada, la recibe automáticamente.
Después viene la teoría sobre la que se apoya la skill, redactada en el propio archivo. Donald Kirkpatrick describió sus cuatro niveles de evaluación en 1959 en una serie de artículos en el Journal of the American Society of Training Directors, surgidos de su tesis. En 1994 recopiló el modelo en Evaluating Training Programs: The Four Levels. Su hijo James y su nuera Wendy lo actualizaron en 2016 como el New World Kirkpatrick Model, con más énfasis en diseñar la medición de antemano y en el apoyo después de la formación.
El núcleo del archivo es una lista de ocho acciones fijas. Primero pregunta de forma dirigida: el objetivo de la formación, el público objetivo y el tamaño del grupo, la duración y la forma, y sobre todo el cambio de comportamiento deseado en el puesto de trabajo. Trabaja hacia atrás desde el nivel 4 y busca de tres a cinco KPI existentes. Construye el nivel 1 como una encuesta corta sobre relevancia, aplicabilidad e implicación, con una puntuación objetivo que tú fijas. El nivel 2 se convierte en un conjunto de criterios de evaluación para una prueba previa y posterior que encajan con el comportamiento deseado.
Construye el nivel 3 como un esquema de observación para el día 30, 60 y 90, con tres a cinco indicadores observables por momento de medición y un formato para rellenar. El nivel 4 se convierte en el enlace entre esos indicadores y los KPI, con la frecuencia de medición, la fuente de datos y la observación de qué otros factores se mueven a la vez. Indica con honestidad los recursos necesarios: bastan una herramienta de encuestas, una hoja de cálculo y un formulario de observación. Y entrega un cronograma del día 0 al día 90, con el responsable de cada momento.
Antes de construir nada, la skill repasa una lista de comprobación de entrada obligatoria: el objetivo de la formación en una frase y el cambio de comportamiento deseado, público objetivo y número de participantes más si sus responsables quieren colaborar en la observación, duración y formato, los KPI de empresa existentes con sus valores actuales si los tienes, las herramientas disponibles, y el plazo en el que la organización quiere ver resultados más quién debe aprobar el plan de medición. Solo pregunta después por lo que falta.
La salida sigue un orden fijo de seis partes: objetivo y cambio de comportamiento con los supuestos que debes confirmar, luego los cuatro niveles cada uno con su momento de medición y su responsable, y por último el cronograma con todos los momentos de medición en fila. Si quieres aprender a escribir tú mismo este tipo de archivos, escribir un SKILL.md NL explica la estructura.
Día 0 hasta día 90
reg. K.003El sexto bloque de la salida es un cronograma de todos los momentos de medición con su responsable en cada uno. Ese bloque es la razón por la que un plan de medición sigue vivo: sin un nombre junto a una fecha, la medición del día 60 no ocurre. El cronograma del ejemplo de la skill, con el papel que cumple el momento de medición según ese mismo ejemplo.
La teoría sobre la que se apoya la skill
El SKILL.md nombra cinco fuentes por su nombre, y es deliberado: así puedes leerlas y decidir por ti mismo si estás de acuerdo con las decisiones tomadas. Llama la atención que haya una fuente crítica entre ellas. No es un descuido, es la razón por la que la skill formula las cosas con tanta cautela.
El modelo viene de Donald Kirkpatrick. Describió los cuatro niveles en 1959 en una serie de artículos en el Journal of the American Society of Training Directors, surgidos de su tesis, y los recopiló en 1994 en Evaluating Training Programs: The Four Levels. Ese sigue siendo el esqueleto de cualquier plan de medición que entrega la skill.
La lógica de diseño viene de James y Wendy Kirkpatrick. Su New World Kirkpatrick Model de 2016 pone el énfasis en dos cosas que en la versión original quedaban poco tratadas: diseñar la medición de antemano en lugar de pensarla después, y el apoyo tras la formación. De ahí viene el orden invertido de la FIG.02.
El quinto nivel viene de Jack Phillips. Return on Investment in Training and Performance Improvement Programs, de 1997, añadió el ROI por encima del nivel 4, con sus correspondientes salvedades. La skill cita esa fuente, pero no calcula ningún ROI ni se inventa ningún porcentaje. Si quieres determinar las cifras detrás de un cálculo así, te conviene más la skill Entrenador de Estrategia de Precios NL, que trata precisamente esa cuestión de valor.
La crítica viene de Alliger y Janak. Su artículo Kirkpatrick's Levels of Training Criteria: Thirty Years Later, de 1989, en Personnel Psychology, trata sobre la causalidad asumida entre los niveles: la idea de que los participantes satisfechos también aprenden, y que quien aprende también lo aplica, no resulta evidente. Esa fuente está en el archivo y explica por qué la skill nunca presenta el nivel 1 como predictor del nivel 2.
Incluso sin instalar la skill puedes mejorar tu propia evaluación con estos principios: empieza por el resultado que quieres ver, describe comportamiento que puedas marcar, acuerda un responsable por cada momento de medición, y señala en tu informe qué más presiona sobre ese KPI.
Lo que la skill rechaza
reg. K.004El SKILL.md contiene una lista de siete cosas que la skill nunca hace, y en evaluación esa lista es la mitad del producto. Un plan de medición con cifras objetivo inventadas parece profesional y no vale nada. En la conversación, estas reglas se traducen así: cada regla es una petición que podrías hacer, con la reacción que la skill da según sus propias instrucciones.
Instalar en Claude Code, Claude.ai o Codex
El zip contiene una carpeta, ai-kirkpatrick-evaluatiecoach, con el SKILL.md dentro. Instalarlo consiste en poner ese archivo en el lugar correcto, y ese lugar cambia según el entorno. SKILL.md es un estándar abierto desde diciembre de 2025, y por eso la misma skill funciona también en Codex, Cursor y Gemini CLI. Así que no descargas un archivo de Claude, sino una instrucción de trabajo que puede leer cualquier asistente de IA moderno.
- Descomprime el zip en
~/.claude/skills/(o.claude/skills/en tu proyecto). - Claude reconoce la skill después por sí solo en cuanto empiezas a hablar de evaluar formaciones, planes de medición o Kirkpatrick.
- Invocarla directamente también es posible, con
/ai-kirkpatrick-evaluatiecoach.
- Ve a Customize y luego a Skills.
- Sube ahí el zip como skill.
- O pega el contenido de SKILL.md en las instrucciones de proyecto de un Project.
- Abre
AGENTS.mden tu repositorio. - Pega ahí el contenido de SKILL.md, o pon SKILL.md como archivo aparte junto a él y remite a él desde
AGENTS.md. - Codex lo lee en cada sesión.
Después, el uso es simple: describe tu objetivo de formación y, sobre todo, qué debe hacer la gente de forma distinta después. Si te atascas al descomprimir o al encontrar la carpeta correcta, eso está explicado paso a paso en instalar skills de Claude NL. Y si quieres primero la explicación más amplia sobre trabajar con IA, la encuentras en la base de conocimiento NL.
Cuándo usarlo y cuándo no
Está en su mejor momento en procesos donde alguien va a preguntar después qué se ha conseguido: un programa de adopción de IA, un proceso de onboarding, un proceso de cumplimiento, una serie de formaciones con un presupuesto detrás. Cuanto antes lo uses, más le sacas, porque la medición inicial del día 0 es el único momento de medición que no puedes recuperar después. También es útil si solo quieres afinar qué es lo que realmente quieres ver cambiar: esa primera pregunta sobre comportamiento suele abrir ya otra conversación con el cliente.
También hay situaciones en las que es mejor dejarlo de lado, y el propio archivo las menciona. Diseñar la formación es una de ellas: esto es un marco de medición, no un diseño didáctico. Qué pasa en la formación y cómo se estructura el contenido es trabajo para otro tipo de ayuda, por ejemplo la skill Entrenador de la Taxonomía de Bloom, que escribe objetivos de aprendizaje y preguntas de evaluación por nivel cognitivo. La prueba estadística es el segundo límite: el plan de medición hace que el efecto sea plausible y discutible, no es una investigación científica de efectos con grupo de control. Y el tercero es la evaluación de personas: las puntuaciones de observación están ahí para evaluar la formación, no para rellenar un expediente.
Otro límite honesto que la propia skill señala: en grupos pequeños y plazos cortos, el nivel 4 a menudo no se puede demostrar con solidez. Eso no significa que lo saltes, sino que el informe cuenta con honestidad qué puedes ver y qué no. Si trabajas hacia una decisión de continuar o parar, esa distinción importa más que la cifra en sí.
Hacerlo tú mismo o dejarlo hecho
reg. K.005Esta skill es la versión gratuita de hazlo tú mismo de un trabajo que también ofrecemos como servicio. La skill sigue completa y sin trampas, pero ten en cuenta qué es una skill: le enseña a tu IA cómo hacer algo, mientras cada sesión nueva empieza vacía. La skill no es el motor ni la memoria. Tú escribes el prompt, tú aportas el contexto cada vez de nuevo, tú controlas. En un plan de medición que se extiende a lo largo de noventa días eso es un problema real, porque la medición del día 60 no vuelve sola a tu pantalla.
dónde estás ahora La skill: tú eres el motor Ejecutas tú mismo el Entrenador de Evaluación Kirkpatrick en Claude, Codex o Cursor. No cuesta nada, funciona hoy mismo, y lo mantienes por completo en tus manos: sin periodo de prueba, sin partes bloqueadas. El límite es tu propio tiempo: solo ocurre cuando tú escribes el prompt, y tienes que explicar tus KPI y tu organización cada sesión de nuevo.
que te lo preparen El Empleado de Informes: está listo sin que tú escribas el prompt Exactamente este trabajo, pero como servicio: el Empleado de Informes prepara los informes semanales y mensuales sin que tengas que sentarte tú delante de Claude, y eso es justo lo que necesita un plan de medición en el día 30, 60 y 90. El control sigue siendo tuyo, porque la salida queda como borrador hasta que una persona la aprueba. Esto lo ofrecemos a través de Mansotti, la empresa de la que TheSEO es el nombre comercial, que además del Empleado de Informes construye también un Empleado de Presupuestos y un Empleado de Ventas (investigación de prospectos). Lee qué es y qué hace un empleado de IA NL.
todo desde una fuente Jarvis: todas tus IA trabajan desde el mismo conocimiento de empresa La skill le enseña a la IA, el cerebro es donde vive la memoria. Si quieres que todas tus IA trabajen desde el mismo conocimiento de empresa: eso es Jarvis, el cerebro de la organización. Conecta ChatGPT, Claude, Codex y a tus personas con los mismos proyectos, conocimiento clave y decisiones, de modo que tu próxima sesión no empiece de cero. Jarvis selecciona el contexto, delega el trabajo y solo guarda lo que ha sido aprobado: el conocimiento de cliente queda aislado y cada paso deja un rastro comprobable. Esta skill también mejora con ello, porque ya no tienes que aportar tus definiciones de KPI, tus mediciones iniciales ni el acuerdo de quién mide qué en cada sesión. Lo que eso aporta en concreto, desde los planes hasta tu primera semana, lo lees en el propio Jarvis.
Lo que Jarvis aporta en concreto
reg. K.006El peldaño 3 merece más que un párrafo, porque aquí está la diferencia entre un chat inteligente y un sistema sobre el que puedes construir. Jarvis es el cerebro de la organización: recuerda lo que tus IA deben saber, reparte el trabajo y registra lo que ha ocurrido. En un plan de medición de noventa días eso no es un lujo sino el núcleo, porque una medición que nadie recupera no es una medición.
Nosotros mismos llevamos meses funcionando con este sistema. Cada sesión de agente, cada tarea y cada decisión se registra y se puede volver a leer. Una sesión nueva no empieza en blanco: primero recupera las decisiones registradas, los proyectos en marcha y los últimos cambios, y sigue trabajando donde se quedó la anterior. Así que no describimos una promesa, sino la forma de trabajar en la que estamos nosotros mismos cada día.
Consulta los cuatro planes en jarvis/prijzen NL. A través de la lista de espera NL solo indicas, sin compromiso, tu plan preferido. Eso todavía no crea ninguna cuenta, pedido ni obligación de pago. El trabajo a medida para empresas lo hablamos primero.
Las skills alrededor
reg. K.007Un plan de medición nunca va solo: antes hay una formación y después llega un informe. Estas skills de la misma biblioteca cubren cada una una parte distinta de esa cadena.
Antes de la formación
el diseñoEl plan de medición mide lo que persigue la formación. Estas dos tratan esa primera parte.
Entrenador de la Taxonomía de BloomEscribe objetivos de aprendizaje y preguntas de evaluación por nivel cognitivo, justo lo que necesita el nivel 2.SKILL Entrenador de la Técnica FeynmanHace simplificar el contenido hasta que los huecos en la comprensión se hacen visibles.SKILL NLEn torno a la medición
las cifrasEl nivel 4 se apoya en KPI que ya existen. Estas dos tratan esas cifras en sí.
Entrenador del Balanced ScorecardOrdena tus KPI de empresa en cuatro perspectivas, para que sepas cuál enlazas.SKILL Entrenador de OKRConvierte objetivos en resultados clave medibles, con la misma exigencia: ninguna cifra sin fuente.SKILL NLDespués de la formación
el comportamientoEl nivel 3 trata de lo que la gente sigue haciendo. Estas dos tratan de mantenerlo.
Entrenador de Mentalidad de CrecimientoPara el participante que a las dos semanas vuelve a la forma de trabajar anterior.SKILL Entrenador de Práctica DeliberadaOrganiza práctica dirigida con retroalimentación, para que el comportamiento no decaiga tras el día 30.SKILLSeguir mirando
el contextoDe dónde viene esta skill y qué más hay.
Toda la biblioteca de skills100 skills gratuitas en fila, ordenadas por tema.HUB NL IA y automatizaciónEl servicio detrás: de skills sueltas a automatización que funciona.SRV Formaciones en IALa formación con la que encaja este plan de medición, si tu equipo se pone con la IA.SRV Base de conocimientoArtículos sobre SEO, IA y visibilidad online, buscables.DOC NLPreguntas frecuentes
¿Cuánto cuesta la skill Entrenador de Evaluación Kirkpatrick?
Nada. La skill es gratuita, está bajo la licencia MIT y no tienes que crear ninguna cuenta ni dejar ningún correo electrónico. Descargas un zip de 4,1 KB con una carpeta dentro y un único archivo, SKILL.md, y eso es la skill completa. No hay versión de pago y no llega ningún correo de ventas después.
¿Funciona esta skill también en Codex, Cursor o Gemini CLI?
Sí. SKILL.md es un estándar abierto desde diciembre de 2025, y por eso el mismo archivo funciona también en Codex, Cursor, Gemini CLI y otras herramientas que siguen el estándar. En Codex descomprimes el zip en .agents/skills/ dentro de tu proyecto, o en ~/.agents/skills/ para todos tus proyectos; Codex admite SKILL.md directamente desde el estándar abierto de diciembre de 2025. Poner el contenido de SKILL.md en tu AGENTS.md también sigue siendo posible. Las instrucciones son texto normal y legible, así que cualquier asistente que acepte archivos de instrucciones puede trabajar con ellas.
¿Calcula la skill el ROI de mi formación?
No. Inventar porcentajes de ROI está entre las cosas que la skill nunca hace. El quinto nivel, el ROI, viene del trabajo de Jack Phillips de 1997 y figura en la lista de fuentes, con sus salvedades. Lo que sí hace la skill es construir el nivel 4: enlazar tres a cinco KPI de empresa existentes con los indicadores de comportamiento, con fuente de datos, frecuencia de medición y los factores externos que influyen en ese mismo KPI.
¿Se inventa la skill puntuaciones objetivo y mediciones iniciales si no las tengo?
No. Cada cifra viene de ti o se convierte en [COMPLETAR] con una propuesta de cómo conseguirla. En el ejemplo desarrollado aparece una puntuación objetivo de 4,0 sobre 5 explícitamente como algo que fija el cliente, y una mejora mínima del 25 por ciento como algo que confirma el cliente. Si falta una medición inicial, aparece [COMPLETAR: se necesita medición inicial].
¿Un plan de medición demuestra que mi formación funciona?
No, y la skill lo dice ella misma. Sin grupo de control, el nivel 4 muestra correlación y no una relación causal, y esa frase también debe aparecer en el informe. El modelo tiene más límites: los niveles no son una cadena causal demostrada, la satisfacción predice mal el resultado de aprendizaje, y en grupos pequeños y plazos cortos el nivel 4 a menudo no se puede demostrar con solidez.
¿Puedo medir solo el nivel 1 y 2?
Sí, se puede, pero no en silencio. La skill no salta los niveles 3 y 4 porque sean difíciles. Si eliges deliberadamente solo reacción y aprendizaje, señala qué queda entonces sin responder: si la gente aplica de verdad lo aprendido, y si algo cambia en las cifras que mira la dirección.
¿Qué herramientas necesito para ejecutar el plan de medición?
Según el archivo, bastan una herramienta de encuestas, una hoja de cálculo y un formulario de observación. No hacen falta sistemas de medición complejos, y la skill lo indica explícitamente como parte del plan. En la lista de comprobación de entrada pregunta qué herramientas ya tienes, para que el plan de medición encaje con lo que hay en lugar de con lo que deberías comprar.
Primero el comportamiento, después las cifras
La pregunta más difícil de todo este marco es la primera: qué hace la gente de forma demostrablemente distinta después de la formación. Quien tenga una respuesta clara a eso, tiene el plan de medición medio hecho y normalmente también una formación mejor. Si quieres que tu equipo se ponga con la IA y poder mostrar de inmediato qué cambia con ello, esa es exactamente la combinación que ofrecemos en las Formaciones en IA. Y si quieres seguir hablando de lo que la IA puede asumir además en tu organización, desde skills sueltas hasta automatización completa, lo hacemos sin más en una conversación.