Tecnología · July 18, 2026 · 5 min de lectura
¿Qué es una evaluación de AI Sandbox?
Prohibir la IA en una prueba mide si los candidatos pueden trabajar sin las herramientas que usarán a diario. Un AI Sandbox mide la verdadera habilidad de 2026: trabajar bien con la IA.
Parte de nuestra guía sobre evaluaciones de contratación generadas con IA. El mayor cambio de habilidades en la contratación desde 2023 es trabajar con herramientas de IA, y la mayoría de las evaluaciones todavía fingen que no existen.
Prohibir la IA mide lo que no debe
Encerrar a un candidato en una caja supervisada mide si puede trabajar sin las herramientas que usará todos los días en el trabajo. Eso es nostalgia, no señal.
Qué mide un AI Sandbox
- Dominio del prompt: ¿pueden obtener un resultado útil de un modelo de forma eficiente?
- Instinto de verificación: ¿detectan dónde se equivoca la IA?
- Criterio: ¿saben cuándo confiar en el resultado y cuándo no?
Le damos al candidato un artefacto defectuoso: un prompt con fallas o una salida generada por IA, y le pedimos que lo corrija, con ejecuciones en vivo contra casos de prueba visibles. Usar la IA es la tarea, no la trampa.
Cómo se califica
La calificación no es «¿funcionó?». Combina señales deterministas y económicas —¿la corrección realmente resuelve el problema, con qué eficiencia iteraron, quemaron cómputo de forma imprudente?— con señales evaluadas, cuya piedra angular es el comportamiento de verificación: ¿el candidato revisó la salida de la IA antes de confiar en ella? El dominio del prompt y la solidez del conocimiento del dominio completan el cuadro. Alguien que da por suerte con una respuesta aprobatoria sin verificar nunca obtiene una calificación peor que quien detecta y corrige una falla sutil, porque en el trabajo, la segunda persona es la que quieres.
AI Sandbox es distinto de AI Fluency: la fluidez pregunta si un candidato entiende el uso responsable de la IA; el Sandbox lo observa haciéndolo de verdad. Consulta la fluidez en IA como señal de contratación.
Escrito por
Jakir Patel · Founder, Hanzomon
Building H-Evaluate — AI-native, quality-gated hiring assessments. Writes about assessment engineering, hiring integrity and compliance-first AI.