Para vencer a la IA y encontrar trabajo hay que seguir siendo humano, el caso Anthropic

La prueba técnica utilizada para contratar ingenieros de alto nivel en Anthropic ya no funciona porque Claude, el modelo desarrollado internamente, se ha vuelto mejor que los candidatos. Lo que apesta es la inventiva que los humanos pueden aplicar.

es el mismo Antrópico para documentar lo que está sucediendo. y al mismo tiempo lanzar una advertencia: renuncia a lo que eres, humano, y lo perderás todo.

Un test creado para medir el trabajo real

La prueba desarrollada en 2024 por el equipo de ingeniería de rendimiento de Anthropic es una prueba que requiere Optimice el código para un acelerador de IA simuladocon herramientas similares a las que se utilizan internamente y un límite de tiempo definido. Sirve para observar cómo una persona afronta problemas complejos y abiertos, muy cercanos al trabajo diario.

En año y medio, más de mil personas completaron la prueba y decenas de ingenieros fueron contratados gracias a esta herramienta. Algunos de los perfiles más efectivos, dice Anthropic, tenían poca experiencia «sobre el papel» pero habían demostrado capacidad fuera de lo común en el premio para llevar a casa.

El equilibrio se rompió con la evolución de los modelos Claude. Primero Claude Opus 4, luego sobre todo Claude Opus 4.5comenzaron a desempeñarse mejor que la mayoría de los candidatos humanos, en la misma cantidad de tiempo.

Dentro de las limitaciones de tiempo de la prueba, Claude llegó a igualar el desempeño de los mejores seres humanos. En ese momento el problema ya no era identificar quién usaba IA o no, sino el hecho de que la prueba en sí Ya no era capaz de distinguir un candidato excelente del resultado del modelo más avanzado..

El punto de inflexión: pruebas menos realistas pero más “resistentes”

Después de varios intentos fallidos, Anthropic eligió un camino radical. La nueva prueba abandona el realismo y se centra en problemas intencionalmente inusualesinspirado en la programación de acertijos con conjuntos de instrucciones extremadamente limitados, similares a los de los juegos de Zachtronics.

Estos ejercicios son fuera de distribuciónmal representados en los datos de entrenamiento del modelo, y requieren un tipo de razonamiento que todavía hoy pone a Claude en dificultades. No simulan directamente el trabajo diario, pero nos permiten recuperar una señal útil en la selección.

Es un compromiso declarado. El propio autor de la prueba admite que el antiguo sistema funcionaba porque parecía un trabajo real, mientras que lo nuevo funciona porque introduce situaciones nuevas e inusuales.

La inventiva como verdadera ventaja humana

El caso de Anthropic muestra que la IA puede volverse imbatible cuando el problema está bien definido, es mensurable y rastreable según patrones ya conocidos. Pero también muestra su limitación más obvia: Claude es muy bueno explorando lo que existe, y mucho menos inventando lo que no existe..

Cuando las pruebas se vuelven inusuales, cuando las reglas son arbitrarias, cuando el problema no se parece a nada que hayamos visto antes, entra en juego algo que hoy sigue siendo humano: la capacidad de imaginar nuevos caminos, sortear limitaciones, transformar un límite en una idea. No es sólo una cuestión de creatividad artística, sino de imaginación técnica, de intuición, de coraje para intentar soluciones que no surgen de un promedio estadístico.

Para seleccionar personas es necesario forzar a los modelos a salir de su zona de confort. Y ahí es donde La inventiva humana vuelve a marcar la diferencia.. No porque la IA sea “estúpida”, sino porque no tiene experiencia directa del mundo, ni ganas de sorprender, ni instinto de romper moldes para ver qué pasa.

En este espacio –frágil, irregular, difícil de medir– todavía hay lugar para los seres humanos.