La IA eligió la versión de ChatGPT el 97.6% del tiempo.
Un equipo de la Universidad de Maryland, la Universidad Nacional de Singapur y Ohio State acaba de publicar el recibo. Tomaron 2,245 currículums escritos por humanos reales extraídos de un sitio profesional de currículums de antes de que existiera ChatGPT, para que la escritura humana fuera realmente humana. Luego, hicieron que siete de los modelos de IA más utilizados en el mundo reescribieran cada uno. GPT-4o. GPT-4o-mini. GPT-4-turbo. LLaMA 3.3-70B. Qwen 2.5-72B. DeepSeek-V3. Mistral-7B.
Luego, le pidieron a cada IA que eligiera el mejor currículum. Cada modelo eligió el suyo propio.
GPT-4o alcanzó el 97.6%. LLaMA-3.3-70B alcanzó el 96.3%. Qwen-2.5-72B alcanzó el 95.9%. DeepSeek-V3 alcanzó el 95.5%. El humano real casi nunca ganó.
Luego, los investigadores probaron la obvia objeción. Tal vez la IA solo sea mejor escribiendo. Así que hicieron que humanos reales evaluaran los currículums por calidad real y ejecutaron el experimento de nuevo, controlando por ello. El resultado fue peor. Cada IA siguió eligiendo la suya propia incluso cuando los jueces humanos calificaron la versión escrita por humanos como más clara, más coherente y más efectiva.
Se pone peor. Las IAs no solo prefieren la IA sobre los humanos. Se prefieren a sí mismas sobre otras IAs. DeepSeek-V3 eligió sus propios currículums un 69% más a menudo que los de LLaMA. GPT-4o eligió los suyos un 45% más a menudo que los de LLaMA. Cada modelo puede reconocer y recompensar su propio dialecto.
Luego, los investigadores ejecutaron la simulación que acaba con carreras. Mismo puesto. 24 ocupaciones. Mismas calificaciones. La única variable era si el candidato usaba la misma IA que la herramienta de selección. Los candidatos que usaban esa IA tenían un 23% a 60% más de probabilidades de ser preseleccionados. La brecha peor fue en ventas, contabilidad y finanzas.
El 99% de las grandes empresas ahora ejecutan IA en los currículums entrantes. La mayoría de ellas usa GPT-4o. El artículo acaba de demostrar que GPT-4o elige GPT-4o el 97.6% del tiempo.
Si escribiste tu propia carta de presentación esta semana, no perdiste contra un candidato mejor. Perdiste contra un candidato peor que le pagó 20 dólares a OpenAI.
Tus calificaciones no importan si la IA prefiere su propia caligrafía sobre la tuya.
https://arxiv.org/abs/2509.00462