La ilusión de la igualdad: cómo la IA realmente amplió la brecha entre desarrolladores  👨‍💻 👨‍💻

Muchos creyeron ingenuamente que la IA generativa igualaría a juniors y seniors. Que la barrera de entrada se desdibujaba, solo escribe prompts y disfruta.

Salió un informe masivo Developer Habits Report de los creadores de Cursor (basado en telemetría real de millones de sesiones de desarrollo entre 2025 y mediados de 2026).


📈 La gran división: top 1% vs mediana

El coeficiente de Gini (índice de desigualdad) en volumen de código generado es 0.77, y en gasto en tokens es 0.75. Para que te hagas una idea: es un nivel de estratificación brutal, peor que en las economías más pobres basadas en materias primas.

🔵 Los desarrolladores del top 1% producen 46 veces más código de IA al día y fusionan 15 veces más PR por semana que el programador mediano.
🔵 El top 10% supera a la mediana en 10 veces en código y en 4 veces en PR.

¿Por qué? Mientras el desarrollador mediano usa Cursor como un autocompletado avanzado (escríbeme una función, haz una migración), los seniors del p99 construyen pipelines de agentes autónomos a su alrededor.


🧠 Los modelos leen más de lo que escriben

Cómo ha cambiado el trabajo con la base de código:

🔵 Crecimiento explosivo del contexto: La proporción de tokens de entrada a salida se disparó de 4.5x a 11.4x. Los agentes gastan una enormidad de recursos en "absorber" el contexto del repositorio antes de escupir una línea de código.
🔵 El caché lo resuelve todo: Hasta el 90% de toda la actividad de tokens es Cache Read. Quien sabe estructurar correctamente el proyecto y mantener el contexto "caliente", obtiene un agente inteligente mucho más barato.
🔵 Confianza sin freno: La proporción de cambios que se fusionan en commits sin aprobación manual aumentó del 7% al 36%. Más de un tercio del código de los agentes va directamente a producción.


💸 Economía de la mente: lo barato sale caro

En la economía de los modelos también hay un corte curioso. Modelos pesados como Opus 4.7 cuestan ~$1.57 por solicitud, mientras que los ligeros (Composer 2.5) cuestan unos ridículos ~$0.18. Casi 9 veces de diferencia.

Pero si calculamos la métrica "costo por línea de código aceptada", la brecha se reduce drásticamente.

Los modelos caros alucinan menos y producen código que se elimina con menos frecuencia durante la refactorización y vive más tiempo en el repositorio. La basura barata a la larga sale más cara.

Por más que me esfuerce por seguir todo esto, igual siento que voy, en el mejor de los casos, a medio camino en el proceso de adaptación a todo lo nuevo 🥲