No hay un único ganador. Depende del trabajo. Tanto Claude Code como el modo agente basado en Composer de Cursor lideran en refactorizaciones difíciles y de varios archivos, según informes reales de usuarios. GitHub Copilot gana en amplitud de IDE (VS Code, JetBrains, Visual Studio, Xcode) y en previsibilidad de precio para equipos que ya lo pagan. Gemini Code Assist tiene ahora mismo el nivel gratuito permanente más generoso de todas las herramientas de esta lista.
Casi todas las herramientas pasaron a facturación por uso en 2026. GitHub Copilot (1 de junio de 2026), OpenAI Codex (abril de 2026) y Qodo (julio de 2026) abandonaron la tarifa plana o avanzaron más hacia créditos medidos este año. Lee la sección de facturación antes de asumir que el precio del año pasado sigue vigente.
"Windsurf" ahora es "Devin Desktop". Cognition adquirió Windsurf en julio de 2025 y retiró la marca el 2 de junio de 2026, migrando automáticamente la configuración de los usuarios existentes. Si una comparativa que estás leyendo todavía trata a Windsurf como un producto independiente y activo, está desactualizada.
Elegir el modelo importa más que elegir la herramienta para la calidad del resultado. Copilot, Cursor y Cline permiten elegir entre las gamas actuales de modelos de Claude, GPT y Gemini dentro de la misma interfaz. La herramienta es sobre todo una capa de orquestación, y el modelo que hay debajo suele explicar más de la diferencia de calidad que la propia marca de la herramienta.
Precios y modelos, a día de hoy, no la captura de pantalla del año pasado
Cada lista que clasifica estas herramientas ahora mismo está trabajando con capturas de pantalla desactualizadas. Verificado directamente este mes contra las propias páginas de precios y documentación de cada proveedor:
Tool Free tier Paid, from Models available
-----------------------------------------------------------------------------------------------
GitHub Copilot 2,000 completions/50 chats/mo Pro $10/mo (usage- Claude Haiku 4.5-Opus 5,
based credits since GPT-5-5.6, Gemini 3.5-3.8
1 Jun 2026) Flash, Grok 4.5/4.6
Cursor 2,000 completions, 50 slow Pro $20/mo Composer 2.5 (own model),
premium requests Claude Opus 4.7-5/Fable
5.1, GPT-5-5.6, Gemini
3-3.8 Flash/Pro, Grok 4.5/4.6
Claude Code Not on Free plan Pro $17-20/mo Opus, Sonnet, Haiku,
Fable (Fable capped at
50% of weekly limit)
Devin Desktop Was free pre-rename; check Under devin.ai/ Was Claude Sonnet 4.6,
(formerly Windsurf) devin.ai/pricing directly pricing GPT-5.4, in-house SWE-1.5
OpenAI Codex/ Free, limited Go $8, Plus $20, GPT-6 Astra rolling out
ChatGPT Pro $100-200/mo since 3 Sep 2026 (Plus/
Pro/Business/Enterprise,
no free tier yet)
Gemini Code Assist 180,000 completions/mo, Standard $19- Gemini 3 Flash ($0.30/M
/ Gemini CLI 240 chats/day (permanent 22.80/user/mo in), Gemini 3 Pro
since March 2026) ($1.25/M in)
Cline Fully free, open-source, ClinePass (new Any provider via MCP:
bring-your-own-key Jun 2026) $9.99/mo Claude, Gemini, GPT,
bundled models OpenRouter, DeepSeek
Qodo Free Developer tier Pro Team: credits Bring-your-own-key on
($0.012 each, since Enterprise
Jul 2026)
Amazon Q Developer 50 agentic requests/mo, Pro $19/user/mo Amazon's own models;
1,000 lines Java transform (4,000 lines/mo, being sunset in favor
(new signups closed 15 May 2026) then $0.003/line) of Amazon Kiro
Tabnine No free tier (dropped 2025), Code Assistant $39, Bring-your-own-key or
14-day trial, no card required Agentic $59/user/mo Tabnine's own modelsEl patrón en la mayoría de estas filas es el mismo: el precio plano mensual está desapareciendo en favor de créditos medidos, y el nivel gratuito que solía ser la opción segura por defecto a veces ya no es la más generosa. Desde marzo de 2026, el nivel gratuito de Gemini Code Assist, 180.000 finalizaciones y 240 chats al día para cuentas individuales, es mayor que lo que cobran la mayoría de estas herramientas en su plan de pago de entrada. Dos filas merecen una segunda mirada antes de comprometer presupuesto: Amazon Q Developer cerró el registro de nuevos usuarios el 15 de mayo de 2026 mientras AWS traslada su inversión a su sucesor, Kiro, y Tabnine, a diferencia de todas las demás herramientas de esta lista, no tiene ningún nivel gratuito permanente desde que lo eliminó en 2025, solo una prueba de 14 días que no requiere tarjeta.
Qué dicen realmente los benchmarks, y cómo leerlos
Las cifras de los benchmarks se mueven aquí lo bastante rápido como para que cualquier puntuación concreta quede desactualizada en semanas, pero el patrón de clasificación es más duradero. En SWE-bench Verified, la prueba estándar de resolver incidencias reales de GitHub, los modelos de frontera están prácticamente empatados: Claude Opus 5 y GPT-5.6 Sol se sitúan ambos en torno al 96-97%, con Claude Fable 5 justo detrás con un 95%, según el seguimiento independiente de Artificial Analysis y morphllm.com. Es un benchmark saturado, con menos de 4 puntos entre los cinco primeros modelos, lo que indica que ya no distingue bien entre las herramientas. El modelo más nuevo de OpenAI, GPT-6 Astra, lanzado el 3 de septiembre de 2026, ya aparece en los rastreadores, pero se sitúa aproximadamente al mismo nivel que Fable 5.1, Opus 5 y los modelos de nivel Flash de Gemini específicamente en benchmarks estándar de ingeniería de software, un empate más que una toma de poder, según las pruebas independientes de DataCamp y ComputingForGeeks.
SWE-bench Pro, un sucesor más difícil creado específicamente porque Verified se saturó, separa más al campo: Claude Fable 5.1 lidera actualmente con un 81,2%, Opus 5 con un 79,2%, y Qwen3.8-Max bastante por detrás con un 67,7% (según el seguimiento de codingfleet.com de septiembre de 2026). En [Terminal-Bench 2.1](https://artificialanalysis.ai/evaluations/terminalbench-v2-1), una prueba de finalización real de tareas de terminal y agénticas, la propia clasificación de Artificial Analysis tiene a Claude Fable 5.1 liderando con un 91,4% (esfuerzo máximo), con GPT-6 Astra justo detrás con un 89,9% (esfuerzo alto), una clasificación genuinamente distinta a la de SWE-bench Pro y un recordatorio de que "el mejor" depende por completo de qué benchmark y qué nivel de esfuerzo elige destacar cada proveedor.
Una advertencia que merece la pena decir sin rodeos: una prueba independiente muy citada que compara Copilot (56,5%) con Cursor (51,7%) en 500 tareas de SWE-bench Verified es real, pero está probando el andamiaje de agente específico y la configuración por defecto de cada producto ese día concreto, no los modelos subyacentes de forma aislada. Cambia el ajuste de modelo de cualquiera de las dos herramientas y la brecha puede moverse. Trata las afirmaciones de benchmark herramienta-contra-herramienta como una instantánea de una configuración concreta, no como un veredicto permanente.
GitHub Copilot: la reacción contra la facturación por uso
Copilot trasladó todos sus niveles de pago a un sistema de solicitudes premium basado en uso el 1 de junio de 2026, anunciado en el propio blog de GitHub: cada plan incluye una asignación mensual de AI Credits (1 crédito = 0,01 $), y las solicitudes que la superan se facturan por uso en lugar de quedar simplemente no disponibles. La reacción fue inmediata y concreta. En Hacker News y en la cobertura de Visual Studio Magazine, un suscriptor de Pro+ informó de haber consumido el 8% de la asignación de créditos de un mes en dos horas de uso normal; otro describió que le cobraron unos 6 $ por una sola solicitud sin ninguna forma de ver el coste antes de que llegara. La queja principal no era el concepto de la facturación por uso, sino la falta de una estimación de coste previa a la solicitud, el mismo problema de opacidad que golpeó a la propia app de Gemini de Google cuando hizo un cambio parecido en mayo de 2026.
Nada de eso borra la ventaja real de Copilot: es la única herramienta de esta lista con soporte de primer nivel en VS Code, Visual Studio, los IDE de JetBrains, Xcode, Eclipse y su propia CLI, todo desde una sola suscripción. Si tu equipo está repartido entre varios IDE, esa amplitud es difícil de replicar cambiando de herramienta.

Cursor: la opción por defecto para usuarios avanzados, con su propio historial de facturación
La propuesta de Cursor es la flexibilidad de modelo dentro de un editor construido a propósito: su plan Individual (niveles Pro, Pro+ o Ultra, desde 20 $/mes) da acceso a los modelos insignia actuales de Anthropic, OpenAI y Google, además de su propio Composer interno, intercambiables según la tarea. Las quejas reales de los usuarios se centran en toparse con límites de "solicitud premium lenta" tras unas 50 sesiones intensas de Composer en un día, y en un historial de precios de 2025 (un incidente de sobrecoste sorpresa por el que la empresa ya se disculpó) que algunos usuarios todavía citan como motivo de cautela antes de comprometerse con Pro+ o Ultra. Para usuarios avanzados que quieren elegir su modelo según la tarea en vez de aceptar lo que la herramienta traiga por defecto, Cursor sigue siendo la opción más flexible de esta lista.

Claude Code: fuerte en problemas difíciles, con límites accidentados a principios de año
El propio agente de programación de Anthropic no está disponible en absoluto en el plan gratuito, solo desde Pro (17-20 $/mes) hacia arriba. El sentimiento de la comunidad en r/ChatGPTCoding es consistente: Claude Code es la herramienta a la que la gente recurre para refactorizaciones amplias y problemas ambiguos de varios archivos, mientras que Codex de OpenAI se lleva la preferencia para tareas estrechas y bien especificadas de una sola función. Esa reputación sufrió un golpe en marzo de 2026, cuando megahilos de "Usage Limit" documentaron que las asignaciones de sesión de 5 horas se agotaban en tan solo una o dos horas de uso real; Anthropic dobló los límites correspondientes el 6 de mayo de 2026 tras las quejas, según la cobertura de la época de MacRumors y The Register. Nuestra propia cobertura de los límites de Claude Code sigue los ajustes más recientes del nivel si estás decidiendo si los límites actuales encajan con tu flujo de trabajo.
Qué pasó con Windsurf
Si has leído una lista antigua de "mejor herramienta de IA para programar" y recomienda Windsurf, está describiendo un producto que ya no existe con ese nombre. Cognition, la empresa detrás del agente de programación autónomo Devin, anunció la adquisición de Windsurf en julio de 2025, y retiró formalmente la marca Windsurf el 2 de junio de 2026, integrándola en un producto unificado ahora llamado Devin Desktop. El cambio de nombre se hizo migrando automáticamente la configuración de los usuarios existentes en lugar de mediante un aviso de aceptación, lo que generó su propia ronda de publicaciones confundidas preguntando qué había pasado con el icono de la app al que estaban acostumbrados. Los precios que antes figuraban bajo Windsurf (nivel Gratis, Pro a 20 $, Max a 200 $, Teams a 40 $) ya no son la fuente de verdad actual; consulta directamente devin.ai/pricing en vez de cualquier comparativa anterior a junio de 2026, incluidas algunas listas todavía sin corregir que siguen clasificando hoy.

Las opciones gratuitas y casi gratuitas que merece la pena conocer
- Gemini Code Assist / Gemini CLI tiene ahora mismo el nivel gratuito permanente más generoso de todas las herramientas de esta lista: 180.000 finalizaciones y 240 chats al día para cuentas individuales, permanente desde marzo de 2026, no una prueba. Una salvedad real: la vía gratuita de Gemini CLI mediante un inicio de sesión personal de Google se descontinuó el 18 de junio de 2026, empujando hacia la Antigravity CLI independiente de Google o hacia una clave de API de pago. La propia extensión Gemini Code Assist integrada en el IDE no se ve afectada.
- Cline es completamente gratuita y de código abierto, una extensión de VS Code que orquesta cualquier modelo para el que aportes tu propia clave de API, incluidos Claude, Gemini, GPT o cualquier modelo listado en OpenRouter. Su nuevo ClinePass (9,99 $/mes, lanzado en junio de 2026) agrupa un conjunto rotativo de modelos de pesos abiertos si prefieres no gestionar claves de API por separado, pero la extensión principal en sí no exige ninguna suscripción.
- Qodo mantuvo un nivel gratuito Developer genuino a través de su propia revisión de precios de julio de 2026, que sustituyó su antiguo plan Pro Team de tarifa plana a 30 $/usuario/mes por facturación basada en créditos (0,012 $ por crédito, vendidos en paquetes).
Cuál para cada trabajo
Si ya pagas una suscripción agnóstica de IDE para todo un equipo, la amplitud de Copilot es difícil de superar; presupuesta su sobrecoste por uso en vez de asumir que una cifra mensual plana lo cubre todo. Si quieres elegir tu modelo según la tarea y no te importa un editor dedicado, Cursor te da la mayor flexibilidad. Para trabajo genuinamente difícil, ambiguo y de varios archivos, la reputación de Claude Code es actualmente la más sólida, y sus límites posteriores a mayo son más manejables de lo que eran en el primer trimestre de 2026. Si el coste es el factor decisivo y tu uso es de ligero a moderado, tanto el nivel gratuito de Gemini Code Assist como el modelo de traer tu propia clave de Cline evitan por completo una suscripción. Ninguna de estas herramientas escribe código correcto sin supervisión en un problema difícil; todas las fuentes de esta comparativa, tanto de proveedores como independientes, siguen recomendando revisar los diffs generados en vez de fusionarlos de confianza.
Preguntas frecuentes
¿Es Cursor mejor que GitHub Copilot?
Depende del trabajo. Cursor ofrece más flexibilidad de modelo y en general lo prefieren los usuarios avanzados para trabajo agéntico de varios archivos dentro de su propio editor. Copilot gana en amplitud de IDE (VS Code, JetBrains, Visual Studio, Xcode desde una sola suscripción) y es la opción por defecto más segura si tu equipo ya está repartido entre varios editores.
¿Cuál es la mejor herramienta de IA gratuita para programar?
Gemini Code Assist tiene ahora mismo el nivel gratuito permanente más generoso (180.000 finalizaciones, 240 chats al día para cuentas individuales, desde marzo de 2026), por delante del nivel gratuito de GitHub Copilot (2.000 finalizaciones/50 chats al mes) y del de Cursor. Cline también es completamente gratuita si aportas tu propia clave de API para el modelo que quieras usar.
¿Qué pasó con Windsurf?
Cognition (creadora del agente de programación Devin) adquirió Windsurf en julio de 2025 y retiró la marca el 2 de junio de 2026, fusionándola en un único producto llamado Devin Desktop. La configuración de los usuarios existentes se migró automáticamente. Cualquier comparativa que todavía liste a Windsurf como un producto independiente y activo está desactualizada.
¿Merece la pena pagar por Claude Code?
Se valora de forma consistente como la mejor de estas herramientas para problemas de programación difíciles, ambiguos y de varios archivos en los debates de la comunidad, pero no está disponible en absoluto en el plan gratuito de Anthropic. Sus límites de uso fueron una queja real en el primer trimestre de 2026 antes de que Anthropic doblara los topes correspondientes el 6 de mayo de 2026; los límites actuales son más manejables de lo que eran entonces.
¿Todas estas herramientas usan los mismos modelos de IA subyacentes?
No, pero varias permiten elegir. Copilot, Cursor y Cline permiten cambiar entre los modelos actuales de Claude, GPT y Gemini dentro de la misma interfaz. Otras, como Claude Code, están ligadas a la familia de modelos de su propio proveedor. El modelo que elijas dentro de una herramienta flexible suele explicar más de la diferencia de calidad del resultado que la propia marca de la herramienta.