La factura que no se suponía tan grande

Si tu última factura del asistente de código con IA te ha sorprendido, no eres el único. La mayoría de desarrolladores independientes se apuntaron a un plan mensual fijo y descubrieron después que las sesiones de chat, las ejecuciones de agentes y las peticiones a modelos premium consumían un fondo aparte de créditos o tokens. El precio de entrada sigue siendo la cuota. Lo que pagas de verdad al mes depende de cuánto exprimas al agente.

Esta guía recorre cómo miden realmente el consumo los principales asistentes en 2026, cómo fijar límites por desarrollador antes de que llegue la sorpresa, cuándo conviene sustituir créditos de pago por un modelo local y cómo auditar una suscripción existente sin perder una semana en hojas de cálculo.

Licencia vs consumo: lo que cambió

Hace dos años, casi todos los asistentes cobraban una cuota mensual fija y anunciaban completados “ilimitados” o un buen número de peticiones. Ese modelo casi ha desaparecido.

Hoy los asistentes suelen dividir la facturación en dos capas:

  • Suscripción por usuario: lo que pagas cada mes por tener derecho a usar el editor o la extensión. Esta parte es predecible.
  • Fondo de uso: una reserva de créditos, tokens o unidades de cómputo que se vacía cuando lanzas chat, agentes o modelos premium. Esta parte es la variable.

Los completados en línea (el texto gris que aparece mientras escribes) suelen seguir siendo gratis o muy baratos en las herramientas principales. La parte cara es todo lo que es agéntico: refactors sobre varios ficheros, hilos de chat largos, ejecutar el modelo más potente sobre una base de código grande. Cuando ese fondo se agota, o paras de trabajar, o esperas al siguiente ciclo, o te facturan el exceso a precio de API.

Si solo usas completados, la cuota es casi tu coste real. Si dependes de agentes o saltas a modelos frontera para los problemas difíciles, espera que la factura suba.

Cómo miden el consumo las herramientas principales ahora mismo

Las cifras cambian con frecuencia, así que toma la tabla siguiente como una foto, no como un contrato.

Herramienta Plan de pago de entrada Plan gratuito Cómo mide el consumo
GitHub Copilot Pro, alrededor de 10 $/mes 2.000 completados + 50 peticiones de chat al mes Créditos de IA por tokens en planes de pago; los completados siguen gratis, el chat y los agentes consumen créditos
Cursor Pro, alrededor de 20 $/mes Peticiones de agente limitadas, sin tarjeta Fondos mensuales de uso; los modelos propios son generosos, los modelos de terceros van a precio de API, el exceso se factura a posteriori
Devin Desktop (antes Windsurf) Pro, alrededor de 20 $/mes Cuota diaria/semanal ligera Cuota que se recarga a diario y semanal; exceso a precio de API
Claude Code Desde Claude Pro, alrededor de 20 $/mes Sin nivel gratuito de programación Límites compartidos de 5 horas y semanales con Claude chat, o pago por token por API

Algunos detalles que merece la pena recordar:

  • Copilot y Cursor ofrecen planes gratuitos reales. Claude Code requiere un plan de pago de Claude.
  • El exceso en Cursor se factura a posteriori, lo que significa que ves el daño en la factura del mes siguiente, no en el momento de pasarte.
  • Varios proveedores mantienen ahora mismo bonos de crédito promocionales que caducan a lo largo de 2026. Cuando se acaben, los equipos cuyo uso no haya cambiado verán por primera vez su coste base real.

Fija un límite por desarrollador antes de que lo necesites

El movimiento más barato de control de coste es poner un techo mientras las cosas están tranquilas. Tres pasos prácticos:

1. Elige un nivel de modelo por desarrollador, no por proyecto. Los modelos de primer nivel (las opciones más caras) resuelven bien planificación ambigua y refactors grandes. Los modelos de nivel medio suelen bastar para ediciones rutinarias, tests y explicaciones. Decide quién necesita realmente el nivel caro y bloquea al resto en el nivel medio.

2. Activa alertas de gasto. La mayoría de asistentes tienen un panel de uso en los ajustes de cuenta. Configura un aviso por correo o en la app al 50% y al 80% del fondo mensual para reaccionar antes de que entre el exceso.

3. Usa el plan gratuito para trabajo de bajo riesgo. Snippets de documentación, scripts puntuales y experimentos para aprender rara vez necesitan un modelo premium. Una cuenta gratuita de Cursor o Copilot cubre la mayor parte.

Si tu herramienta no expone límites por usuario, un truco veterano es abrir una cuenta por desarrollador y que cada persona active su propia alerta. La carga administrativa es pequeña y el ahorro real.

Cuándo conviene un modelo local

Los LLM locales han cruzado un umbral útil. Para tareas rutinarias, un modelo local bien afinado en tu portátil o en una mini máquina puede sustituir a los créditos de pago sin una caída de calidad perceptible.

Los modelos locales encajan bien cuando el trabajo es:

  • Código repetitivo, ficheros de configuración o refactors mecánicos
  • Andamiaje de tests y generación de tests unitarios
  • Renombrados, formato y limpieza de imports
  • Explicar funciones pequeñas o mensajes de error cortos

Los modelos locales no encajan bien en tareas que necesitan una ventana de contexto muy grande, razonamiento profundo sobre varios ficheros o el modelo más potente disponible. Para eso, sigue mereciendo la pena pagar un modelo frontera.

Una configuración razonable es mantener un asistente de pago para los problemas duros y desviar todo lo demás a un modelo local a través de un cliente open source como Continue, Aider u OpenCode. No pagas nada por petición y tu código nunca sale de tu máquina.

Detecta excesos silenciosos antes de que llegue la factura

La mayoría de los sustos de facturación vienen de uno de tres sitios: un agente que se quedó corriendo toda la noche, un compañero experimentando con un modelo frontera, o un ajuste mal configurado que apunta por defecto al nivel más caro.

Una auditoría mensual corta pilla los tres. Una vez al mes, aparta 30 minutos y pasa esta lista:

  • Abre el panel de uso de cada asistente que use tu equipo. Apunta el cambio mes a mes.
  • Ordena a los usuarios por gasto. Un único usuario intensivo puede dominar la factura.
  • Revisa los modelos por defecto. Confirma que el editor de nadie apunta en silencio a un modelo premium para completados rutinarios.
  • Repasa las sesiones activas. Cancela cualquier agente que siga corriendo desde hace días.
  • Concilia con la factura. Si la cifra del panel y la de la factura se separan más de un 10%, hay que investigar.

Este hábito se amortiza la primera vez que pillas un agente desbocado antes de que genere una factura de cuatro cifras.

Un plan de control de costes sencillo

Si solo vas a hacer cinco cosas, haz estas:

  1. Ajusta el nivel del modelo a la tarea, no al cargo del desarrollador.
  2. Activa alertas de gasto al 50% y al 80% del fondo mensual.
  3. Desvía el trabajo rutinario a modelos locales o planes gratuitos.
  4. Audita el uso una vez al mes comparándolo con la factura.
  5. Cuando caduque un bono promocional, asume un salto de coste y ajústalo antes de que pase.

Preguntas frecuentes

¿Sale más barato pagar por desarrollador o por token? Para usuarios intensivos de agentes, licencia más token suele ser lo más barato porque la licencia incluye un fondo base. Para usuarios ligeros que solo usan completados, un plan fijo por usuario suele bastar.

¿Puedo poner un tope fijo que impida a un desarrollador pasarse? Algunas herramientas exponen topes duros a nivel de organización. Otras solo muestran alertas. Cuando no hay topes duros, lo siguiente mejor es una cuenta por usuario con alertas.

¿Sustituyen de verdad los modelos locales a los asistentes de pago? En trabajo rutinario, a menudo sí. En razonamiento arquitectónico difícil y tareas con contexto grande, los modelos frontera de pago siguen ganando.

¿Cada cuánto conviene revisar los precios? Al menos una vez por trimestre. Esta categoría reescribe sus páginas de precios a menudo.

Fuentes