Cuánto cuesta la IA en la empresa: suscripción, API o equipo propio
Una pyme de cincuenta personas que quiere dotar a sus equipos de un asistente de IA recibe tres propuestas que no se pueden comparar: un precio por empleado y mes, un precio por millón de tokens, un precio de máquina. Este artículo lleva esas tres facturas a la misma unidad, a partir de las tarifas públicas vigentes el 1 de octubre de 2026.
Tres formas de pagar la misma respuesta
El primer modelo es la suscripción por usuario, también llamada licencia por puesto. La empresa paga un importe fijo por cada persona autorizada a usar la herramienta, la utilice diez veces al día o una vez al mes. Es el modelo de las ofertas para equipos de los grandes asistentes conversacionales y de los copilotos integrados en las suites ofimáticas.
El segundo modelo es el pago por uso mediante API. Una API, o interfaz de programación, permite que un programa envíe una solicitud al modelo de un proveedor y reciba la respuesta. El proveedor factura entonces la cantidad de texto procesada, medida en tokens. No hay suscripción por persona: la factura sigue el volumen.
El tercer modelo consiste en poseer la máquina. La empresa compra un ordenador capaz de ejecutar un modelo de lenguaje de pesos abiertos, es decir, un modelo cuyos parámetros se publican y pueden instalarse en casa. El coste pasa a ser una inversión amortizada durante varios años, a la que se suman la electricidad y el mantenimiento. El número de solicitudes ya no cambia la factura; solo cambia la carga de la máquina.
Estos tres modelos no responden a la misma pregunta. La suscripción compra un servicio listo para usar. La API compra capacidad de cálculo en bruto que hay que integrar en las propias herramientas. La máquina compra una capacidad fija, disponible sin límite de volumen, pero acotada por su potencia. Compararlos exige reducir cada oferta a un coste mensual para un uso determinado.
El token, unidad de cuenta de los modelos de lenguaje
Un token es un fragmento de texto, a menudo un trozo de palabra, que el modelo lee y produce uno a uno. La documentación de precios de Anthropic da un orden de magnitud: en inglés, un token equivale a unos cuatro caracteres, aproximadamente tres cuartas partes de una palabra. Precisa que el recuento exacto varía según el idioma y el tipo de contenido. Un texto en francés, una tabla de cifras o código fuente no producen el mismo número de tokens para una longitud idéntica.
Los proveedores distinguen dos categorías. Los tokens de entrada corresponden a todo lo que el modelo recibe: la pregunta, las instrucciones, el historial de la conversación, los documentos adjuntos. Los tokens de salida corresponden a lo que escribe. Estos últimos cuestan bastante más. En las tarifas consultadas el 1 de octubre de 2026, el token de salida vale cinco veces el de entrada tanto en los modelos actuales de Anthropic como en la generación gpt-6 de OpenAI.
El token no es una unidad estable de un proveedor a otro, ni siquiera de una generación de modelos a la siguiente. Anthropic indica que sus modelos a partir de Claude 4.7 utilizan un nuevo segmentador de texto que produce aproximadamente un 30 % más de tokens para un mismo texto. A igual precio publicado, la misma tarea puede costar más tras un cambio de modelo. Comparar precios por millón de tokens entre dos proveedores equivale a comparar precios por kilo sin saber si las dos básculas están calibradas del mismo modo.
Lo que muestran las tarifas al 1 de octubre de 2026
En cuanto a las suscripciones, la página de precios de Claude, consultada el 1 de octubre de 2026, muestra una oferta Team a 25 dólares por puesto y mes con facturación mensual, o 20 dólares con compromiso anual, para el puesto estándar. Un puesto llamado premium cuesta 125 dólares al mes, o 100 dólares al año. La oferta Enterprise combina una base de 20 dólares por puesto y mes, facturada anualmente, y un consumo facturado a las tarifas de la API. Este último punto merece atención: a ese nivel, la suscripción ya no limita el gasto.
Microsoft lanzó el 1 de diciembre de 2025 Microsoft 365 Copilot Business, a 21 dólares por usuario y mes, destinado a organizaciones de hasta 300 usuarios y vendido con compromiso anual. Esta licencia se suma a una suscripción Microsoft 365 Business existente, a la que no sustituye. La oferta para grandes empresas figura a 30 dólares por usuario y mes.
En cuanto a la API, la página de tarifas de OpenAI, consultada en la misma fecha, muestra para su generación más reciente modelos que van desde gpt-6-luna, a 0,10 dólares el millón de tokens de entrada y 0,50 dólares de salida, hasta gpt-6-astra, a 10 y 50 dólares, pasando por gpt-6.1-sol, a 2 y 10 dólares. En Anthropic, Claude Haiku 4.5 cuesta 1 dólar de entrada y 5 de salida, Claude Sonnet 5.5 2 y 10 dólares, Claude Opus 5.5 4 y 20 dólares. Dentro de la sola generación gpt-6, la diferencia de precio alcanza un factor de cien.
Dos mecanismos reducen estos precios. El procesamiento por lotes, que acepta un plazo de respuesta, divide la factura por dos en ambos proveedores. El almacenamiento en caché de las instrucciones repetidas factura las relecturas a una fracción del precio de entrada: el 10 % de la tarifa base en la mayoría de los modelos de Anthropic. Todos estos importes están expresados en dólares, sin impuestos, y los proveedores precisan que pueden modificarlos.
Cómo la factura sigue el uso
Tomemos una hipótesis deliberadamente sencilla. Cincuenta empleados envían cada uno treinta solicitudes por día laborable, durante veintiún días al mes, es decir, 31 500 solicitudes. Cada solicitud transporta 3 000 tokens de entrada, lo que cubre una instrucción, algo de historial y un documento breve, y produce 600 tokens de respuesta. El mes suma 94,5 millones de tokens de entrada y 18,9 millones de tokens de salida.
Con Claude Sonnet 5.5, este volumen cuesta 189 dólares de entrada y 189 dólares de salida, es decir, 378 dólares al mes. Con Claude Opus 5.5, el doble: 756 dólares. Con gpt-6-astra, 1 890 dólares. Con gpt-6-luna, 18,90 dólares. Enfrente, cincuenta puestos de Claude Team con facturación mensual suponen 1 250 dólares, y cincuenta licencias de Copilot Business 1 050 dólares, antes de la licencia de Microsoft 365 que presuponen.
Este cálculo muestra que, para un uso moderado y regular, la API de un modelo intermedio puede costar menos que las suscripciones. No lo dice todo. La API por sí sola no proporciona interfaz, ni gestión de cuentas, ni conexión con los documentos de la empresa: hay que construirlos o comprarlos. Y la hipótesis de 3 000 tokens por solicitud es frágil.
La documentación de Anthropic estima que una página web media representa unos 2 500 tokens y que un artículo de investigación de 500 kilobytes en PDF representa unos 125 000. Si un asistente relee ese documento en cada uno de los diez intercambios de una conversación, consume 1,25 millones de tokens de entrada, es decir, 2,50 dólares en Claude Sonnet 5.5 por un solo análisis. Con el almacenamiento en caché, la misma conversación baja a alrededor de 0,54 dólares, siempre que los intercambios se encadenen antes de que caduque la caché. Los agentes, esos programas que encadenan varias llamadas al modelo para realizar una tarea, multiplican este fenómeno: cada etapa reenvía el contexto acumulado. En una API, la factura depende menos del número de usuarios que de la cantidad de texto que se hace releer al modelo.
Los costes que no aparecen en la tarifa
La primera partida oculta es la integración. Conectar un modelo con la mensajería, las carpetas compartidas, el software de gestión o la base de clientes requiere tiempo de desarrollo, pruebas y mantenimiento continuo. Este coste no figura en ninguna página de precios y depende por completo del sistema de información de cada empresa.
La segunda partida tiene que ver con la ubicación del procesamiento. OpenAI aplica un recargo del 10 % en sus puntos de acceso de procesamiento regional, los que garantizan que los datos permanecen en una zona geográfica, para los modelos publicados a partir del 5 de marzo de 2026. Anthropic aplica un coeficiente de 1,1 cuando el cliente impone un procesamiento únicamente en Estados Unidos. Elegir dónde se tratan los datos tiene un precio explícito.
La tercera partida es la renovación de los modelos. La página de retirada de modelos de OpenAI muestra que GPT-4.5 preview, cuya baja se anunció el 14 de abril de 2025, dejó de funcionar el 14 de julio de 2025, tres meses después. Cada sustitución obliga a comprobar que las instrucciones, los formatos de salida y la calidad de las respuestas siguen siendo válidos. Este trabajo de recalificación se repite con cada generación.
La cuarta partida es la inestabilidad de las tarifas, en ambos sentidos. Anthropic había anunciado para Claude Sonnet 5 un precio de lanzamiento de 2 y 10 dólares válido hasta el 31 de agosto de 2026, seguido de una subida a 3 y 15 dólares el 1 de septiembre. La subida se canceló finalmente y el precio de lanzamiento pasó a ser el precio estándar. El desenlace fue favorable a los clientes, pero la decisión no les correspondía. Un presupuesto construido sobre una tarifa de API sigue dependiendo de una decisión del proveedor.
La quinta partida concierne a la salida. Recuperar los datos, los historiales de conversación y las configuraciones para cambiar de proveedor se ha facturado durante mucho tiempo. El reglamento europeo de datos, aplicable desde el 12 de septiembre de 2025, autoriza hasta el 12 de enero de 2027 unos costes de cambio limitados a los costes reales y después los prohíbe, incluidos los costes de salida de datos. No resuelve la dependencia técnica: unas instrucciones escritas y ajustadas para un modelo concreto no siempre se trasladan sin retoques a otro.
Poseer la máquina: precio de compra, amortización y electricidad
Para razonar sobre un caso real, tomemos el NVIDIA DGX Spark, un ordenador compacto diseñado para ejecutar modelos de lenguaje, con 128 GB de memoria unificada. Es un ejemplo de referencia pública, no una recomendación. Según un revendedor europeo que sigue sus precios, se lanzó en octubre de 2025 a 3 999 dólares, y después NVIDIA subió su precio en 700 dólares en febrero de 2026 alegando la escasez mundial de memoria. En septiembre de 2026, según los precios consultados en un revendedor europeo (pi3g), las versiones vendidas en Europa partían de unos 5 038 euros sin impuestos. El hardware también sufre subidas que el comprador no controla, pero las soporta una sola vez, en la compra.
En Francia, el material informático se amortiza habitualmente en tres años de forma lineal, es decir, un tercio de su valor cada año. Los equipos de menos de 500 euros sin impuestos pueden contabilizarse directamente como gasto. Amortizados en treinta y seis meses, 5 038 euros representan unos 140 euros al mes.
La electricidad se calcula a partir de la potencia. La documentación de NVIDIA indica una fuente de alimentación externa de 240 vatios para esta máquina. Si funcionara de forma permanente a ese máximo, lo que sobrestima la realidad puesto que el consumo baja en reposo, consumiría 2 102 kilovatios hora al año. A la tarifa azul profesional en opción base, fijada en 0,1624 euros el kilovatio hora sin IVA, impuesto especial incluido, desde el 1 de agosto de 2026 tras la deliberación de la Comisión de Regulación de la Energía del 15 de julio de 2026, la factura anual alcanza como máximo unos 341 euros, es decir, 28 euros al mes.
El techo del coste mensual de posesión de esta máquina se sitúa, por tanto, en torno a 168 euros, antes del mantenimiento, las actualizaciones, las copias de seguridad y el tiempo de la persona que se ocupa de ella. En contrapartida, el número de solicitudes no cambia la factura. El límite está en otro lugar: una máquina determinada atiende un número limitado de solicitudes simultáneas, tanto menor cuanto mayor es el modelo, y los modelos de pesos abiertos que puede ejecutar no ofrecen los mismos resultados que los mayores modelos comerciales en todas las tareas. Solo una prueba con las tareas reales de la empresa permite decidir.
Un razonamiento prudente para comparar
La comparación se hace a treinta y seis meses, la duración de amortización del hardware, y distinguiendo las monedas: las API y las suscripciones se facturan en dólares, la electricidad y el hardware comprado en Europa en euros. Convertir a un tipo de cambio del día daría una precisión ilusoria a tres años.
El primer paso consiste en medir. Un piloto de unas semanas en una API, con un grupo pequeño, proporciona el número real de tokens por solicitud, que las consolas de los proveedores muestran. Esta medición vale más que cualquier hipótesis, incluida la de este artículo.
El segundo paso consiste en separar los usos. Los usuarios ocasionales cuestan poco en API y mucho en suscripción. Los usuarios intensivos, o los procesos automáticos que releen grandes volúmenes de documentos, invierten la proporción. Una máquina propia resulta interesante cuando el volumen es alto y regular, o cuando una parte de los datos no debe salir de la empresa, sea cual sea el precio de la alternativa.
El tercer paso consiste en cuantificar la salida desde la entrada. ¿Cuánto costaría un cambio de proveedor, de modelo o de tarifa dentro de dieciocho meses? Con las cifras de nuestro ejemplo, una máquina cuyo coste alcanza como máximo unos 168 euros al mes se compara con una API que costaría 378 dólares con un modelo intermedio o menos de 20 dólares con el modelo más pequeño. El cálculo no designa un ganador universal. Depende del volumen, de la naturaleza de los datos y de la calidad exigida, tres parámetros que solo la empresa conoce.
Lo que la tarifa no dice
Los tres modelos económicos no se excluyen entre sí. Muchas organizaciones combinan una suscripción para los usos ofimáticos, una API para algunos tratamientos puntuales que requieren un modelo muy grande, y una capacidad propia para el volumen regular y los datos que no deben salir de las instalaciones. Lo importante es saber, para cada flujo, cuánto cuesta y quién fija su precio.
Es el criterio que aplicamos en HOMN: un coste fijo conocido de antemano para el procesamiento local, y un recurso a la nube decidido flujo por flujo, con su coste medido. Las cifras de este artículo están fechadas el 1 de octubre de 2026; las páginas de precios citadas como fuente permiten actualizarlas.
¿Qué es un token y cuántas palabras representa?
Un token es un fragmento de texto que el modelo lee o escribe, a menudo un trozo de palabra. Anthropic estima que en inglés un token corresponde a unos cuatro caracteres, es decir, tres cuartas partes de una palabra. El recuento varía según el idioma, el contenido y el segmentador de texto del modelo.
¿Es la API más barata que una suscripción por usuario?
Para un uso moderado, a menudo sí: en nuestra hipótesis de 50 empleados, la API de un modelo intermedio cuesta 378 dólares al mes frente a más de 1 000 dólares en suscripciones. Pero la API no proporciona interfaz ni integración, y su factura crece rápidamente con los documentos largos y los agentes.
¿Cuánta electricidad consume una máquina de IA local?
Depende de su potencia. Una máquina con una fuente de alimentación de 240 vatios consumiría como máximo 2 102 kWh al año en funcionamiento permanente a plena carga, es decir, unos 341 euros a la tarifa azul profesional base vigente desde el 1 de agosto de 2026.
¿En cuántos años se amortiza un servidor de IA?
En Francia, el material informático se amortiza habitualmente en tres años de forma lineal. Los equipos de menos de 500 euros sin impuestos pueden contabilizarse como gasto. Su asesor contable confirmará la duración adecuada para su situación.