Quanto custa a IA numa empresa: subscrição, API ou máquina

Uma PME de cinquenta pessoas que queira dotar as equipas de um assistente de IA recebe três propostas que não se comparam entre si: um preço por colaborador e por mês, um preço por milhão de tokens, um preço de máquina. Este artigo leva as três faturas para a mesma unidade, com base nas tabelas públicas em vigor a 1 de outubro de 2026.

Três formas de pagar a mesma resposta

O primeiro modelo é a subscrição por utilizador, também chamada licença por lugar. A empresa paga um montante fixo por cada pessoa autorizada a usar a ferramenta, quer a use dez vezes por dia ou uma vez por mês. É o modelo das ofertas para equipas dos grandes assistentes conversacionais e dos copilotos integrados nas suites de escritório.

O segundo modelo é o pagamento por utilização através de API. Uma API, ou interface de programação, permite que um software envie um pedido ao modelo de um fornecedor e receba a resposta. O fornecedor fatura então a quantidade de texto processada, medida em tokens. Não há subscrição por pessoa: a fatura acompanha o volume.

O terceiro modelo consiste em possuir a máquina. A empresa compra um computador capaz de executar um modelo de linguagem de pesos abertos, ou seja, um modelo cujos parâmetros são publicados e podem ser instalados nas suas instalações. O custo passa a ser um investimento amortizado ao longo de vários anos, ao qual se somam a eletricidade e a manutenção. O número de pedidos deixa de alterar a fatura; altera apenas a carga da máquina.

Estes três modelos não respondem à mesma pergunta. A subscrição compra um serviço pronto a usar. A API compra capacidade de cálculo em bruto, que é preciso integrar nas próprias ferramentas. A máquina compra uma capacidade fixa, disponível sem limite de volume, mas limitada pela sua potência. Compará-los exige reduzir cada oferta a um custo mensal para uma utilização dada.

O token, unidade de conta dos modelos de linguagem

Um token é um fragmento de texto, muitas vezes um pedaço de palavra, que o modelo lê e produz um a um. A documentação tarifária da Anthropic dá uma ordem de grandeza: em inglês, um token representa cerca de quatro caracteres, ou seja, aproximadamente três quartos de uma palavra. Precisa que a contagem exata varia consoante a língua e o tipo de conteúdo. Um texto em francês, uma tabela de números ou código-fonte não produzem o mesmo número de tokens para um comprimento idêntico.

Os fornecedores distinguem duas categorias. Os tokens de entrada correspondem a tudo o que o modelo recebe: a pergunta, as instruções, o histórico da conversa, os documentos anexados. Os tokens de saída correspondem ao que ele escreve. Os segundos custam bastante mais. Nas tabelas consultadas a 1 de outubro de 2026, o token de saída vale cinco vezes o token de entrada, tanto nos modelos atuais da Anthropic como na geração gpt-6 da OpenAI.

O token não é uma unidade estável entre fornecedores, nem sequer de uma geração de modelos para a seguinte. A Anthropic indica que os seus modelos a partir do Claude 4.7 usam um novo segmentador de texto que produz cerca de 30 % mais tokens para o mesmo texto. A preço afixado igual, a mesma tarefa pode portanto custar mais após uma mudança de modelo. Comparar preços por milhão de tokens entre dois fornecedores equivale a comparar preços ao quilo sem saber se as duas balanças estão calibradas da mesma maneira.

O que mostram as tabelas a 1 de outubro de 2026

Quanto às subscrições, a página de preços do Claude, consultada a 1 de outubro de 2026, apresenta uma oferta Team a 25 dólares por lugar e por mês com faturação mensal, ou 20 dólares com compromisso anual, para o lugar standard. Um lugar dito premium custa 125 dólares por mês, ou 100 dólares por ano. A oferta Enterprise combina uma base de 20 dólares por lugar e por mês, faturada anualmente, e um consumo faturado às tarifas da API. Este último ponto merece atenção: a este nível, a subscrição deixa de limitar a despesa.

A Microsoft lançou a 1 de dezembro de 2025 o Microsoft 365 Copilot Business, a 21 dólares por utilizador e por mês, destinado a organizações com um máximo de 300 utilizadores e vendido com compromisso anual. Esta licença acresce a uma subscrição Microsoft 365 Business existente, que não substitui. A oferta destinada às grandes empresas está indicada a 30 dólares por utilizador e por mês.

Quanto às API, a página de tarifas da OpenAI, consultada na mesma data, apresenta para a sua geração mais recente modelos que vão do gpt-6-luna, a 0,10 dólares por milhão de tokens de entrada e 0,50 dólares de saída, ao gpt-6-astra, a 10 e 50 dólares, passando pelo gpt-6.1-sol, a 2 e 10 dólares. Na Anthropic, o Claude Haiku 4.5 custa 1 dólar de entrada e 5 dólares de saída, o Claude Sonnet 5.5 custa 2 e 10 dólares, o Claude Opus 5.5 custa 4 e 20 dólares. Só dentro da geração gpt-6, a diferença de preço atinge um fator de cem.

Dois mecanismos reduzem estes preços. O processamento em lote, que aceita um prazo de resposta, divide a fatura por dois nos dois fornecedores. A colocação em cache das instruções repetidas fatura as releituras a uma fração do preço de entrada: 10 % da tarifa base na maioria dos modelos da Anthropic. Todos estes montantes estão expressos em dólares, sem impostos, e os fornecedores precisam que os podem alterar.

Como a fatura acompanha a utilização

Tomemos uma hipótese deliberadamente simples. Cinquenta colaboradores enviam cada um trinta pedidos por dia útil, ao longo de vinte e um dias por mês, ou seja, 31 500 pedidos. Cada pedido transporta 3 000 tokens de entrada, o que cobre uma instrução, algum histórico e um documento curto, e produz 600 tokens de resposta. O mês totaliza 94,5 milhões de tokens de entrada e 18,9 milhões de tokens de saída.

Com o Claude Sonnet 5.5, este volume custa 189 dólares de entrada e 189 dólares de saída, ou seja, 378 dólares por mês. Com o Claude Opus 5.5, o dobro: 756 dólares. Com o gpt-6-astra, 1 890 dólares. Com o gpt-6-luna, 18,90 dólares. Em contraponto, cinquenta lugares Claude Team com faturação mensal representam 1 250 dólares, e cinquenta licenças Copilot Business 1 050 dólares, antes da licença Microsoft 365 que pressupõem.

Este cálculo mostra que, para uma utilização moderada e regular, a API de um modelo intermédio pode custar menos do que as subscrições. Não diz tudo. A API sozinha não fornece interface, nem gestão de contas, nem ligação aos documentos da empresa: é preciso construí-las ou comprá-las. E a hipótese de 3 000 tokens por pedido é frágil.

A documentação da Anthropic estima que uma página web média representa cerca de 2 500 tokens e que um artigo de investigação de 500 quilobytes em PDF representa cerca de 125 000. Se um assistente reler este documento em cada uma das dez trocas de uma conversa, consome 1,25 milhões de tokens de entrada, ou seja, 2,50 dólares no Claude Sonnet 5.5 por uma única análise. Com a colocação em cache, a mesma conversa desce para cerca de 0,54 dólares, desde que as trocas se sucedam antes de a cache expirar. Os agentes, programas que encadeiam várias chamadas ao modelo para cumprir uma tarefa, multiplicam este fenómeno: cada etapa reenvia o contexto acumulado. Numa API, a fatura depende menos do número de utilizadores do que da quantidade de texto que se faz o modelo reler.

Os custos que não aparecem na tabela

A primeira rubrica oculta é a integração. Ligar um modelo às mensagerias, às pastas partilhadas, ao software de gestão ou à base de clientes exige tempo de desenvolvimento, testes e manutenção contínua. Este custo não consta de nenhuma página de preços e depende inteiramente do sistema de informação de cada empresa.

A segunda rubrica prende-se com a localização do processamento. A OpenAI cobra uma majoração de 10 % nos seus pontos de acesso de processamento regional, os que garantem que os dados permanecem numa zona geográfica, para os modelos publicados a partir de 5 de março de 2026. A Anthropic aplica um coeficiente de 1,1 quando o cliente impõe um processamento apenas nos Estados Unidos. Escolher onde os dados são processados tem um preço explícito.

A terceira rubrica é a renovação dos modelos. A página de retirada de modelos da OpenAI mostra que o GPT-4.5 preview, cuja descontinuação foi anunciada a 14 de abril de 2025, deixou de funcionar a 14 de julho de 2025, três meses depois. Cada substituição obriga a verificar se as instruções, os formatos de saída e a qualidade das respostas se mantêm. Este trabalho de requalificação repete-se a cada geração.

A quarta rubrica é a instabilidade tarifária, num sentido e noutro. A Anthropic tinha anunciado para o Claude Sonnet 5 um preço de lançamento de 2 e 10 dólares válido até 31 de agosto de 2026, seguido de um aumento para 3 e 15 dólares a 1 de setembro. O aumento acabou por ser cancelado e o preço de lançamento tornou-se o preço standard. O desfecho foi favorável aos clientes, mas a decisão não lhes pertenceu. Um orçamento construído sobre uma tabela de API fica dependente de uma decisão do fornecedor.

A quinta rubrica diz respeito à saída. Recuperar os seus dados, os históricos de conversa e as configurações para mudar de prestador foi durante muito tempo cobrado. O regulamento europeu sobre os dados, aplicável desde 12 de setembro de 2025, autoriza até 12 de janeiro de 2027 encargos de mudança limitados aos custos reais, e depois proíbe-os, incluindo os encargos de saída de dados. Não resolve a dependência técnica: instruções escritas e afinadas para um modelo preciso nem sempre se transpõem sem ajustes para outro.

Possuir a máquina: preço de compra, amortização e eletricidade

Para raciocinar sobre um caso real, tomemos o NVIDIA DGX Spark, um computador compacto concebido para executar modelos de linguagem, com 128 GB de memória unificada. É um exemplo de referência pública, não uma recomendação. Segundo um revendedor europeu que acompanha os seus preços, foi lançado em outubro de 2025 a 3 999 dólares, e depois a NVIDIA aumentou o preço em 700 dólares em fevereiro de 2026, invocando a escassez mundial de memória. Em setembro de 2026, segundo os preços consultados num revendedor europeu (pi3g), as versões vendidas na Europa começavam em cerca de 5 038 euros sem IVA. O hardware também conhece aumentos que o comprador não controla, mas sofre-os uma só vez, na compra.

Em França, o material informático amortiza-se habitualmente em três anos pelo método linear, ou seja, um terço do seu valor por ano. Os equipamentos de valor inferior a 500 euros sem IVA podem ser lançados diretamente em gastos. Amortizados em trinta e seis meses, 5 038 euros representam cerca de 140 euros por mês.

A eletricidade calcula-se a partir da potência. A documentação da NVIDIA indica uma fonte de alimentação externa de 240 watts para esta máquina. Se funcionasse permanentemente a este máximo, o que sobrestima a realidade dado que o consumo diminui em repouso, consumiria 2 102 quilowatts-hora por ano. Na tarifa azul profissional em opção base, fixada em 0,1624 euros o quilowatt-hora sem IVA, com imposto especial incluído, desde 1 de agosto de 2026 na sequência da deliberação da Comissão de Regulação da Energia de 15 de julho de 2026, a fatura anual atinge no máximo cerca de 341 euros, ou seja, 28 euros por mês.

O teto do custo mensal de posse desta máquina situa-se, portanto, em torno de 168 euros, antes da manutenção, das atualizações, das cópias de segurança e do tempo da pessoa que dela se ocupa. Em contrapartida, o número de pedidos não altera a fatura. O limite está noutro lado: uma máquina dada serve um número limitado de pedidos simultâneos, tanto menor quanto maior for o modelo, e os modelos de pesos abertos que consegue executar não dão os mesmos resultados que os maiores modelos comerciais em todas as tarefas. Só um ensaio com as tarefas reais da empresa permite decidir.

Um raciocínio prudente para comparar

A comparação faz-se ao longo de trinta e seis meses, a duração de amortização do hardware, e distinguindo as moedas: as API e as subscrições são faturadas em dólares, a eletricidade e o hardware comprado na Europa em euros. Converter a uma taxa do dia daria uma precisão ilusória ao longo de três anos.

O primeiro passo consiste em medir. Um piloto de algumas semanas numa API, com um pequeno grupo, fornece o número real de tokens por pedido, que as consolas dos fornecedores mostram. Esta medição vale mais do que qualquer hipótese, incluindo a deste artigo.

O segundo passo consiste em separar as utilizações. Os utilizadores ocasionais custam pouco em API e caro em subscrição. Os utilizadores intensivos, ou os processamentos automáticos que releem grandes volumes de documentos, invertem a proporção. Uma máquina própria torna-se interessante quando o volume é elevado e regular, ou quando parte dos dados não deve sair da empresa, seja qual for o preço da alternativa.

O terceiro passo consiste em quantificar a saída desde a entrada. Quanto custaria uma mudança de fornecedor, de modelo ou de tabela tarifária dentro de dezoito meses? Com os números do nosso exemplo, uma máquina cujo custo atinge no máximo cerca de 168 euros por mês compara-se com uma API que custaria 378 dólares com um modelo intermédio ou menos de 20 dólares com o mais pequeno. O cálculo não designa um vencedor universal. Depende do volume, da natureza dos dados e da qualidade exigida, três parâmetros que só a empresa conhece.

O que a tabela não diz

Os três modelos económicos não se excluem. Muitas organizações combinam uma subscrição para as utilizações de escritório, uma API para alguns processamentos pontuais que exigem um modelo muito grande, e uma capacidade própria para o volume regular e para os dados que não devem sair das instalações. O importante é saber, para cada fluxo, quanto custa e quem fixa o seu preço.

É a grelha que aplicamos na HOMN: um custo fixo conhecido de antemão para o processamento local, e um recurso à nuvem decidido fluxo a fluxo, com o seu custo medido. Os números deste artigo estão datados de 1 de outubro de 2026; as páginas de preços citadas como fonte permitem atualizá-los.

O que é um token e quantas palavras representa?

Um token é um fragmento de texto que o modelo lê ou escreve, muitas vezes um pedaço de palavra. A Anthropic estima que, em inglês, um token corresponde a cerca de quatro caracteres, ou seja, três quartos de uma palavra. A contagem varia consoante a língua, o conteúdo e o segmentador de texto do modelo.

A API é mais barata do que uma subscrição por utilizador?

Para uma utilização moderada, muitas vezes sim: na nossa hipótese de 50 colaboradores, a API de um modelo intermédio custa 378 dólares por mês contra mais de 1 000 dólares em subscrições. Mas a API não fornece interface nem integração, e a sua fatura sobe depressa com documentos longos e agentes.

Quanta eletricidade consome uma máquina de IA local?

Depende da sua potência. Uma máquina com fonte de alimentação de 240 watts consumiria no máximo 2 102 kWh por ano em funcionamento permanente a plena carga, ou seja, cerca de 341 euros na tarifa azul profissional base em vigor desde 1 de agosto de 2026.

Em quantos anos amortizar um servidor de IA?

Em França, o material informático amortiza-se habitualmente em três anos pelo método linear. Os equipamentos de valor inferior a 500 euros sem IVA podem ser lançados em gastos. O seu contabilista certificado confirmará a duração adequada à sua situação.