Quanto costa l'IA in azienda: abbonamento, API o macchina propria

Una PMI di cinquanta persone che vuole dotare i propri team di un assistente di IA riceve tre proposte che non si confrontano: un prezzo per dipendente al mese, un prezzo per milione di token, un prezzo di macchina. Questo articolo riporta le tre fatture alla stessa unità, a partire dai listini pubblici in vigore al 1° ottobre 2026.

Tre modi di pagare la stessa risposta

Il primo modello è l'abbonamento per utente, detto anche licenza per postazione. L'azienda paga un importo fisso per ogni persona autorizzata a usare lo strumento, che lo utilizzi dieci volte al giorno o una volta al mese. È il modello delle offerte team dei grandi assistenti conversazionali e dei copiloti integrati nelle suite di produttività.

Il secondo modello è il pagamento a consumo tramite API. Un'API, o interfaccia di programmazione, permette a un software di inviare una richiesta al modello di un fornitore e di ricevere la risposta. Il fornitore fattura la quantità di testo elaborata, misurata in token. Non c'è abbonamento per persona: la fattura segue il volume.

Il terzo modello consiste nel possedere la macchina. L'azienda acquista un computer in grado di eseguire un modello linguistico a pesi aperti, cioè un modello i cui parametri sono pubblicati e possono essere installati in sede. Il costo diventa un investimento ammortizzato su più anni, a cui si aggiungono elettricità e manutenzione. Il numero di richieste non cambia più la fattura; cambia soltanto il carico della macchina.

Questi tre modelli non rispondono alla stessa domanda. L'abbonamento acquista un servizio pronto all'uso. L'API acquista capacità di calcolo grezza da integrare nei propri strumenti. La macchina acquista una capacità fissa, disponibile senza limiti di volume, ma vincolata alla sua potenza. Per confrontarli occorre ricondurre ogni offerta a un costo mensile per un uso determinato.

Il token, unità di conto dei modelli linguistici

Un token è un frammento di testo, spesso una parte di parola, che il modello legge e produce uno alla volta. La documentazione tariffaria di Anthropic fornisce un ordine di grandezza: in inglese un token corrisponde a circa quattro caratteri, cioè a circa tre quarti di parola. Precisa che il conteggio esatto varia in base alla lingua e al tipo di contenuto. Un testo in francese, una tabella di numeri o del codice sorgente non producono lo stesso numero di token a parità di lunghezza.

I fornitori distinguono due categorie. I token di input corrispondono a tutto ciò che il modello riceve: la domanda, le istruzioni, la cronologia della conversazione, i documenti allegati. I token di output corrispondono a ciò che scrive. I secondi costano nettamente di più. Sui listini rilevati il 1° ottobre 2026, il token di output vale cinque volte il token di input, sia per gli attuali modelli di Anthropic sia per la generazione gpt-6 di OpenAI.

Il token non è un'unità stabile da un fornitore all'altro, e nemmeno da una generazione di modelli alla successiva. Anthropic indica che i suoi modelli a partire da Claude 4.7 usano un nuovo tokenizzatore che produce circa il 30% di token in più per lo stesso testo. A parità di prezzo esposto, lo stesso compito può quindi costare di più dopo un cambio di modello. Confrontare i prezzi al milione di token tra due fornitori equivale a confrontare prezzi al chilo senza sapere se le due bilance sono tarate allo stesso modo.

Cosa mostrano i listini al 1° ottobre 2026

Sul fronte degli abbonamenti, la pagina dei prezzi di Claude, consultata il 1° ottobre 2026, mostra un'offerta Team a 25 dollari per postazione al mese con fatturazione mensile, o 20 dollari con impegno annuale, per la postazione standard. Una postazione cosiddetta premium costa 125 dollari al mese, o 100 dollari all'anno. L'offerta Enterprise combina una base di 20 dollari per postazione al mese, fatturata annualmente, e un consumo fatturato alle tariffe dell'API. Quest'ultimo punto merita attenzione: a questo livello l'abbonamento non limita più la spesa.

Microsoft ha lanciato il 1° dicembre 2025 Microsoft 365 Copilot Business, a 21 dollari per utente al mese, destinato alle organizzazioni fino a 300 utenti e venduto con impegno annuale. Questa licenza si aggiunge a un abbonamento Microsoft 365 Business esistente, che non sostituisce. L'offerta per le grandi aziende è indicata a 30 dollari per utente al mese.

Sul fronte API, la pagina delle tariffe di OpenAI, consultata alla stessa data, riporta per la sua generazione più recente modelli che vanno da gpt-6-luna, a 0,10 dollari per milione di token di input e 0,50 dollari in output, fino a gpt-6-astra, a 10 e 50 dollari, passando per gpt-6.1-sol, a 2 e 10 dollari. Presso Anthropic, Claude Haiku 4.5 costa 1 dollaro in input e 5 in output, Claude Sonnet 5.5 2 e 10 dollari, Claude Opus 5.5 4 e 20 dollari. All'interno della sola generazione gpt-6, il divario di prezzo raggiunge un fattore cento.

Due meccanismi riducono questi prezzi. L'elaborazione in batch, che accetta un tempo di risposta più lungo, dimezza la fattura presso entrambi i fornitori. La memorizzazione in cache delle istruzioni ripetute fattura le riletture a una frazione del prezzo di input: il 10% della tariffa base per la maggior parte dei modelli Anthropic. Tutti questi importi sono espressi in dollari, al netto delle imposte, e i fornitori precisano di poterli modificare.

Come la fattura segue l'uso

Prendiamo un'ipotesi volutamente semplice. Cinquanta dipendenti inviano ciascuno trenta richieste per giorno lavorativo, su ventuno giorni al mese, cioè 31.500 richieste. Ogni richiesta trasporta 3.000 token di input, che coprono un'istruzione, un po' di cronologia e un breve documento, e produce 600 token di risposta. Il mese totalizza 94,5 milioni di token di input e 18,9 milioni di token di output.

Con Claude Sonnet 5.5, questo volume costa 189 dollari in input e 189 dollari in output, cioè 378 dollari al mese. Con Claude Opus 5.5, il doppio: 756 dollari. Con gpt-6-astra, 1.890 dollari. Con gpt-6-luna, 18,90 dollari. Di fronte a questi valori, cinquanta postazioni Claude Team con fatturazione mensile rappresentano 1.250 dollari, e cinquanta licenze Copilot Business 1.050 dollari, prima della licenza Microsoft 365 che presuppongono.

Questo calcolo mostra che, per un uso moderato e regolare, l'API di un modello intermedio può costare meno degli abbonamenti. Non dice tutto. La sola API non fornisce né interfaccia, né gestione degli account, né collegamento ai documenti aziendali: vanno costruiti o acquistati. E l'ipotesi di 3.000 token per richiesta è fragile.

La documentazione di Anthropic stima che una pagina web media corrisponda a circa 2.500 token e che un articolo di ricerca di 500 kilobyte in PDF ne corrisponda a circa 125.000. Se un assistente rilegge questo documento a ciascuno dei dieci scambi di una conversazione, consuma 1,25 milioni di token di input, cioè 2,50 dollari su Claude Sonnet 5.5 per una sola analisi. Con la cache, la stessa conversazione scende intorno a 0,54 dollari, a condizione che gli scambi si susseguano prima della scadenza della cache. Gli agenti, cioè i programmi che concatenano più chiamate al modello per portare a termine un compito, moltiplicano questo fenomeno: ogni passaggio rinvia il contesto accumulato. Su un'API, la fattura dipende meno dal numero di utenti che dalla quantità di testo che si fa rileggere al modello.

I costi che non compaiono nel listino

La prima voce nascosta è l'integrazione. Collegare un modello alla posta, alle cartelle condivise, al gestionale o al database clienti richiede tempo di sviluppo, test e manutenzione continua. Questo costo non figura in nessuna pagina di prezzi e dipende interamente dal sistema informativo di ciascuna azienda.

La seconda voce riguarda la localizzazione dell'elaborazione. OpenAI applica una maggiorazione del 10% sui propri endpoint a elaborazione regionale, quelli che garantiscono che i dati restino in un'area geografica, per i modelli pubblicati a partire dal 5 marzo 2026. Anthropic applica un coefficiente di 1,1 quando il cliente impone un'elaborazione solo negli Stati Uniti. Scegliere dove i propri dati vengono elaborati ha un prezzo esplicito.

La terza voce è il rinnovo dei modelli. La pagina dei ritiri dei modelli di OpenAI mostra che GPT-4.5 preview, la cui dismissione era stata annunciata il 14 aprile 2025, ha cessato di funzionare il 14 luglio 2025, tre mesi dopo. Ogni sostituzione impone di verificare che le istruzioni, i formati di output e la qualità delle risposte reggano ancora. Questo lavoro di riqualificazione si ripresenta a ogni generazione.

La quarta voce è l'instabilità tariffaria, in un senso come nell'altro. Anthropic aveva annunciato per Claude Sonnet 5 un prezzo di lancio di 2 e 10 dollari valido fino al 31 agosto 2026, seguito da un aumento a 3 e 15 dollari il 1° settembre. L'aumento è stato infine annullato e il prezzo di lancio è diventato il prezzo standard. L'esito è stato favorevole ai clienti, ma la decisione non spettava a loro. Un budget costruito sul listino di un'API resta appeso a una decisione del fornitore.

La quinta voce riguarda l'uscita. Recuperare i propri dati, le cronologie delle conversazioni e le configurazioni per cambiare fornitore è stato a lungo a pagamento. Il regolamento europeo sui dati, applicabile dal 12 settembre 2025, consente fino al 12 gennaio 2027 costi di cambio limitati ai costi effettivi, per poi vietarli, comprese le spese di uscita dei dati. Non risolve la dipendenza tecnica: istruzioni scritte e messe a punto per un modello preciso non si trasferiscono sempre senza ritocchi su un altro.

Possedere la macchina: prezzo d'acquisto, ammortamento ed elettricità

Per ragionare su un caso reale, prendiamo il NVIDIA DGX Spark, un computer compatto progettato per eseguire modelli linguistici, con 128 GB di memoria unificata. È un esempio di riferimento pubblico, non una raccomandazione. Secondo un rivenditore europeo che ne monitora i prezzi, è stato lanciato a ottobre 2025 a 3.999 dollari, poi NVIDIA ne ha aumentato il prezzo di 700 dollari a febbraio 2026 adducendo la carenza mondiale di memoria. A settembre 2026, secondo i prezzi rilevati presso un rivenditore europeo (pi3g), le versioni vendute in Europa partivano da circa 5.038 euro IVA esclusa. Anche l'hardware conosce aumenti che l'acquirente non controlla, ma li subisce una volta sola, all'acquisto.

In Francia l'hardware informatico si ammortizza comunemente su tre anni a quote costanti, cioè un terzo del suo valore ogni anno. Le attrezzature di valore inferiore a 500 euro IVA esclusa possono essere imputate direttamente a costo. Ammortizzati su trentasei mesi, 5.038 euro corrispondono a circa 140 euro al mese.

L'elettricità si calcola a partire dalla potenza. La documentazione di NVIDIA indica un alimentatore esterno da 240 watt per questa macchina. Se funzionasse in permanenza a questo massimo, il che sovrastima la realtà poiché il consumo scende a riposo, consumerebbe 2.102 kilowattora all'anno. Alla tariffa blu professionale opzione base, fissata a 0,1624 euro al kilowattora IVA esclusa, accisa inclusa, dal 1° agosto 2026 a seguito della deliberazione della Commission de régulation de l'énergie del 15 luglio 2026, la fattura annua si attesta al massimo intorno a 341 euro, cioè 28 euro al mese.

Il tetto del costo mensile di possesso di questa macchina si colloca dunque intorno a 168 euro, prima di manutenzione, aggiornamenti, backup e del tempo della persona che se ne occupa. In cambio, il numero di richieste non cambia la fattura. Il limite sta altrove: una determinata macchina serve un numero limitato di richieste simultanee, tanto più basso quanto più il modello è grande, e i modelli a pesi aperti che può eseguire non offrono gli stessi risultati dei maggiori modelli commerciali su tutti i compiti. Solo una prova sui compiti reali dell'azienda permette di decidere.

Un ragionamento prudente per confrontare

Il confronto si fa su trentasei mesi, la durata di ammortamento dell'hardware, distinguendo le valute: le API e gli abbonamenti sono fatturati in dollari, l'elettricità e l'hardware acquistato in Europa in euro. Convertire a un cambio del giorno darebbe una precisione illusoria su tre anni.

Il primo passo consiste nel misurare. Un pilota di qualche settimana su un'API, con un piccolo gruppo, fornisce il numero reale di token per richiesta, che le console dei fornitori mostrano. Questa misura vale più di qualsiasi ipotesi, compresa quella di questo articolo.

Il secondo passo consiste nel separare gli usi. Gli utenti occasionali costano poco in API e molto in abbonamento. Gli utenti intensivi, o le elaborazioni automatiche che rileggono grandi volumi di documenti, ribaltano la proporzione. Una macchina di proprietà diventa interessante quando il volume è elevato e regolare, o quando una parte dei dati non deve uscire dall'azienda, qualunque sia il prezzo dell'alternativa.

Il terzo passo consiste nel quantificare l'uscita fin dall'ingresso. Quanto costerebbe un cambio di fornitore, di modello o di listino tra diciotto mesi? Con le cifre del nostro esempio, una macchina il cui costo si attesta al massimo intorno a 168 euro al mese si confronta con un'API che costerebbe 378 dollari con un modello intermedio o meno di 20 dollari con il modello più piccolo. Il calcolo non indica un vincitore universale. Dipende dal volume, dalla natura dei dati e dalla qualità richiesta, tre parametri che solo l'azienda conosce.

Ciò che il listino non dice

I tre modelli economici non si escludono a vicenda. Molte organizzazioni combinano un abbonamento per gli usi d'ufficio, un'API per alcune elaborazioni occasionali che richiedono un modello molto grande, e una capacità di proprietà per il volume regolare e per i dati che non devono lasciare i locali. L'importante è sapere, per ogni flusso, quanto costa e chi ne fissa il prezzo.

È il criterio che applichiamo in HOMN: un costo fisso noto in anticipo per l'elaborazione locale, e il ricorso al cloud deciso flusso per flusso, con il suo costo misurato. Le cifre di questo articolo sono datate 1° ottobre 2026; le pagine di prezzi citate tra le fonti permettono di aggiornarle.

Che cos'è un token e a quante parole corrisponde?

Un token è un frammento di testo che il modello legge o scrive, spesso una parte di parola. Anthropic stima che in inglese un token corrisponda a circa quattro caratteri, cioè tre quarti di parola. Il conteggio varia in base alla lingua, al contenuto e al tokenizzatore del modello.

L'API costa meno di un abbonamento per utente?

Per un uso moderato, spesso sì: nella nostra ipotesi di 50 dipendenti, l'API di un modello intermedio costa 378 dollari al mese contro oltre 1.000 dollari di abbonamenti. Ma l'API non fornisce né interfaccia né integrazione, e la sua fattura cresce rapidamente con i documenti lunghi e gli agenti.

Quanta elettricità consuma una macchina di IA locale?

Dipende dalla sua potenza. Una macchina con un alimentatore da 240 watt consumerebbe al massimo 2.102 kWh all'anno in funzionamento permanente a pieno carico, cioè circa 341 euro alla tariffa blu professionale base in vigore dal 1° agosto 2026.

In quanti anni ammortizzare un server di IA?

In Francia l'hardware informatico si ammortizza comunemente su tre anni a quote costanti. Le attrezzature di valore inferiore a 500 euro IVA esclusa possono essere imputate a costo. Il Suo commercialista confermerà la durata adatta alla Sua situazione.