← News
By Leila Haddad
— Solutions Architect, Enterprise
·
· INSIGHT
Lo shift di Anthropic al pricing usage-based: cosa rinegoziare in azienda
Anthropic ha ristrutturato Claude Enterprise a una bassa fee base per posto più utilizzo uncapped alle tariffe API. I clienti sopra i 150 posti transitano al rinnovo. Il procurement dovrebbe ricostruire i modelli di spesa attorno a token, caching e sconti batch prima di firmare.
Cosa è cambiato nel pricing enterprise 2026 di Anthropic
Nell'aprile 2026, Anthropic ha confermato ciò che The Information aveva riportato per prima: Claude Enterprise è passato dal pricing flat per posto con token in bundle a un modello che combina una bassa fee base per posto con l'utilizzo fatturato alle tariffe API standard. Secondo la struttura pubblicata da Anthropic, il nuovo posto Enterprise si attesta attorno a $20 per utente al mese, e "non puoi disabilitare il billing per l'utilizzo". I vecchi tier premium e standard (precedentemente attorno a $200 e $40 per utente al mese con allocazioni di token in bundle) transitano al nuovo modello al rinnovo.
Il cambiamento inizialmente prende di mira deployment con 150 o più posti. I clienti più piccoli rimangono sul pricing legacy per ora, ma la direzione di marcia è chiara. Anthropic cita un compute crunch guidato dall'adozione di Claude Code e dai carichi agentici. Le testate del settore da PYMNTS, The Register e ITBrief inquadrano questo come la fine dell'era della flat-fee per i contratti enterprise dei modelli di frontiera. Per i team di procurement, l'effetto pratico è che la voce passa da abbonamento prevedibile a consumo variabile, con la fee del posto che diventa una piccola frazione del costo totale.
Per posto vs per token: come funziona la nuova matematica
Sotto il legacy Premium plan, un deployment da 200 posti a $200 per utente produceva un commitment annuale prevedibile di $480.000 con quote di token in bundle. Sotto il nuovo modello, gli stessi 200 posti producono solo $48.000 di fee base; il resto è qualunque cosa quegli utenti consumino effettivamente alle tariffe API di listino: Sonnet 4.6 a circa $3 input e $15 output per milione di token, Opus 4.7 materialmente più alto.
Gli analisti di licensing citati da implicator.ai e The Register stimano che gli utenti pesanti vedranno la spesa totale raddoppiare o triplicare. Un singolo ingegnere Claude Code che esegue loop agentici può bruciare diversi milioni di token al giorno; moltiplica su un team di piattaforma e la voce variabile eclissa la base. La matematica ora dipende da tre numeri che il procurement raramente tracciava prima: token medi per utente attivo al giorno, rapporto output-su-input (l'output è 5x più costoso) e mix di modelli tra Haiku, Sonnet e Opus. I team finance che prima prevedevano la spesa AI come una voce SaaS per posto devono ricostruire attorno alla telemetria di consumo, non al numero di teste.
Sconti cache e Message Batches: le leve di costo che valgono
Due sconti nativi di Anthropic passano da "nice to have" a load-bearing sotto la nuova forma di contratto. La Message Batches API processa richieste asincrone entro 24 ore esattamente al 50% dei prezzi standard dei token, applicato sia all'input sia all'output su tutti i modelli Claude. Qualsiasi cosa che possa tollerare un giorno di latenza — classificazione notturna di documenti, run di valutazione, sintesi bulk, refresh degli embedding — dovrebbe essere instradata attraverso di esso.
Il prompt caching è la seconda leva. I moltiplicatori pubblicati da Anthropic mettono le scritture di cache a 5 minuti a 1,25x il prezzo base di input, le scritture a 1 ora a 2x, e crucialmente, le letture di cache a 0,1x — uno sconto del 90% sui token di input cached. I due sconti si sommano. Un system prompt lungo o un contesto di documento che viene colpito ripetutamente via Batches può atterrare a circa il 5% del listino di richiamo per la porzione cached. Per pipeline RAG e workflow agent long-context, strutturare deliberatamente i prompt così che il prefisso stabile sia cacheable è ora una decisione visibile al procurement, non solo un'ottimizzazione engineering.
Modellare la spesa annuale sotto i nuovi tier
Un modello di spesa 2026 difendibile ha bisogno di tre input per coorte utenti: giorni attivi al mese, token consumati per giorno attivo e la quota di quel traffico eleggibile per sconti cache o batch. Una baseline utile: un tipico sviluppatore Claude-in-IDE riportato consuma 1-3 milioni di token per giorno attivo; un analista di ricerca che esegue flussi in stile Deep Research è più vicino a 200-500k; un agent di customer support su Haiku può stare sotto i 100k.
Costruisci tre scenari — base, stretch e adversarial — e fai pressione su ciascuno contro la nuova formula posto più utilizzo. Il caso adversarial dovrebbe assumere zero adozione del caching, zero routing batch, selezione Opus di default e 30% di crescita dei token mese-su-mese (coerente con le curve di domanda riportate). Quel tetto è il numero da portare nella conversazione di rinnovo. La Compliance API di Anthropic e l'accesso agli audit log, inclusi nel posto Enterprise, sono ciò di cui hai bisogno per strumentare questo mensilmente; cuoci il requisito di conservare almeno 13 mesi di dati d'uso a livello di token nel contratto prima di firmare.
Il counter-positioning di OpenAI e gli incentivi alla migrazione
OpenAI ha finora mantenuto una postura per posto per ChatGPT Enterprise — le tariffe pubblicate si attestano grosso modo nella fascia $45-$75 per utente al mese, con un minimo di 150 posti e prepagamento annuale. Dal 2 aprile 2026, OpenAI ha introdotto il pricing flessibile con posti standard e posti solo-Codex, più pool di crediti che sbloccano accesso aggiuntivo a Deep Research, modelli Thinking, generazione di immagini e Codex sopra i cap per posto. La struttura sembra ancora SaaS-shaped al tier d'ingresso, anche se il meccanismo del pool di crediti importa silenziosamente dinamiche usage-based per feature avanzate.
Questo crea un arbitraggio di breve termine. I team di procurement che gestiscono cicli di rinnovo in Q3 e Q4 2026 vedranno motion di sales OpenAI che presentano esplicitamente la prevedibilità contro il modello variabile di Anthropic. Tratta quelle quote con disciplina: conferma esattamente quali feature ricadono dentro l'envelope per posto, quali richiedono draw-down di crediti e come appare la tariffa di overage una volta che il pool si esaurisce. L'esito realistico non è la migrazione single-vendor ma una postura dual-sourced con cap duri su entrambi i lati.
Hedge: stratificare gateway BYOK su un contratto single-vendor
L'hedge strutturale più chiaro contro lo shift di pricing di qualsiasi singolo vendor è disaccoppiare il contratto del modello dall'applicazione. Un layer gateway che tiene le tue chiavi API e instrada le richieste tra provider trasforma la scelta del modello in una decisione runtime piuttosto che in un impegno di procurement. Quando Anthropic alza le tariffe, scade un tier di sconto o deprecata uno SKU di modello a metà contratto, ri-instradi il traffico classe Sonnet a un competitor paragonabile senza toccare il codice dell'applicazione.
I requisiti operativi sono poco glamour ma specifici: selezione del provider per richiesta, consapevolezza del prompt-cache così non perdi lo sconto del 90% quando ri-instradi, attribuzione dell'uso a livello di token per Workspace o cost center, e billing pure pass-through così il gateway stesso non aggiunge un layer di margine sopra i prezzi di listino del vendor. Le piattaforme in questa categoria — osFoundry è un esempio costruito attorno al pass-through BYOK senza fee per posto — stanno davanti ad Anthropic, OpenAI e provider open-weights simultaneamente. Il punto non è l'abbandono del vendor; è preservare l'opzione di rinegoziare da una posizione in cui il costo di switching si misura in ore, non trimestri.
Azioni per il tuo prossimo rinnovo
Porta quattro artefatti al tavolo prima di firmare il rinnovo 2026. Primo, una baseline di consumo di token a 13 mesi suddivisa per coorte utenti, modello e cache hit rate — la Compliance API di Anthropic ti dà i dati grezzi; strumentala ora anche se il rinnovo è a mesi di distanza. Secondo, un impegno scritto da Anthropic sulle finestre di notifica di cambio prezzo: la transizione legacy posto-a-uso ha sorpreso i clienti nel 2026, e il tuo contratto dovrebbe richiedere 90 giorni di notifica per qualsiasi modifica di tariffa o tier.
Terzo, negozia esplicitamente la sopravvivenza degli sconti Batch e cache — ottieni linguaggio che confermi che lo sconto Batch del 50% e il moltiplicatore di lettura cache sono termini contrattuali, non termini di servizio unilateralmente revocabili. Quarto, assicura una clausola di gateway che permetta layer di routing di terze parti e postura BYOK; alcuni accordi enterprise restringono silenziosamente la rivendita o il proxying, e vuoi quell'ambiguità risolta per iscritto. Se Anthropic resiste a una qualsiasi di queste, quello stesso è un utile data point su quanta flessibilità di pricing si aspettano di esercitare sul tuo contratto.
Frequently asked questions
- Il nuovo pricing Enterprise di Anthropic colpisce ogni cliente?
- Non immediatamente. Anthropic ha confermato che la nuova struttura prende di mira deployment con 150 o più posti, con i tier premium e standard esistenti che transitano al modello combinato fee-base-più-uso al rinnovo del contratto. I deployment più piccoli rimangono sul pricing legacy per ora, anche se la maggior parte degli analisti del settore si aspetta che il modello si estenda verso il basso nel tempo. L'implicazione pratica: se il tuo rinnovo è nei prossimi due-quattro trimestri e sei sopra la soglia dei posti, costruisci ora una previsione di spesa usage-based piuttosto che dopo che il team sales ti manda una quote.
- Lo sconto Batch del 50% e quello cache-read del 90% sono davvero permanenti?
- Anthropic pubblica entrambi nella documentazione API corrente: la Message Batches API addebita il 50% delle tariffe standard dei token per richieste asincrone restituite entro 24 ore, e il prompt caching usa un moltiplicatore 0,1x sulle letture di input cached, equivalente a uno sconto del 90%. Gli sconti si sommano. Sono feature documentate, non pricing promozionale, ma sono ancora impegni a livello di termini di servizio che Anthropic può rivedere. I team di procurement che negoziano contratti enterprise pluriennali dovrebbero richiedere linguaggio contrattuale esplicito che preservi entrambi i meccanismi per il termine del contratto.
- Come prevedo il consumo di token per utente senza dati storici?
- Inizia con una finestra di strumentazione di due-quattro settimane usando la Compliance API di Anthropic o i log del tuo gateway, segmentati per ruolo. Benchmark grezzi utili dalle testate di settore: gli sviluppatori che usano Claude in workflow IDE agentici spesso consumano da uno a tre milioni di token al giorno attivo, i ruoli di ricerca e analisi più vicini a 200.000-500.000 e l'automazione di supporto ad alto volume su Haiku frequentemente sotto i 100.000. Moltiplica per i giorni lavorativi, applica un'assunzione di crescita (15-30 percento trimestre su trimestre è tipico) e aggiusta per la copertura prevista di cache e batch.
- Cambiare provider è un hedge realistico o solo una minaccia di negoziazione?
- Entrambi, se l'architettura lo supporta. Il vero switching richiede un layer gateway o di routing che astrae gli SDK provider-specific, preserva i tassi di cache hit del prompt attraverso i re-routing e misura l'uso a livello di token per Workspace. Senza quel layer, le rivendicazioni di portabilità multi-provider raramente sopravvivono a una migrazione reale. Con esso, puoi credibilmente instradare il traffico per classe di modello, fare fallback a un provider secondario durante incidenti e usare elasticità misurabile piuttosto che una minaccia verbale nelle conversazioni di rinnovo. Costruisci la capacità prima di doverla deployare.
Sources