Anthropic ha tagliato il prezzo di Opus 5.5

Anthropic ha tagliato il prezzo di Opus 5.5

Anthropic taglia Opus 5.5 del 40%, ma il risparmio vero è sulle letture cache: AWS capitalizza la distribuzione multi-cloud.

Listino -20%, esecuzione -40%: lo sconto maggiore arriva dalle letture in cache

Un -40% che non è solo marketing

Eppure, dietro l’annuncio c’è una sequenza di cifre che merita di essere letta con sospetto. Secondo Anthropic, Claude Opus 5.5 fa di più con meno token rispetto a Claude Opus 5, e la nuova politica di prezzo trasferirebbe quei guadagni direttamente ai clienti. Sempre secondo Anthropic, il modello ha un costo di esecuzione inferiore del 40% rispetto a Opus 5, genera output oltre il 30% più velocemente, e i token di input e output costano rispettivamente 4 e 20 dollari per milione: il 20% in meno rispetto a Opus 5.

Qui comincia il problema contabile. Se il costo di esecuzione scende del 40%, perché il prezzo di listino scende solo del 20%? Una parte della risposta sta nelle letture della cache: costano 0,20 dollari per milione di token, il 60% in meno rispetto a Opus 5, e secondo Anthropic rappresentano la maggior parte dei costi del lavoro agentico e di coding. Tradotto: lo sconto vero è per chi usa il modello in modo intensivo, riciclando contesto su sessioni lunghe. Chi paga input e output a prezzo pieno si ferma a un quinto del risparmio promesso.

Il contesto aiuta a capire la traiettoria. Già con Opus 5, Anthropic aveva posizionato il modello come un prodotto che si avvicina all’intelligenza di frontiera di Claude Fable 5 a metà del prezzo. Il -40% di oggi si somma a quella base già scontata. Non è una rottura: è la compressione progressiva di un listino. Ma se il prezzo scende così tanto, la domanda scomoda è un’altra: chi sta davvero guadagnando da questa mossa?

Chi guadagna dallo sconto

Se il prezzo scende, qualcuno deve assorbire il taglio: la risposta è nella catena distributiva. Claude Opus 5.5 è disponibile su tutte le piattaforme, inclusi Amazon Web Services, Google Cloud e Microsoft Azure. La formula sembra neutrale: il modello è “ovunque”. Ma basta leggere i dettagli dell’annuncio AWS per capire dove sta il baricentro.

Su Amazon Bedrock, Opus 5.5 arriva con la zero data retention (ZDR) attiva per impostazione predefinita. Bedrock mantiene i dati dentro l’infrastruttura AWS con residenza regionale dei dati, e l’accesso passa da un servizio unificato con funzionalità gestite come Guardrails e Knowledge Bases. Ci sono profili di inferenza dedicati — US Geo CRIS, EU Geo CRIS, AU Geo CRIS, JP Geo CRIS e Global CRIS su bedrock-runtime — più le regioni US East (N. Virginia) e AP SouthEast (Melbourne) su bedrock-mantle. Tradotto: ogni territorio ha un tubo dedicato, ogni dato una giurisdizione. È un argomento che parla più ai regolatori che agli ingegneri. Il paradosso è che più Anthropic insiste sul multi-cloud, più Amazon Bedrock capitalizza: Google Cloud e Microsoft Azure vengono citati nel comunicato, ma la sostanza operativa — residenza, zero retention, strumenti gestiti — è costruita attorno all’infrastruttura AWS. E mentre i margini si assottigliano, Anthropic mette sul piatto un altro argomento: la sicurezza.

Classificatori di sicurezza: scudo o specchietto normativo?

Il nuovo Opus 5.5 non è solo più economico: è il primo modello Opus dotato di classificatori di sicurezza simili a Claude Fable 5.1 in biologia, cybersicurezza e sviluppo AI. L’annuncio lo presenta come un traguardo tecnico. Ma la domanda è un’altra: perché proprio ora? Insieme allo zero data retention, questi classificatori servono a rassicurare le imprese regolamentate e i legislatori che chiedono limiti espliciti sui modelli. Non sappiamo se sia un reale avanzamento tecnico o un posizionamento difensivo: Anthropic non offre un confronto indipendente che misuri questi filtri contro quelli della concorrenza. Resta il dubbio: la sicurezza è una conquista tecnica o l’ennesima foglia di fico per un mercato che non vuole guardare il prezzo vero dell’innovazione?

Claude Opus 5.5 è la promessa di un’intelligenza artificiale più accessibile e più sicura. Ma il taglio del 40% e la distribuzione multi-cloud lasciano aperto un dubbio: il risparmio è per i clienti o è il costo che Anthropic paga per restare rilevante in un mercato dominato da AWS? Nei benchmark sul coding agentico, Anthropic rivendica il 66,4% contro il 57,9% di GPT-6 Astra ad alto sforzo, cifra riportata da OpenAI. La risposta, però, non è nei benchmark. È nella catena di chi incassa.

🍪 Impostazioni Cookie