📄 News10 minuti di lettura

Opus 4.8: il taglio prezzi del fast mode è il vero titolo

Anthropic ha rilasciato ieri Claude Opus 4.8 con benchmark migliori e un nuovo strumento. Ma la mossa più importante è altrove: -3× sul fast mode, sei giorni dopo la price cut permanente di DeepSeek. Una lettura.

AS

Alessandro Saiani

Human in the Loop

Opus 4.8: il taglio prezzi del fast mode è il vero titolo

La cosa che conta di più nel rilascio di Opus 4.8, ieri sera, non è nei titoli di stamattina. I siti di settore vanno tutti sullo stesso binario: "benchmark migliori", "più onesto sui propri limiti", "nuovo strumento agentico". Tre cose vere, tutte e tre incrementali. La quarta, quella che chi paga i token guarda per prima, è altrove: il fast mode passa da 30/150 dollari per milione a 10/50. Tre volte meno. Sei giorni dopo che DeepSeek ha reso permanente lo sconto del 75% sul V4-Pro.

Quel numero è il pezzo che voglio mettere al centro, perché spiega un movimento competitivo che la copertura mainstream sfuma. Il resto — alignment, dynamic workflows, teaser Mythos — è importante, ma va letto in seconda battuta.

L'annuncio in due righe

Il 28 maggio 2026 Anthropic ha pubblicato sul newsroom Introducing Claude Opus 4.8. Disponibilità immediata su claude.ai, API e Claude Code. La cadenza è di 42 giorni rispetto a Opus 4.7 (16 aprile). Stessa giornata, GitHub Copilot ha messo Opus 4.8 in GA per Pro+, Business ed Enterprise, con moltiplicatore premium 15× fino al 1° giugno — il classico colpo di rampa per spingere l'adozione nelle prime settimane.

La frase con cui Anthropic apre il post, verbatim, è: "sharper judgement, more honesty about its progress, and the ability to work independently for longer than its predecessors". Tradotto: ragiona meglio, dice meglio cosa non sa, regge sessioni agentiche più lunghe. Tre vettori dichiarati, su cui torno in coda perché si legano a un filo che attraversa tutta la settimana scorsa.

In fondo all'annuncio, una riga sul Mythos: "expect to be able to bring Mythos-class models to all our customers in the coming weeks". Tienila a mente, ma trattala come promessa, non come prodotto.

I benchmark: utili, incrementali, con una cautela

I numeri sono questi, modello su modello:

BenchmarkOpus 4.7Opus 4.8Delta
Agentic coding (SWE-Bench Pro)64,3%69,2%+4,9 pp
Multidisciplinary reasoning with tools54,7%57,9%+3,2 pp
Agentic computer use82,8%83,4%+0,6 pp
Knowledge work (Elo)1.7531.890+137
Terminal-Bench 2.192,3%
OSWorld-Verified84,1%
Legal Agent Benchmarkprimo modello a superare 10% sullo standard all-pass

Quattro virgola nove punti su SWE-Bench Pro sono reali ma "modest but tangible", come ha titolato the-decoder. Sono il tipo di incremento che si nota in produzione su task lunghi, non quello che riscrive la classifica. Sono coerenti con un release point — 4.7 → 4.8 — non con un major.

C'è una cautela esplicita da segnalare: il Super-Agent benchmark citato da Anthropic, con la frase del CTO Kay Zhu "Claude Opus 4.8 is the only model to complete every case end-to-end, beating prior Opus models and GPT-5.5 at parity on cost", è un benchmark proprietario. Vuol dire: l'ha disegnato Anthropic, l'ha eseguito Anthropic, non c'è una controprova esterna. È una metrica utile come segnale interno, va trattata con il distacco che merita quando un vendor dichiara di battere il concorrente sul suo terreno.

E c'è un controesempio onesto che vale la pena dire ad alta voce: su Terminal-Bench 2.1 Opus 4.8 fa 92,3% in aggregato, ma sulla fetta specifica di agentic terminal coding GPT-5.5 vince 78,2% contro 74,6%. Non è il quadro complessivo, è una nicchia. Ma è una nicchia che riguarda esattamente il tipo di lavoro che molti di noi fanno con Claude Code dentro un terminale. Vale dirlo, perché altrimenti si torna a fare quello che facevamo tre anni fa: cherry-picking dei propri benchmark e silenzio sugli altri.

Il fast mode -3×: questo è il vero titolo

E veniamo al numero che secondo me andrebbe in apertura ovunque.

Modello / modalitàInput ($/M)Output ($/M)
Opus 4.8 — standard525
Opus 4.8 — fast mode1050
Opus 4.7 — fast mode (prima)30150
GPT-5.5530
GPT-5.5 Pro30180
Qwen3.7 Max (19 maggio)2,507,50
DeepSeek V4-Pro (75% perm., dal 22/5)0,4350,87

Il pricing standard di Opus 4.8 resta invariato — 5 dollari input, 25 output, come 4.7 e come Sonnet 4 prima di lui. È il fast mode che si muove, e si muove tanto: da 30/150 a 10/50, tre volte meno, su input e output insieme. Il prompt caching scende ancora del 90%, il batch del 50%.

Per chi non l'ha mai toccato: il fast mode è la modalità a bassa latenza di Claude Code, pensata per gli agent loop che fanno tanti round-trip brevi. Storicamente è stata la modalità che brucia di più: tipica di chi spreme un subagent loop o un orchestrator che chiama il modello cinquanta volte in cinque minuti. A 150 dollari per milione di output ti accorgevi in fretta. A 50 il conto cambia.

Tre volte meno, su una modalità specifica, sei giorni dopo che DeepSeek ha reso permanente lo sconto del 75% sul V4-Pro (22 maggio), portando il costo del modello cinese a 0,435 dollari input e 0,87 output. Ne avevo scritto a fine aprile, quando lo sconto era ancora temporaneo: la differenza tra "promo" e "listino" è esattamente il tipo di mossa che obbliga i frontier lab a rispondere.

E qui Anthropic ha risposto sulla leva più sensibile, quella del modello pro su modalità ad alto consumo, evitando di toccare il listino standard (che avrebbe segnalato "ci stiamo arrendendo sul prezzo del frontier"). È un compromesso comunicato bene: non è una price war frontale, è un taglio selettivo sul punto dove la pressione cinese si sentiva di più. Ma è il primo riconoscimento esplicito che quella pressione esiste e produce reazioni.

Non lo dice nessun comunicato, lo dicono i numeri uno accanto all'altro: 30 → 10 sul fast mode, 0,87 sul V4-Pro full price ora permanente, e sei giorni di distanza tra le due mosse.

Dynamic workflows: cosa è, cosa promette, dove si ferma

Insieme a Opus 4.8 esce Dynamic Workflows, lo strumento agentico nuovo. Status dichiarato: research preview. Disponibilità: Claude Code per Enterprise, Team, Max. Escluso il piano Pro individuale, che è esattamente quello che usa la maggior parte dei dev che leggono qui.

L'idea è semplice da raccontare e meno semplice da mettere in produzione. Claude scrive uno script di orchestrazione — non un grafo predefinito, lo scrive lui — che lancia subagenti in parallelo per attaccare un problema da più angoli. Una parte di questi subagenti è esplicitamente adversariale: prova a confutare i findings degli altri, a rompere l'ipotesi che il workflow sta convergendo. È un pattern che ha senso: invece di un singolo loop lineare, una piccola squadra che cerca di smontarsi a vicenda.

I limiti sono dichiarati e fanno la differenza tra demo e produzione: 16 subagenti concorrenti, 1.000 totali per run. Il cap totale è il segnale che non siamo davanti a un loop infinito da agente generalista, ma a uno strumento pensato per task ben definiti dove dopo mille step o hai chiuso o c'è qualcosa che non va.

Lo use case verbatim dichiarato da Anthropic è interessante: "codebase-scale migrations across hundreds of thousands of lines of code from kickoff to merge". Migrazioni di codebase intere, dall'inizio al merge. È la promessa più ambiziosa, ed è esattamente lo scenario in cui un orchestratore parallelo con subagenti adversariali avrebbe senso — se funziona davvero. Research preview vuol dire: non lo sapremo finché non avremo abbastanza case study indipendenti.

Sul punto della concorrenza con altri pattern multi-agente avevo scritto recentemente che il dogma "multi-agent batte single-agent" non regge sempre. Dynamic Workflows non smentisce quella lettura: è un caso specifico in cui il parallelismo ha senso (codebase enormi, task indipendenti), non un'evidenza che multi-agent sia sempre la risposta giusta.

La sequenza dei dieci giorni: quattro mosse coordinate

Se metto in fila gli ultimi dieci giorni di Anthropic, il quadro che esce non è una serie di rilasci scollegati. È una sequenza coreografata, con tappe verificabili:

  • 18-19 maggio: pubblicato l'episodio con Karpathy sulla strategia agentica e l'estensione del programma Stainless. Ne avevo scritto come strategia delle 48 ore.
  • 22 maggio: DeepSeek rende permanente lo sconto del 75% su V4-Pro. È la mossa esterna a cui Anthropic deve rispondere.
  • 25 maggio: Chris Olah a Roma alla presentazione dell'enciclica Magnifica Humanitas di Papa Leone XIV. Olah dice una frase che pesa: "informed critics who will tell the labs when we are failing", "moral voices that the incentives cannot bend". È posizionamento etico-EU. Ne ho scritto due giorni fa, in l'enciclica AI di Magnifica Humanitas.
  • 27 maggio: Anthropic apre il sesto ufficio europeo a Milano. Ne ho scritto ieri, in Anthropic apre a Milano, cosa cambia per il dev italiano.
  • 28 maggio: Opus 4.8 + fast mode -3× + Dynamic Workflows.

Quattro mosse — due geopolitico-narrative (Vaticano, Milano) e due tecnico-commerciali (Karpathy/Stainless, Opus 4.8 + taglio prezzo) — in dieci giorni. Sullo sfondo, due fatti americani che spiegano il perché ora: a febbraio 2026 l'amministrazione Trump ha designato Anthropic come supply chain risk; a marzo 2026 Anthropic ha fatto causa all'amministrazione. Mentre in patria si litiga, si costruisce con accelerazione un'alternativa europea, una narrativa etica, una pipeline talento (Stainless, Karpathy) e una risposta al concorrente cinese sul prezzo.

Una mossa l'avrei letta come tatticismo. Quattro in dieci giorni sono strategia.

E vale per la lettura dell'Opus 4.8: non è un rilascio isolato. È il pezzo tecnico-commerciale che chiude la settimana, con il numero del fast mode che parla al mercato pricing-sensitive, mentre Milano parla all'enterprise EU e il Vaticano parla al pubblico dei valori. Tre messaggi diversi nello stesso arco temporale, ciascuno per un'audience.

Mythos "coming weeks": promessa, non prodotto

La riga sul Mythos va maneggiata con prudenza. Il modello era stato annunciato in aprile via Project Glasswing — accesso ristrettissimo, solo a ricercatori di sicurezza e aziende selezionate. Avevo provato a leggerlo allora, in Project Glasswing e i modelli Mythos.

Anthropic ora dichiara "swift progress" sui "stronger safety safeguards" necessari per allargare l'accesso, e mette il classico "in the coming weeks". Tradotto in italiano da blog: non c'è una data. C'è un'intenzione comunicata.

Vale citarla, perché il contesto regolatorio si sta muovendo: la CNBC del 29 maggio titola "EU seeks to intensify talks with U.S. on advanced cyber AI models amid Mythos concerns". Quindi: Anthropic dice "presto", l'EU dice "discutiamone prima". Tradotto operativamente: chi pianifica produzione nei prossimi 30-60 giorni non costruisca su Mythos. Costruisca su Opus 4.8 e tenga il Mythos sul radar.

"More honesty about its progress": un filo che attraversa la settimana

C'è un dettaglio nel post di Anthropic che mi ha colpito perché lega questa release a un altro pezzo della settimana. La frase è "more honesty about its progress": un modello che dice meglio cosa non sa, che è più cauto nel claim, che riconosce i propri limiti dentro la sessione.

Tre giorni fa, all'enciclica del Papa, Chris Olah parlava di "informed critics who will tell the labs when we are failing" e di "moral voices that the incentives cannot bend". Stessa idea — la consapevolezza dei limiti come direzione di design — in due registri diversi: uno religioso/filosofico, uno tecnico/prodotto. L'enciclica chiede all'AI di non auto-celebrarsi; il release note di Opus 4.8 dichiara che il modello è "più onesto sui propri progressi".

Non sto dicendo che sia stata scritta nella stessa stanza. Sto dicendo che, qualunque sia il livello di intenzionalità, il messaggio coerente è uno: l'AI che riconosce di non sapere è la nuova frontiera di posizionamento, non la più grande, non la più veloce. Il dato di benchmark il primo modello a superare il 10% sull'all-pass del Legal Agent Benchmark, dove "all-pass" significa "ho risolto tutto, niente errori, niente allucinazioni" è coerente con questa linea: misurare la robustezza, non solo la velocità.

È una lettura. Non è il pezzo principale. Ma è coerente con quello che si vede.

Cosa farsene oggi, operativamente

Provo a chiudere con qualcosa di utile, suddiviso per chi sta leggendo.

Se usi il fast mode di Claude Code in produzione, il movimento è semplice e arriva subito: il costo per milione di output scende da 150 a 50 dollari. Senza fare nulla, oggi il tuo bill sui task ad alto throughput cala. Verifica che il tuo client stia effettivamente puntando a claude-opus-4-8 (o all'alias che la documentazione indica al rollout). Se hai sospeso il fast mode mesi fa perché costava troppo, vale la pena rifare i conti.

Se paghi in produzione con piano Enterprise/Team/Max e gestisci migrazioni cross-codebase, Dynamic Workflows è il pezzo da testare in research preview. Aspettative misurate: 16 subagenti concorrenti e 1.000 totali sono limiti reali, non placeholder. Per task ben circoscritti — migrazioni framework, refactor di pattern ricorrenti su molti file — il pattern adversariale può fare la differenza. Per task aperti senza fine condition chiara, il cap dei 1.000 step diventa un freno.

Se sei sul piano Pro individuale, Dynamic Workflows non è per te oggi. Aspettati che arrivi più avanti, con tutta probabilità in forma ridotta.

Se stai guardando il mid-tier per ragioni di costo, il quadro competitivo si è ristretto, non allargato. DeepSeek V4-Pro a 0,87 dollari di output resta l'opzione più aggressiva sul prezzo — col caveat italiano del Garante di cui ho già scritto — ma il fast mode di Opus 4.8 a 50 dollari accorcia il delta su un tipo specifico di workload, quello a bassa latenza con molte chiamate brevi. Per scenari ibridi (Opus per i task critici, V4-Pro per la routine), il calcolo dell'ottimo cambia: più Opus diventa difendibile economicamente nel fast mode, meno è necessario scaricare tutto su V4-Pro.

Se gestisci compliance e residency, niente cambia con Opus 4.8. Infrastruttura USA, listino in dollari, niente data residency EU nativa annunciata. Per quello continua a valere il quadro che descrivevo ieri parlando di Milano.

Chiusura

Opus 4.8 in sé è un buon release point: cinque punti su SWE-Bench Pro, un benchmark legale nuovo dove è il primo a passare la soglia, uno strumento agentico di orchestrazione che almeno sulla carta ha senso. È onesto chiamarlo come l'ha chiamato the-decoder: modest but tangible. Non è il rilascio che riscrive la categoria.

Il numero che riscrive qualcosa, anche se piccolo, è il -3× sul fast mode. È la prima volta che Anthropic risponde in modo esplicito a una pressione di prezzo sul mid-tier, sei giorni dopo che il concorrente cinese ha trasformato la propria promo in listino. E si inserisce in una settimana in cui Anthropic ha messo in fila quattro mosse — Karpathy/Stainless, Vaticano, Milano, Opus 4.8 — con una coerenza che è difficile leggere come casuale.

Il pezzo da portarsi via, se devi dirne uno solo: guardate il fast mode, non i benchmark.

Fonti

  1. Introducing Claude Opus 4.8 — Anthropic
  2. Claude Opus 4.8 3X cheaper fast mode — VentureBeat
  3. Anthropic launches Opus 4.8 with lower fast mode pricing — Neowin
  4. Opus 4.8 — modest but tangible improvement — the-decoder
  5. Opus 4.8 dynamic workflow tool — TechCrunch
  6. Dynamic Workflows 1000 subagents — MarkTechPost
  7. Opus 4.8 GA su GitHub Copilot — GitHub Changelog
  8. Mythos-class models — The Register
  9. EU intensify talks on Mythos — CNBC
  10. Anthropic sues Trump over supply chain risk designation — NPR
  11. DeepSeek V4-Pro 75% price cut permanent — Codersera
  12. Fast mode docs — Claude Code