📄 News10 minuti di lettura

Anthropic compra 220.000 GPU da SpaceX. Cosa cambia davvero per chi paga i token

Il deal Colossus 1 da 300 MW annunciato il 6 maggio sblocca un nuovo equilibrio. I prezzi per token però restano, e il tokenizer di Opus 4.7 ti costa il 35% in più. Cosa è cambiato e cosa no.

AS

Alessandro Saiani

Human in the Loop

Anthropic compra 220.000 GPU da SpaceX. Cosa cambia davvero per chi paga i token

A febbraio Elon Musk scriveva su X che Anthropic è "evil, misanthropic" e che "hates Western civilization". Il 6 maggio, dal palco del Code with Claude a San Francisco, Dario Amodei ha annunciato che Anthropic affitterà l'intera capacità di Colossus 1, il supercomputer di SpaceX/xAI a Memphis: oltre 220.000 GPU NVIDIA, 300+ MW, online "within the month". Commento di Musk lo stesso giorno: "No one set off my evil detector". Tre mesi tra "evil" e "landlord". Capacity prima dell'identità, sempre.

Lascio l'ironia da parte e vado al punto che conta per chi mi legge: cosa cambia davvero da lunedì per un dev italiano che apre Claude Code e brucia token tutto il giorno. Spoiler in tre righe: il limite delle 5 ore è raddoppiato (vero, già attivo), il prezzo per token di Opus 4.7 non si è mosso di un centesimo, e il nuovo tokenizer di 4.7 ti fa pagare circa il 35% in più sullo stesso testo. La capacity in più va dove deve andare: a togliere "limit reached" agli utenti che spendono. Non a ridurre il listino.

I numeri del deal, secchi

Sul fatto in sé i numeri sono usciti rapidamente, in parte ufficializzati da Anthropic e xAI, in parte riportati da Fortune, CNBC, Tom's Hardware, Latent Space.

  • GPU: oltre 220.000 NVIDIA, mix H100 + H200 + GB200 Blackwell. Composizione esatta non ufficializzata; stime non confermate indicano circa 150k H100, 50k H200, 30k GB200.
  • Capacità: 300+ MW. Per ordine di grandezza, è la potenza richiesta da una città di 200-250 mila abitanti, ed è un singolo campus AI medio-grande.
  • Sede: Colossus 1, Memphis, Tennessee. xAI ha spostato il training primario su Colossus 2, liberando il sito.
  • Timeline: capacità online "entro il mese" (formulazione Anthropic), quindi fine maggio 2026.
  • Valore: non ufficializzato. Fortune titola "$4 billion deal". Latent Space cita "$5B/year". New Street Research stima $3-4 miliardi/anno di revenue per SpaceX, con oltre 2,5 miliardi di profitto cash.
  • Kill-switch: la clausola riportata da Fortune dà a SpaceX il diritto di revocare la compute se l'AI di Anthropic "engages in actions that harm humanity". Non è solo decorazione contrattuale; è il primo deal di compute frontier con una clausola di questo tipo pubblicamente nota.

Una riga di colore che merita un cenno e basta: Anthropic ha "expressed interest" a sviluppare con SpaceX "multiple gigawatts of orbital AI compute capacity". Data center in orbita. È una riga in un press release, non un piano. Ne riparleremo quando ci sarà qualcosa da raccontare.

Cosa cambia da oggi

Insieme all'annuncio del deal, Anthropic ha pubblicato un secondo post (anthropic.com/news/higher-limits-spacex) con i cambi operativi sui rate limit. Sono già attivi.

  • Limite 5-hour raddoppiato su Pro, Max, Team e Enterprise seat-based. Se prima esaurivi i messaggi della finestra a metà mattina, oggi hai il doppio dello spazio.
  • Rimosso il peak-hour throttling. Le ore 5-11 PT (per chi sviluppa in Italia, le 13-19 GMT, cioè il primo pomeriggio) non sono più penalizzate. Era diventato un problema noto: marzo 2026 The Register documentava utenti che bruciavano i 5h in meno di 5h durante la finestra peak.
  • API rate limits su Opus alzati "considerably". Non c'è un numero pubblico, ma per chi costruisce agenti in produzione sopra l'API conta.
  • Weekly limits invariati. Punto su cui Anthropic non si è mossa. Chi sbatteva nel weekly cap continuerà a sbatterci.

Per inquadrare bene il "perché serviva il deal": a luglio 2025 Anthropic ha introdotto i weekly rate limit per contenere i power user di Claude Code lasciati a girare 24/7. A fine marzo 2026, durante la quota exhaustion crisis, ha ammesso pubblicamente che "people are hitting usage limits in Claude Code way faster than expected". Nel frattempo Amodei ha dichiarato a Fortune che l'ARR del Q1 2026 è cresciuto 80x year-over-year, contro previsioni interne di 10x. Domanda fuori scala, supply ferma. Il deal SpaceX è la risposta più rapida ottenibile: un singolo sito già costruito, già alimentato, già raffreddato. Procurement GPU normale richiede 18-24 mesi.

Cosa NON cambia

Qui sta il pezzo che si legge meno volentieri ma è quello che conta in bolletta.

Il prezzo per token di Opus 4.7 è invariato: $5 per milione di token input, $25 per milione di output. Stessi numeri di Opus 4.6. Anthropic non ha annunciato sconti, riduzioni di listino, tier intermedi. La capacity in più va a togliere il "limit reached" agli utenti che pagano l'abbonamento — non a far scendere il costo per chi paga a consumo via API.

È una scelta esplicita, ed è anche razionale: la domanda di Opus è inelastica. Chi lo usa in produzione sa che oggi non ha un sostituto 1:1 sui task agentic multi-file più complessi. Con quella curva di domanda, un lab non taglia il prezzo: aumenta la capacità servita allo stesso prezzo.

I weekly limit restano. Era il vero collo di bottiglia per gli utenti più intensi di Claude Code, ed è proprio quello su cui Anthropic non si è mossa. Tradotto: se la tua giornata tipo è "30K input + 5K output per task × 50 task", il deal SpaceX ti regala fluidità dentro le 5 ore. Non ti regala più volume nel mese.

La qualità del modello è la stessa. Più compute disponibile non vuol dire "Opus 4.7 ora è migliore". È lo stesso modello, servito su più hardware.

La trappola del tokenizer 4.7

C'è un dettaglio uscito poco e che vale la pena guardare bene, perché è la differenza tra "prezzo invariato" e "costo invariato". Sono due cose diverse.

Opus 4.7 ha cambiato tokenizer rispetto a 4.6. Analisi indipendenti pubblicate da Finout e CloudZero documentano che, sullo stesso identico testo, 4.7 produce fino al 35% di token in più rispetto a 4.6. Non è un bug e non è un'opinione: è il modo in cui il nuovo tokenizer segmenta — in particolare su codice, identificatori snake_case/camelCase, stringhe miste e testo italiano con accenti.

Cosa significa in pratica. Se prima un task ti costava 30K input × $5/M = $0,15 con 4.6, lo stesso identico task con 4.7 può finire a 40K input × $5/M = $0,20. Il listino dice "prezzo invariato". La carta di credito dice "+33%".

Ne ho parlato in dettaglio nell'articolo dedicato — Opus 4.7, il tokenizer nascosto e i costi reali. Qui basta tenere il punto: chi legge il deal SpaceX come "Anthropic ha più compute, quindi pagheremo meno" sta sommando due fattori sbagliati. Il listino non scende, e il conto sullo stesso testo sale per via del tokenizer. È un aumento di prezzo de facto mascherato da un cambio di modello.

La corsa alla capacity in contesto

Tre cose insieme. Non bisogna leggere il deal isolato per capire dove sta davvero Anthropic.

OpenAI / Stargate: 8+ GW di capacità pianificata, $450 miliardi committed, target $500 miliardi e 10 GW entro fine 2029. Negli ultimi 90 giorni (Q1 2026) ha aggiunto 3 GW. Cinque siti tra Texas, New Mexico, Ohio, Wisconsin, Michigan. È in un'altra scala dimensionale.

xAI Colossus: Colossus 1, quello appena affittato ad Anthropic, è 300+ MW. Colossus 2, secondo stime non ufficiali, sta puntando a circa 500.000 Blackwell per il training xAI primario.

Anthropic stack compute (dichiarato nel comunicato del 6 maggio): Amazon fino a 5 GW (quasi 1 GW operativo entro fine 2026), Google + Broadcom altri 5 GW dal 2027, Microsoft + NVIDIA $30 miliardi di Azure capacity, Fluidstack $50 miliardi in infra USA, e ora SpaceX/Colossus 1 per 300+ MW.

Il colpo del 6 maggio fa due cose nello stesso tempo: dà ad Anthropic capacità tampone in tempi che il procurement normale non consente, e segnala al mercato che Anthropic è disposta ad accordi di portata politicamente delicata pur di non restare scoperta. Ma non spareggia la corsa con OpenAI sul lungo periodo. Anthropic resta terza nello scoreboard del compute promesso, e Amodei stesso continua a definire l'azienda compute-constrained.

C'è anche un sotto-testo tecnico. Servire modelli grandi a basso latency su scala consumer è un problema di inference, non solo di training. Le feature annunciate insieme al deal — multiagent orchestration, sessioni più lunghe, Dreams (consolidation di memoria background) — sono tutte feature che spostano costo dal training all'inference. È esattamente il punto su cui ho ragionato nel pezzo su MoE — attivare solo gli esperti che servono: la sparsity al servizio dell'inference economy, non dello scaling del training. E si lega anche a come gestire la memoria degli agenti su filesystem senza esplodere il context window — meno tokens per turno, più task serviti.

La sceneggiata Musk e l'IPO di SpaceX

Va raccontata, ma come fatto, non come trama.

A febbraio 2026, su X, Musk descrive Anthropic come "evil, misanthropic", li accusa di "hate Western civilization". È una sequenza di post non ambigui. Lo stesso Musk continua il proprio lawsuit federale contro OpenAI/Altman, e Anthropic è il competitor principale di OpenAI sul fronte coding agentico.

Il 1 aprile 2026, SpaceX deposita un IPO confidenziale. È pubblico: lo riporta Fortune.

Il 6 maggio 2026, Anthropic e SpaceX annunciano il deal. Musk pubblica: "No one set off my evil detector" e dichiara di aver passato del tempo con "senior members of the company to understand what they do to ensure Claude is good for humanity".

La lettura più sobria — quella che fanno gli analisti citati da Fortune e Latent Space — è che Musk si sta posizionando come "AI landlord" più che come competitor diretto in vista dell'IPO. Un cliente da 3-5 miliardi di dollari annui è un proof-point di revenue che vale, nel multiple di una IPO, molto più del rumore reputazionale che gli costa cambiare opinione su Anthropic. La kill-switch clause serve a vendere internamente la decisione e a tenere una leva morale teatrale. Funziona per entrambe le parti finché funziona.

Non è una storia di amicizia. È un deal commerciale con kill-switch clause, fatto tra due aziende che tre mesi prima si insultavano in pubblico. Va letto come tale.

Cosa farsene oggi, lato dev

Senza profezie, le cose pratiche da portare a casa.

Sfrutta il 5h raddoppiato. Se eri su Pro o Max e ti chiudevi i task perché ti finiva la finestra, oggi hai il doppio dello spazio nelle stesse 5 ore. Il primo pomeriggio italiano (era il peak USA) non è più penalizzato. È un cambio reale e gratuito per chi paga già l'abbonamento.

Tieni d'occhio il tokenizer 4.7. Se hai migrato a Opus 4.7 e i costi sembrano cresciuti rispetto a 4.6 sullo stesso lavoro, non è un'illusione. Misura. Logga input_tokens e output_tokens, confronta con 4.6 se hai ancora accesso, e decidi caso per caso se conviene fare downgrade su task dove la qualità marginale di 4.7 non giustifica il costo extra del 35%.

Non aspettarti uno sconto sui token. Niente lo suggerisce. Storicamente, ogni volta che un lab risolve un bottleneck di compute, il primo utente servito è il training del modello successivo, non lo sconto al consumer. Ricorda che dopo DeepSeek V3 a fine 2024, Sonnet 4.6 è rimasto a $3/$15 per mesi e Anthropic non ha tagliato il listino in modo significativo. La pressione esiste, la velocità di risposta storica no.

Tieni viva un'alternativa low-cost. Per i task in cui non ti serve Opus, DeepSeek V4-Pro resta l'opzione a 1/6 del prezzo via API DeepSeek-compatible, con caveat GDPR per l'Italia che ho discusso in quell'articolo. Il deal SpaceX rinforza, non indebolisce, la tesi del pattern ibrido: routine ai modelli economici, decisioni critiche a Opus.

Weekly limit: pianifica come prima. Niente è cambiato lì. Se hai una giornata 24/7 di agenti su Claude Code Pro/Max, il weekly cap arriverà uguale.

Chiusura

Il deal SpaceX-Anthropic è grande quanto sembra grande nei numeri: 220.000 GPU, 300+ MW, miliardi all'anno, online in settimane. Ma è grande in fluidità di servizio, non in economia per chi compra token. Le due cose stanno su due circuiti separati, e tenerli separati nella propria testa è il modo più rapido per non farsi raccontare la favola sbagliata della settimana.

Per chi sviluppa, oggi, l'azione concreta è semplice. Apri Claude Code, lavora dentro la finestra 5h che è ora doppia, smetti di temere il peak pomeridiano, e tieni un'occhiata al conto API se sei già migrato a 4.7. Il resto — chi paga davvero il deal, dove finisce la capacità, se Stargate andrà a 10 GW e se Colossus 2 farà ombra a entrambi — è la cornice. Utile da conoscere, non da inseguire.

E la prossima volta che Musk pubblica un post su chi è "evil", vale la pena ricordarsi del 6 maggio. Non per cinismo. Per calibrare il peso giusto delle parole.


Fonti:

  1. Anthropic — Higher usage limits and SpaceX deal
  2. xAI — Compute Partnership with Anthropic
  3. CNBC — Anthropic, SpaceX announce compute deal
  4. Fortune — Musk called Anthropic 'evil' 3 months ago, now $4B landlord
  5. Fortune — Anthropic grew 80-fold in a single quarter
  6. Axios — Anthropic compute from SpaceX
  7. Semafor — Tokens are taking over the economy
  8. Tom's Hardware — 220k GPU, 300 MW deal
  9. Data Center Dynamics — Anthropic to use all Colossus 1
  10. Latent Space AINews — 300MW / $5B/yr / 8000% ARR
  11. The Register — Anthropic admits Claude Code quotas running out
  12. TechCrunch — New weekly rate limits July 2025
  13. Anthropic Pricing docs
  14. Finout — Opus 4.7 pricing real cost story
  15. CloudZero — Opus 4.7 pricing analysis
  16. OpenAI — Five new Stargate sites
  17. Data Center Frontier — 10 GW Stargate