News dal Mondo AI
Rilasci, aggiornamenti e novità dal mondo AI coding. Announcement, analisi e risorse selezionate.

Ha inventato l'RLHF, adesso dice che è il problema
Diogo Almeida, quarto autore del paper che ha portato l'RLHF in ChatGPT, esce dallo stealth con 40 milioni e un modello che non genera testo: decisioni tipizzate in 70 millisecondi. Il grafico con lo 0% di allucinazioni però non è una misura, e lo scrivono loro.

Un modello in test ha pubblicato un pacchetto trappola su PyPI. Per tre mesi non se n'è accorto nessuno
Quindici sistemi reali hanno installato in un'ora il pacchetto scritto da Claude Mythos 5 durante una valutazione, fra cui lo scanner di un'azienda di sicurezza. Nessun modello è evaso: l'ambiente aveva internet per errore e il prompt diceva il contrario. È un fallimento dell'impalcatura, ma non solo.

Gli infostealer ora rubano le sessioni degli agenti di coding. E le trovano in chiaro
Una ricerca Gen Digital documenta almeno dieci famiglie di malware che raccolgono token, configurazioni MCP e cronologie dei prompt di Claude Code, Cursor, Codex e Cline. Non è una falla degli agenti: è che i transcript sono file di testo, e la documentazione lo scrive.

"Welcome to the AGI era". Nello stesso briefing OpenAI ammette di vederci meno dentro
Astra è il primo modello addestrato con altri modelli a supervisionarlo, e il primo a raggiungere la soglia critica per la cybersecurity. È anche il primo di cui OpenAI dice che la monitorabilità è calata, definendo il calo serio.

Nvidia si compra Hugging Face. La promessa di restare aperti è depositata alla SEC
11,9 miliardi più un miliardo di retention per la piattaforma dove 18 milioni di sviluppatori scaricano 3 milioni di modelli. L'impegno a supportare altri produttori di chip non è un tweet: sta nel Form 8-K. Il problema è che copre l'esplicito, e il rischio è implicito.

GitHub Copilot Usera' i Tuoi Dati per il Training. Opt-Out Entro il 24 Aprile.
Dal 24 aprile 2026, input, output e snippet di Copilot Free/Pro/Pro+ addestrano modelli AI di Microsoft. Come fare opt-out in 2 minuti.

Apple Blocca il Vibe Coding sull'App Store. Ma Intanto lo Mette in Xcode.
Apple blocca Replit e Vibecode invocando una regola del 2010, mentre Xcode 26.3 integra Claude e Codex. Il paradosso, la storia, e cosa cambia per chi sviluppa.

OpenCode vs Anthropic: La Guerra Open Source dei Coding Tool
OpenCode, 125K stelle GitHub, bloccato da Anthropic per spoofing OAuth. Community in rivolta, ma la questione e' piu' sottile di come sembra.

Microsoft Valuta Azione Legale Contro OpenAI e Amazon per Deal Cloud da $50 Miliardi
Microsoft minaccia di citare OpenAI e Amazon per un accordo cloud da $50 miliardi che porterebbe i modelli GPT su AWS. In gioco: vendor lock-in e multi-cloud AI.

GPT-5.4 Mini e Nano: L'Era dei Sub-Agent Economici
GPT-5.4 Nano costa $0.20 per milione di token ed è pensato per i coding subagents. Mini arriva gratis su ChatGPT. Cosa cambia per chi sviluppa sistemi multi-agent.

Amazon Perde 6.3 Milioni di Ordini per Codice AI: Ora Serve la Double Review
Due outage in una settimana, 6.3 milioni di ordini persi in 6 ore. Amazon impone double code review e reset di sicurezza su 335 sistemi. Cosa è successo.

Anthropic vs Pentagono: Microsoft e 22 Ex Generali Si Schierano
Il Pentagono etichetta Anthropic come rischio per la supply chain. Microsoft, Google e 22 ex generali si oppongono. In gioco il futuro dell'AI responsabile.

OpenAI Codex Security: l'AI che Trova Exploit in OpenSSH e Chromium
Codex Security ha scovato 792 vulnerabilità critiche in 30 giorni di beta, con exploit in OpenSSH e Chromium. Come funziona e cosa cambia per i dev.

GPT-5.4: OpenAI Unifica Reasoning, Coding e Computer Use in un Solo Modello
OpenAI lancia GPT-5.4 Thinking e ritira GPT-5.1. Un modello generalista che fonde reasoning, coding e azioni agentiche. Cosa cambia per chi sviluppa.

GitHub Copilot SDK: l'AI Non Scrive Più Testo, Esegue Codice
GitHub lancia il Copilot SDK: l'AI diventa un motore di esecuzione programmabile. Agent Mode con MCP per tutti. Cosa cambia per gli sviluppatori.

Anthropic Lancia Code Review per Claude Code
Code Review di Anthropic manda un team di agenti AI in parallelo su ogni PR. Copertura passata dal 16% al 54% internamente, circa 20 minuti per review.

Claude Opus 4.6 e Sonnet 4.6: Cosa Cambia per Chi Sviluppa
Opus 4.6 porta Agent Teams e 1M di contesto. Sonnet 4.6 raggiunge il 98% delle performance a costo ridotto. Benchmark, pricing e novità pratiche.

Opus 4.6 vs GPT-5.3 Codex: Cosa Cambia Per Chi Sviluppa
Opus 4.6 porta 1M di contesto e Agent Teams. GPT-5.3 Codex è il 25% più veloce. Due rilasci lo stesso giorno: ecco cosa cambia per chi sviluppa.