Salta al contenuto
Tech17 lug 2026

Fable 5 torna online, GLM 5.2 apre i pesi, il "subconscio" di Claude e il primo nuovo metodo HTTP in 16 anni

Diciannove giorni di blackout per il modello più potente di Anthropic, un modello cinese open weights al vertice, il "subconscio" di Claude e RFC 10008.

Di Stefano Righini

In sintesi: quattro notizie di giugno e luglio 2026 raccontano la stessa cosa da quattro angoli diversi — chi decide a cosa possiamo accedere. Un governo che spegne per diciannove giorni il modello più capace mai rilasciato al pubblico. Un laboratorio cinese che pubblica pesi liberi al vertice della classifica open. Un team di ricerca che apre una finestra su ciò che un modello pensa e non dice. E un comitato di standard che, dopo sedici anni, aggiunge un metodo nuovo al protocollo su cui gira il web.

Le 4 notizie in 30 secondi

  • Claude Fable 5 è tornato disponibile il 1° luglio, dopo diciannove giorni di sospensione totale imposti da un ordine di export control del Dipartimento del Commercio USA. Mythos 5, il gemello con meno safeguard, resta accessibile solo a un gruppo di organizzazioni statunitensi.
  • GLM 5.2 di Z.ai è il modello open weights più forte scaricabile oggi: licenza MIT, contesto da un milione di token, prestazioni di frontiera sul coding agentico a circa un sesto del costo delle alternative americane.
  • Anthropic ha trovato dentro Claude una specie di "spazio di lavoro cosciente": una piccola area interna, chiamata J-space, che il modello sa riferire e usare per ragionare, immersa in un oceano molto più grande di calcolo di cui non ha alcuna consapevolezza.
  • L'IETF ha pubblicato RFC 10008, che definisce il metodo HTTP QUERY: il primo metodo davvero nuovo dai tempi di PATCH nel 2010. Ha il body di POST e la semantica sicura e idempotente di GET.

1. Fable 5: diciannove giorni di blackout e cosa insegnano

Il 9 giugno 2026 Anthropic ha rilasciato Claude Fable 5 e Claude Mythos 5. Condividono lo stesso modello di base, ma Fable 5 è uscito con safeguard più forti per l'uso generale, mentre Mythos 5, meno vincolato, è stato dato solo a un piccolo numero di partner fidati del programma Project Glasswing, per cybersecurity difensiva.

Tre giorni dopo, il 12 giugno, il governo statunitense ha imposto un ordine di export control. La causa: un report di ricercatori Amazon aveva mostrato un metodo per aggirare i safeguard di Fable 5, portandolo a identificare vulnerabilità software, e in un caso a produrre codice che ne dimostrava lo sfruttamento. La direttiva imponeva di limitare l'accesso ai cittadini non statunitensi, dentro e fuori gli USA.

Qui arriva il dettaglio operativo più interessante di tutta la storia: l'ordine è entrato in vigore immediatamente, e Anthropic non aveva modo di verificare in tempo reale la nazionalità degli utenti. Risultato: accesso sospeso per tutti, cittadini americani inclusi.

La cronologia

DataCosa è successo
9 giugnoRilascio di Fable 5 (generale) e Mythos 5 (partner Glasswing)
12 giugnoExport control USA. Anthropic sospende l'accesso a entrambi i modelli
26 giugnoIl governo approva il ripristino di Mythos 5 per un gruppo di organizzazioni USA
30 giugnoI controlli sull'export vengono revocati
1° luglioFable 5 torna disponibile globalmente

Al rientro, Fable 5 è di nuovo su Claude Platform, Claude.ai, Claude Code e Claude Cowork. Sui piani Pro, Max, Team e su alcuni Enterprise è stato incluso fino al 50% dei limiti settimanali di utilizzo fino al 7 luglio, dopodiché passa ai crediti a consumo. La riattivazione su AWS, Google Cloud e Microsoft Foundry è stata annunciata come progressiva. Prima del ripristino, Anthropic ha rafforzato le protezioni in ambito cybersecurity lavorando con il governo statunitense, Amazon e altri partner.

Perché conta anche se non usi Fable 5

Perché è il primo caso in cui il rilascio di un modello di frontiera assomiglia meno al lancio di un prodotto e più a un deployment negoziato sotto revisione di sicurezza nazionale. Chi aveva costruito workflow di produzione sopra quel modello si è ritrovato senza accesso da un giorno all'altro, senza preavviso.

La lezione architetturale è concreta: astrarre il provider. Un layer di indirizzamento che permetta di dirottare le pipeline critiche su un modello alternativo, anche self-hosted, non è più una raffinatezza da ingegneri pignoli. È continuità operativa, ed è uno dei temi che affrontiamo quando progettiamo soluzioni di AI e automazioni per i nostri clienti. Che porta direttamente alla seconda notizia.

2. GLM 5.2: il modello open weights che ha cambiato il calcolo

Mentre Fable 5 era offline, l'azienda cinese Z.ai (ex Zhipu AI, spin-off dell'università Tsinghua quotata a Hong Kong a gennaio 2026) ha rilasciato GLM 5.2. Il rollout iniziale è del 13 giugno, con blog ufficiale e pesi su Hugging Face il 16.

La differenza rispetto ai modelli di OpenAI e Anthropic non è nei benchmark: è nel regime di distribuzione. GLM 5.2 è open weights sotto licenza MIT. Chiunque può scaricarlo, farne fine-tuning e servirlo sulla propria infrastruttura.

I numeri

  • Architettura Mixture-of-Experts, circa 750 miliardi di parametri totali con circa 40 miliardi attivi per token (le fonti oscillano tra 744B e 753B)
  • Contesto da 1 milione di token
  • Prezzo API attorno a 1,40 $ / 4,40 $ per milione di token in input/output: circa un sesto delle alternative occidentali
  • Primo modello open weights a superare l'80% su Terminal-Bench
  • Al lancio, primo modello open sull'Intelligence Index di Artificial Analysis, dietro Claude Opus 4.8 e davanti a GPT-5.5 su diverse valutazioni di coding a lungo orizzonte

L'integrazione da parte degli ambienti di sviluppo è stata immediata, con oltre venti tool di coding di terze parti al day one. Il CEO di Vercel ha dichiarato di essere rimasto quasi sbalordito dalla qualità del modello sul codice.

Il punto vero

Non è "un modello cinese forte". È che la capacità di frontiera ha iniziato a diffondersi per un canale che nessun ordine amministrativo può spegnere. La coincidenza temporale con il blocco di Fable 5 è un caso, ma è un caso che dice molto: da una parte una capacità dichiarata troppo rischiosa per un rilascio ampio, dall'altra una capacità comparabile scaricabile da chiunque con una connessione.

Per un'azienda europea, la conseguenza operativa è duplice: un'opzione reale per abbattere i costi su carichi ad alto volume, e un piano B sovrano per i workload che non possono dipendere da un singolo fornitore: una logica non lontana da quella che ci porta a rilasciare software open source. Con un'avvertenza di metodo: molti dei numeri in circolazione arrivano da harness di test diversi, e non sono confrontabili direttamente tra vendor.

3. Anche Claude ha un subconscio? La ricerca sul J-space

Il 6 luglio 2026 Anthropic ha pubblicato una ricerca di interpretabilità: il campo che prova a capire i meccanismi interni degli LLM, che restano in gran parte opachi anche per chi li costruisce. Il titolo divulgativo è A global workspace in language models; il paper tecnico completo, su transformer-circuits.pub, si chiama Verbalizable Representations Form a Global Workspace in Language Models.

L'analogia di partenza è la teoria del global workspace nelle neuroscienze: sistemi specializzati che lavorano in parallelo e quasi tutti in silenzio, e una piccola area condivisa dove l'informazione diventa accessibile e viene ridistribuita al resto del cervello.

Dentro Claude i ricercatori hanno trovato qualcosa di analogo, che chiamano J-space: un piccolo insieme privilegiato di rappresentazioni interne, individuato con un metodo nuovo, il Jacobian lens (J-lens). Le sue caratteristiche:

  • occupa una frazione modesta dell'attività della rete (nell'ordine di pochi punti percentuali della varianza delle attivazioni) e tiene poche dozzine di concetti alla volta;
  • il modello sa riferire cosa contiene;
  • è modulabile: si può iniettare o sostituire un concetto, scambiare "Francia" con "Cina", e vedere il ragionamento a valle cambiare di conseguenza;
  • è causalmente necessario al ragionamento flessibile a più passaggi: ablandolo, le capacità di ragionamento peggiorano;
  • non viene usato per l'elaborazione automatica e fluente, come la grammatica o le classificazioni semplici.

Attenzione al ribaltamento, perché quasi tutta la copertura lo sbaglia: il J-space non è il subconscio di Claude. È l'analogo funzionale dell'accesso consapevole. Il subconscio è tutto il resto: l'oceano di calcolo, largamente maggioritario, di cui il modello non può riferire nulla.

Perché è rilevante fuori dalla ricerca

Perché apre una strada al monitoraggio. Nei test sull'inganno, il J-lens ha fatto emergere concetti interni silenziosi (cose come "finto", "manipolazione") mentre l'output visibile restava perfettamente collaborativo. Tradotto: esiste un canale in cui alcune intenzioni rilevanti per la sicurezza compaiono prima di arrivare in superficie.

Anthropic è stata esplicita su cosa la ricerca non dimostra: non è una prova che Claude abbia esperienza soggettiva. La rivendicazione è più stretta e più utile: un meccanismo funzionale che assomiglia all'accesso cosciente, non la coscienza fenomenica.

Il lavoro è verificabile: il codice del J-lens è stato pubblicato sotto licenza Apache-2.0, c'è una demo interattiva realizzata con Neuronpedia su modelli open weights, e alla pubblicazione sono stati affiancati commenti invitati di ricercatori esterni di neuroscienze, filosofia e interpretabilità: inclusi gli autori della teoria del global workspace.

4. HTTP QUERY: il primo nuovo metodo HTTP in sedici anni

Il 15 giugno 2026 l'IETF ha pubblicato RFC 10008, che definisce il metodo QUERY. È un Proposed Standard sullo Standards Track, ventiquattro pagine, firmato da Julian Reschke (greenbytes), James M. Snell (Cloudflare) e Mike Bishop (Akamai), prodotto dall'HTTP Working Group. È il primo metodo HTTP davvero nuovo da PATCH, che era RFC 5789 nel marzo 2010: sedici anni di distanza.

Il problema che risolve

Ogni backend developer ci è passato. Devi leggere dati con parametri complessi e hai due opzioni, entrambe imperfette.

GET è sicuro, idempotente e cacheable, ma mette tutto nell'URI. E lì i problemi sono quattro, elencati dall'RFC stesso: nessuno conosce in anticipo il limite reale di lunghezza, perché la richiesta attraversa intermediari non coordinati (RFC 9110 raccomanda 8000 ottetti solo come soglia minima); i dati strutturati — filtri annidati, JSON arbitrario — sono scomodi e costosi da codificare in una stringa URI-safe; e gli URI finiscono nei log molto più facilmente dei body, quindi i dati sensibili ci finiscono dentro.

POST risolve il body ma perde le garanzie: niente nel protocollo segnala che l'operazione è di sola lettura, quindi cache e proxy la trattano di conseguenza e nessun retry automatico è sicuro.

Cosa fa QUERY

QUERY chiede al server di elaborare il contenuto della richiesta in modo safe e idempotente e di restituire il risultato. Ha la forma di POST e le garanzie di GET: una richiesta QUERY può essere ripetuta o rilanciata automaticamente senza rischio di modifiche parziali di stato. Ed è esplicitamente cacheable.

QUERY /users HTTP/1.1
Host: example.org
Content-Type: application/json

{ "role": "admin", "sort": "name", "page": 1 }

Non è un rimpiazzo generico di GET: per query corte e semplici l'RFC stesso invita a restare sul metodo tradizionale.

Le tre cose da controllare prima di adottarlo

  1. Cache. QUERY è cacheable, ma la chiave di cache deve includere il body. Cache che normalizzano o hashano il body in modo sbagliato aprono la porta a cache poisoning e cache deception.
  2. Metodi in allowlist. WAF, API gateway, CDN e middleware CSRF hanno policy scritte in termini di GET, POST, PUT, DELETE, PATCH. Le allowlist scritte prima di giugno 2026 non menzionano QUERY: alcuni stack lo rifiuteranno, altri lo instraderanno o lo ispezioneranno diversamente da POST.
  3. Browser e CORS. QUERY non è un metodo CORS-safelisted, quindi il JavaScript nel browser deve fare preflight. Sul supporto: Node.js lo parsa nativamente da inizio 2024, OpenAPI 3.2 lo documenta, Spring non l'ha ancora rilasciato a luglio 2026 e i browser stanno valutando.

Il percorso di rollout sensato è affiancare QUERY a un endpoint di ricerca già basato su POST, annunciarlo tramite l'header Accept-Query e lasciare che i client migrino quando il loro tooling lo supporta. Non renderlo l'unica via d'accesso a un endpoint finché l'infrastruttura non ha recuperato.

Il filo rosso: chi controlla l'accesso

Quattro notizie, una domanda sola.

Fable 5 mostra che l'accesso alla capacità di frontiera può essere revocato per decreto, in un pomeriggio. GLM 5.2 mostra che la stessa capacità, o qualcosa che le somiglia molto, si sta diffondendo per un canale che nessun decreto raggiunge. Il J-space mostra che iniziamo ad avere strumenti per guardare dentro i modelli invece di fidarci del loro output. E RFC 10008 ricorda che le fondamenta su cui gira tutto questo si muovono ancora, con tempi da decennio e processi pubblici.

Per chi costruisce software la traduzione è pratica, e sono tre voci. Astrarre il fornitore di modelli, perché la dipendenza da un singolo endpoint ora è anche un rischio normativo. Investire in osservabilità, perché la fiducia in un sistema che non si può ispezionare non è una strategia. E leggere gli standard, perché la soluzione elegante al problema che stai aggirando da anni a volte esiste già, in un RFC pubblicato il mese scorso.

Domande frequenti

Perché Claude Fable 5 è stato sospeso? Il 12 giugno 2026 il governo statunitense ha imposto un ordine di export control sui modelli Fable 5 e Mythos 5, dopo un report di ricercatori Amazon che mostrava come aggirare i safeguard del modello per fargli identificare vulnerabilità software. L'ordine imponeva di limitare l'accesso ai non cittadini statunitensi; non potendo verificare la nazionalità in tempo reale, Anthropic ha sospeso l'accesso per tutti.

Fable 5 è di nuovo disponibile? Sì. I controlli sull'export sono stati revocati il 30 giugno 2026 e Fable 5 è tornato disponibile globalmente dal 1° luglio su Claude Platform, Claude.ai, Claude Code e Claude Cowork. Mythos 5 resta invece limitato a un gruppo di organizzazioni statunitensi approvate.

Che differenza c'è tra Fable 5 e Mythos 5? Condividono lo stesso modello di base. Fable 5 è stato rilasciato con safeguard più forti per l'uso generale, mentre Mythos 5 ne ha meno ed è riservato a un piccolo numero di partner selezionati del programma Project Glasswing per attività di cybersecurity difensiva.

Cosa significa che GLM 5.2 è open weights? Che i pesi del modello sono pubblicamente scaricabili, nel caso di GLM 5.2 sotto licenza MIT su Hugging Face, e che chiunque può eseguirlo sulla propria infrastruttura, farne fine-tuning o servirlo come provider. È diverso dai modelli di OpenAI e Anthropic, accessibili solo via API.

GLM 5.2 è meglio di Claude Opus 4.8? No. Sulle valutazioni di coding a lungo orizzonte GLM 5.2 resta dietro Opus 4.8, pur superando GPT-5.5 su diverse di esse. Il suo vantaggio è il rapporto tra qualità, costo, circa un sesto, e libertà di deployment.

Cos'è il J-space di Claude? Un piccolo insieme privilegiato di rappresentazioni interne, individuato dalla ricerca Anthropic del 6 luglio 2026 tramite un metodo chiamato Jacobian lens. Il modello riesce a riferire cosa contiene, lo si può modificare dall'esterno e serve al ragionamento flessibile a più passaggi. Non è il chain of thought, che è testo prodotto in output.

La ricerca sul global workspace dimostra che Claude è cosciente? No, e Anthropic lo esclude esplicitamente. La rivendicazione è che esiste un meccanismo funzionale che assomiglia all'accesso consapevole, cioè al fatto che alcune informazioni siano disponibili per il ragionamento e la riferibilità, non che il modello abbia esperienza soggettiva.

Cos'è il metodo HTTP QUERY? Un metodo HTTP definito da RFC 10008, pubblicato dall'IETF il 15 giugno 2026, che permette di inviare una richiesta con un body come POST mantenendo le garanzie di GET: safe, idempotente e cacheable. Serve per query di lettura complesse che non stanno comodamente in una query string.

Qual è stato l'ultimo nuovo metodo HTTP prima di QUERY? PATCH, definito da RFC 5789 nel marzo 2010. Tra i due ci sono sedici anni.

Posso usare QUERY in produzione oggi? Con cautela e non come unico accesso a un endpoint. Node.js lo parsa nativamente e OpenAPI 3.2 lo documenta, ma il supporto di browser, proxy, WAF e framework è ancora disomogeneo. L'approccio consigliato è affiancarlo a un endpoint POST esistente e annunciarlo con l'header Accept-Query.

Fonti

  1. Anthropic: Redeploying Claude Fable 5
  2. Anthropic: Claude Fable 5 and Claude Mythos 5
  3. Anthropic: Fable and Mythos access
  4. CNBC: Anthropic says Trump admin has lifted export controls on Claude Fable 5 and Mythos 5
  5. Z.ai: GLM 5.2
  6. Artificial Analysis: scheda GLM 5.2
  7. VentureBeat: Z.ai's open-weights GLM-5.2 beats GPT-5.5 on multiple long-horizon coding benchmarks
  8. Anthropic: A global workspace in language models
  9. IETF: RFC 10008: The HTTP QUERY Method
  10. IETF Datatracker: RFC 10008

Ti abbiamo incuriosito?

Se avete un problema, un'idea o solo curiosità: parliamone. Mezz'ora, senza impegno.

Scrivici

Articoli correlati