OFFERTE TECH
Cerca

Cerca nel magazine

Che cosa vuoi approfondire?

News

Anthropic presenta Claude Fable 5.1: l’IA pensata per i lavori più complessi

Claude AI
Foto iammottakin © 123RF.com

Anthropic amplia la propria offerta di intelligenza artificiale con Claude Fable 5.1 e Claude Mythos 5.1, due versioni basate sullo stesso modello ma caratterizzate da differenti livelli di protezione. La prima è destinata alla distribuzione generale, mentre la seconda viene riservata ad alcune organizzazioni selezionate che operano in settori particolarmente delicati.

Il nuovo Claude Fable 5.1 punta soprattutto sulla programmazione, sulla ricerca e sulle attività professionali composte da numerosi passaggi. Accanto alla crescita delle prestazioni emerge anche un altro elemento importante: una maggiore efficienza economica, soprattutto quando il modello deve riutilizzare grandi quantità di informazioni già elaborate.

Un modello progettato per lavorare a lungo

Uno degli obiettivi principali di Fable 5.1 riguarda le attività agentiche complesse. Il modello è stato sviluppato per portare avanti progetti che richiedono diverse ore di lavoro, l’impiego coordinato di più strumenti e la capacità di reagire agli errori incontrati durante il percorso.

L’aggiornamento dovrebbe permettere a Claude di cercare con maggiore precisione l’origine di un problema, evitando di fermarsi alle soluzioni più immediate. I miglioramenti interessano anche la scrittura di codice, la produzione di documenti, le ricerche articolate e l’interpretazione di grafici, tabelle e altri elementi visivi.

Sul piano tecnico, la finestra di contesto raggiunge un milione di token, mentre la risposta generata può arrivare fino a 128.000 token. Sono valori che consentono di gestire documenti molto estesi, grandi quantità di codice e conversazioni particolarmente lunghe senza perdere facilmente le informazioni iniziali.

L’adaptive thinking rimane sempre attivo. Gli sviluppatori possono comunque utilizzare il parametro “effort” per stabilire quanta elaborazione affidare al modello, trovando un equilibrio tra qualità del risultato, velocità di esecuzione e costi.

I benchmark mostrano un miglioramento evidente

Secondo i test pubblicati da Anthropic, il salto rispetto alla generazione precedente appare particolarmente marcato. Nel Terminal-Bench-Science 0.1, dedicato alla ricerca scientifica svolta con un approccio agentico, Fable 5.1 raggiunge il 52,6%. Il precedente Fable 5 si fermava al 24,7%, mentre Opus 5 otteneva il 29%.

Anche nel Terminal-Bench 4.0, maggiormente orientato alla programmazione, il nuovo modello sale al 55,8%, contro il 42% del predecessore. In questo caso riesce a superare anche Opus 5, che raggiunge il 52,3%. La versione Mythos 5.1 arriva invece al 60,9%.

Nel test GDPval-AA v2, pensato per valutare le capacità legate al lavoro professionale, Fable 5.1 ottiene 1.853 punti. Il risultato supera sia i 1.723 punti di Fable 5 sia i 1.824 registrati da Opus 5. Si tratta comunque di dati prodotti e diffusi dalla stessa Anthropic, quindi risultano particolarmente utili per osservare l’evoluzione interna della famiglia Claude.

Il vero risparmio arriva dalla cache

I prezzi nominali restano invariati rispetto alla generazione precedente. L’utilizzo costa 10 dollari per ogni milione di token in ingresso e 50 dollari per la stessa quantità in uscita. La novità più significativa riguarda invece la lettura delle informazioni conservate nella cache.

Il costo scende a 0,25 dollari per milione di token, con una riduzione del 75% rispetto a Fable 5. Anche la Batch API offre tariffe più contenute, pari a 5 dollari per l’input e 25 dollari per l’output.

Secondo le rilevazioni condotte su carichi reali, questa struttura dovrebbe diminuire la spesa complessiva di circa il 25% negli utilizzi più comuni. Il risparmio potrebbe raggiungere il 45% nei flussi agentici complessi, nei quali il sistema consulta ripetutamente una grande quantità di contesto già elaborato.

La riduzione della cache assume quindi un peso concreto per chi utilizza Claude all’interno di progetti lunghi. Un agente che lavora per ore può infatti richiamare documenti, istruzioni e passaggi precedenti molte volte, facendo crescere rapidamente il consumo complessivo.

Protezioni più precise e nuove applicazioni scientifiche

Fable 5.1 e Mythos 5.1 condividono la stessa base tecnologica, ma la seconda versione dispone di protezioni meno restrittive in ambiti come la sicurezza informatica e la ricerca biologica. Anthropic ha comunque affinato anche i controlli presenti nel modello destinato al pubblico.

Le protezioni legate alla cybersecurity dovrebbero intervenire circa il 60% in meno durante le sessioni di Claude Code. Il sistema può inoltre contribuire all’individuazione delle vulnerabilità nel codice sorgente, mentre restano limitate alcune attività riguardanti gli exploit, i test sui file binari e determinate procedure di penetrazione. Nelle normali richieste biologiche e mediche, i falsi positivi sarebbero diminuiti dell’85%.

Le capacità scientifiche sono state sperimentate anche nella progettazione di proteine e nell’ottimizzazione di modelli dedicati alla biologia e alla genomica. Fable 5.1 ha inoltre contribuito a elaborare una nuova mappa altimetrica di circa un terzo della superficie di Venere, portando la risoluzione dai precedenti 10-20 chilometri a circa 2-3 chilometri.

Un’ulteriore novità riguarda il watermark invisibile inserito nei modelli Claude pubblicati dopo il 2 agosto 2026. Questo sistema permette di stimare la probabilità che un testo sia stato generato dall’intelligenza artificiale senza includere dati relativi agli utenti o alle loro conversazioni.

Claude Fable 5.1 è già disponibile attraverso Claude, le API per sviluppatori e diversi servizi cloud. Nell’interfaccia principale può essere utilizzato con i piani Pro, Max, Team ed Enterprise, mentre Mythos 5.1 rimane accessibile soltanto attraverso programmi verificati rivolti a organizzazioni selezionate.

Scorri per continuare con l’articolo successivo