Claude Opus 5 und Fable 5.1 im Vergleich

Claude Opus 5 e Fable 5.1 a confronto

Anthropic ha rinnovato due modelli nel giro di poche settimane. Claude Opus 5 ha sostituito Opus 4.8 allo stesso prezzo e Claude Fable 5.1 resta il modello di punta, diventando più economico da far girare. Su ChatX, Fable costa ormai circa due volte e mezzo Opus. Questo articolo mette in fila i numeri e riassume che cosa raccontano gli utenti dopo le prime settimane. Alla fine trovi quando conviene ciascun modello.

Opus 5 rende di più allo stesso prezzo

Claude Opus 5 costa quanto Opus 4.8 e nei test di Anthropic lo supera nettamente. Su Frontier-Bench, una prova di programmazione impegnativa, Opus 5 raddoppia il risultato del predecessore con un costo minore per compito risolto. Su ARC-AGI 3, una prova di problem solving astratto, arriva al triplo del secondo modello migliore. Anche nei test con molti passaggi intermedi batte il precedente Fable 5 con circa un terzo dello sforzo.

Per il lavoro quotidiano significa:

  • Ricerca di errori in codice esteso: Opus 5 verifica e ripete i propri passaggi invece di tirare a indovinare dopo il primo insuccesso. Compiti su cui Opus 4.8 si arrendeva ora arrivano in fondo.
  • Analisi lunghe: su molti turni il modello resta sull’obiettivo e non perde di vista la domanda iniziale.
  • Rapporto qualità-prezzo: per la maggior parte dei compiti impegnativi, su ChatX Opus è il modello con il miglior rapporto tra risultato e token, davanti a Sol e a Fable.

Fable 5.1 costa di più, ma serve di rado

Claude Fable 5.1 è arrivato tre mesi dopo Fable 5. Il prezzo base resta uguale, ma rileggere input già elaborati costa il 75 per cento in meno. Nelle conversazioni lunghe, dove lo stesso contesto viene riletto in continuazione, questo abbassa i costi in modo evidente.

Sale anche la resa. Su Terminal-Bench-Science, una prova di compiti scientifici a molti passaggi, il risultato raddoppia dal 24,7 al 52,6 per cento. Sul test di programmazione Terminal-Bench 4.0 si passa dal 42,0 al 55,8 per cento. Anthropic cita come esempio un crash raro la cui causa né gli sviluppatori né altri modelli avevano trovato in anni. Fable 5.1 l’ha trovata. La variante Mythos 5.1, con protezioni allentate, è accessibile solo a organizzazioni statunitensi verificate.

Su ChatX, Fable 5.1 è disponibile per gli utenti registrati ed è ora incluso nell’abbonamento. A differenza di Opus lavora senza ricerca web.

Che cosa dicono gli utenti dopo le prime settimane

I riscontri su Opus 5 sono contrastanti, anche se chi lo prova lo colloca quasi all’unanimità tra i migliori modelli disponibili. Viene lodata la forza sui compiti ben definiti. Vengono criticati il tono, prolisso, prudente e a volte troppo incline a fare domande di ritorno, e l’attesa più lunga della prima risposta con profondità alta. Alcuni sviluppatori trovano Opus 5 meno piacevole di Opus 4.8 nel dialogo, anche quando i risultati sono migliori.

Coincide con quello che vediamo su ChatX. Con domande brevi e profondità alta, la prima risposta impiega diversi secondi senza migliorare. Sui compiti di lavoro ben delimitati, invece, la differenza rispetto a Opus 4.8 si vede subito.

Impostare bene la profondità di pensiero

Su ChatX l’impostazione si chiama «Profondità di pensiero» con i livelli Disattivato, Bassa, Media e Alta. Aggiornamento del 24 settembre 2026: Opus 5 è stato nel frattempo sostituito da Claude Opus 5.5. Lì il ragionamento non si può più spegnere, restano Bassa, Media e Alta, con Bassa come punto di partenza. Anche Fable 5.1 non ha un «Disattivato».

  • Conversazione, testi, domande: usa il livello più basso disponibile. Più veloce e più economico. Il tono diventa più asciutto.
  • Codice e analisi: Opus su «Bassa» o «Media». «Alta» solo quando il compito ammette più soluzioni.
  • Quando Opus si blocca: ripeti lo stesso compito con Fable 5.1 su «Media». È il caso in cui il prezzo molto più alto si giustifica. Come modello predefinito, Fable è sovradimensionato.
  • Testi di tutti i giorni: Haiku 4.5 e Sonnet 5 restano la scelta più veloce ed economica.

I benchmark danno la direzione. Se la differenza conti nel tuo caso lo dimostra prima una prova con un compito reale che qualsiasi tabella.


Posted

in

by

Tags: