Anthropic a lansat Claude Sonnet 5.5, al doilea model din familia Claude 5.5, despre care spune că generează răspunsuri cu peste 30% mai rapid decât Sonnet 5. Anunțat pe 28 septembrie, modelul păstrează tarifele predecesorului, dar poate reduce costul unei sarcini cu până la 30%, datorită unui consum mai mic de tokenuri.
Compania îl poziționează ca alternativă mai rapidă și mai accesibilă la Opus 5.5 pentru activități cotidiene bine delimitate, corectarea erorilor de programare și realizarea documentelor, prezentărilor și foilor de calcul. Opus 5.5 rămâne opțiunea recomandată de Anthropic pentru proiecte complexe, deschise, care necesită evaluări și decizii susținute.
Claude Sonnet 5.5 progresează la programare și lucru cu documente
În rezultatele publicate de Anthropic, Sonnet 5.5 obține 70,6% în Terminal-Bench 4.0, o evaluare a sarcinilor executate de agenți AI în terminal, față de 10,3% pentru Sonnet 5. Pe CursorBench 4.0, construit în jurul unor sarcini din sesiuni reale de programare, scorul crește de la 34,1% la 55,5%, apropiindu-se de cele 57,8% obținute de Opus 5.5.
În GDPval-AA, care testează activități profesionale din 44 de ocupații și nouă industrii, noul model ajunge la 1.844 de puncte, față de 1.449 pentru Sonnet 5 și 1.846 pentru Opus 5.5. Anthropic subliniază însă că benchmark-urile surprind doar o parte a capacităților unui model.
Un nivel mai ridicat de efort nu garantează nici el un rezultat mai bun. În FrontierCode, Sonnet 5.5 obține 52,1% la setarea Xhigh și 46,2% la Max, unde unele evaluări au fost penalizate pentru depășirea timpului disponibil sau modificări în afara sarcinii cerute.

Slack se numără printre companiile care au testat modelul înainte de lansare.
„Fără să modificăm niciunul dintre prompturile noastre, Claude Sonnet 5.5 a avut rezultate mai bune decât Sonnet 5 în aproape toate evaluările noastre offline pentru Slackbot, în mai puțini pași și cu aproximativ 14% mai puține tokenuri de ieșire. Când cineva îi încredințează o sarcină lui Slackbot, calitatea și viteza contează cel mai mult, iar Sonnet 5.5 îi permite să ofere utilizatorilor rezultate mai bune, mai repede”, a declarat Curtis Allen, Principal Engineer la Slack.
Aceleași tarife, consum mai mic
Prețurile sunt de 2 dolari pentru un milion de tokenuri de intrare și 10 dolari pentru un milion de tokenuri de ieșire. Citirea din cache costă 0,20 dolari pentru un milion de tokenuri, iar scrierea în cache, 2,50 dolari.
Reducerea de până la 30% invocată de Anthropic privește costul efectiv al unei sarcini, nu tariful unitar. Modelul are nevoie, de regulă, de mai puține tokenuri pentru aceeași activitate.
În aplicațiile Claude și în Claude Code, nivelul implicit de efort este Medium, în timp ce Claude Platform folosește High. Setările inferioare favorizează viteza și consumul redus, iar cele superioare alocă mai mult timp raționamentului și verificării rezultatelor.
Protecții suplimentare pentru securitate cibernetică
Sonnet 5.5 este primul model Sonnet lansat cu protecții de securitate cibernetică similare celor aplicate modelelor mai capabile ale companiei. Solicitările considerate cu risc ridicat sunt transferate către Sonnet 5, schimbare semnalată utilizatorului, în timp ce identificarea și repararea obișnuită a erorilor software rămân disponibile.
Anthropic spune că auditul automatizat, care acoperă aproximativ 1.850 de scenarii, arată rezultate egale sau mai bune decât Sonnet 5 pentru majoritatea indicatorilor de aliniere, sinceritate și rezistență la utilizări abuzive. Compania precizează că evaluările nu pot identifica toate problemele posibile.
Claude Sonnet 5.5 este disponibil pe platformele companiei și prin Amazon Web Services, Google Cloud și Microsoft Azure, inclusiv cu opțiunea de retenție zero a datelor. Familia urmează să fie completată în săptămânile următoare de Haiku 5.5, destinat aplicațiilor cu volume mari și cerințe stricte de cost.