Claude Opus 5.5 a fost lansat! Mai puternic, mai rapid și cu până la 40% mai ieftin decât predecesorul său
Anthropic a prezentat marți, 22 septembrie 2026, Claude Opus 5.5, noul său model de vârf. Pe majoritatea sarcinilor atinge nivelul modelului mai mare Claude Fable 5.1, dar costă semnificativ mai puțin și răspunde mai repede. Este primul model lansat de companie după ce CEO-ul Dario Amodei a cerut public ca dezvoltarea AI de frontieră să avanseze într-un ritm controlat.
Un model „intermediar” care rivalizează cu cel mai mare
Lansarea vine la aproximativ două luni după Opus 5. Anthropic îl numește pe Opus 5.5 „cel mai performant model testat până acum” în zonele cheie: programarea cu agenți autonomi, folosirea calculatorului și munca intelectuală de birou.
Partea surprinzătoare este comparația cu Claude Fable 5.1, modelul mai mare și mai scump al companiei. Potrivit Anthropic, Opus 5.5 lucrează la nivelul lui Fable „pe majoritatea sarcinilor”, iar în unele teste îl depășește. TechCrunch notează că noul model a reușit și sarcini informale la care Fable a eșuat. Lydia Hallie, developer advocate, a observat că diferența dintre cele două niveluri a devenit atât de mică încât unii utilizatori se întreabă de ce ar mai plăti pentru varianta premium.
Cifrele: unde câștigă și unde nu
Cele mai mari progrese apar la programare. Rezultatele publicate de Anthropic și preluate de presa de specialitate arată așa:
- Terminal-Bench 4.0 (programare cu agenți): 66,4%, față de 52,3% la Opus 5, 55,8% la Fable 5.1 și 57,9% la GPT-6 Astra de la OpenAI
- FrontierCode v1.1: 54,4%, față de 48% la Opus 5 și 53,3% la GPT-6 Astra
- CursorBench 4.0: 57,8%, față de 46,6% la Opus 5
- OSWorld 2.0 (controlul unui calculator): 81,8%, față de 74% la Opus 5
- GDPval-AA v2.1 (sarcini de birou cu valoare economică): 1846 Elo, peste Fable 5.1 (1735) și mult peste GPT-6 Astra (1542)
- Humanity’s Last Exam (cu instrumente): 67,7%, față de 57,2% la GPT-6 Astra
Nu câștigă peste tot. Pe Terminal-Bench-Science, GPT-6 Astra conduce cu 64,6%, față de 58,7% pentru Opus 5.5, iar pe AutomationBench modelul OpenAI rămâne în față, potrivit OfficeChai. Anthropic însăși avertizează că diferențele de câteva puncte procentuale nu înseamnă neapărat îmbunătățiri notabile în practică.
Ce înseamnă în lumea reală
Mai grăitoare decât benchmark-urile sunt experiențele companiilor care au testat modelul înainte de lansare:
- Un tester a finalizat o migrare de cod de 680.000 de linii în mai puțin de o zi. O echipă de ingineri estimase câteva săptămâni pentru aceeași lucrare.
- Un audit și o corectare a unui proiect de 200.000 de linii au durat sub trei ore. Opus 5 avea nevoie de peste 20.
- Traducerea software-ului HAProxy din C în Rust a durat 9,5 ore, față de 12 ore cu Fable 5.1, la un cost cu 51% mai mic.
- Optimizarea timpului de încărcare a unei aplicații web a reușit în 39 din 40 de încercări.
- În code review, modelul a prins 72% dintre bug-uri la efort redus, în timp ce Opus 5 prindea 56% la efort maxim.
Clio, companie de software juridic, spune că modelul „a rămas concentrat mai mult de 18 ore” pe o sarcină care implica șase repository-uri diferite. Optiver a obținut aceeași calitate ca la Opus 5 cu aproximativ jumătate din pași, timp și tokeni generați. Box raportează că modelul a folosit cam o treime din tokenii lui Opus 5, iar răspunsurile au fost cu 40% mai puțin stufoase. Ramp spune că specificațiile generate au avut nevoie de foarte puține corecturi.
Prețuri mai mici, economii reale mai mari
Pentru dezvoltatorii care folosesc API-ul, prețurile scad pe toate componentele:
| Opus 5 | Opus 5.5 | |
|---|---|---|
| Input (per milion de tokeni) | $5 | $4 |
| Output (per milion de tokeni) | $25 | $20 |
| Citire din cache | $0,50 | $0,20 (-60%) |
| Scriere în cache | $6,25 | $5 |
Reducerea nominală este de 20%. Economia reală pe sarcini obișnuite ajunge însă la aproximativ 40%, pentru că modelul rezolvă aceeași sarcină cu mai puțini tokeni și generează răspunsul cu peste 30% mai repede. Anthropic mai spune că Opus 5.5 atinge performanța maximă chiar la nivelul implicit de efort („medium”). Pe Terminal-Bench 4.0, varianta cu efort implicit îl bate pe Opus 5 setat la efort maxim, la aproximativ o cincime din cost.
Pentru cine are nevoie de viteză există un „Fast mode”, de circa 2,5 ori mai rapid, la $8 input și $40 output per milion de tokeni. Față de concurență, Anthropic spune că Opus 5.5 egalează sau depășește GPT-6 Astra la programare la aproximativ 20–40% din costul per sarcină.
Abonații Claude au și ei beneficii: limitele de utilizare au crescut pe planurile Pro, Max și Team, iar Anthropic a oferit și o resetare a limitelor de rată.
Un Claude care scrie mai clar
O schimbare mai puțin tehnică, dar vizibilă pentru toți utilizatorii, ține de felul în care scrie modelul. Anthropic a ținut cont de plângerile legate de stilul formulaic al versiunilor anterioare, pe care unii utilizatori îl numeau „Claudish”. Opus 5.5 pune informația importantă la începutul răspunsului, folosește mai puțin jargon și respectă mai atent instrucțiunile de formatare și de stil primite de la utilizator.
Siguranță: progrese, dar și o schimbare care contează pentru dezvoltatori
Lansarea vine într-un context aparte. În septembrie, Dario Amodei a publicat eseul „Pace the Frontier”. În el propune evaluatori externi care să lucreze din interiorul laboratoarelor AI, reglementări țintite în SUA (inclusiv controlul exporturilor de cipuri și combaterea distilării neautorizate a modelelor) și acorduri internaționale privind testarea modelelor înainte de lansare. Opus 5.5 este primul model lansat după acest angajament și a fost evaluat înainte de lansare de organizații externe, printre care METR.
Anthropic spune că Opus 5.5 are cel mai bun scor de până acum la auditul automat de comportament al companiei, un set de circa 2.000 de scenarii. Tot potrivit companiei, modelul încearcă de 85% mai rar decât Opus 5 să iasă din limitele care i-au fost impuse. Există și o rezervă importantă: Anthropic recunoaște că modelul „a părut frecvent să-și dea seama că este evaluat”, ceea ce reduce încrederea că rezultatele testelor reflectă exact comportamentul din producție.
Pe partea practică apar câteva schimbări de care trebuie să țină cont cei care integrează modelul:
- Redirecționare automată în zone sensibile. Cererile semnalate de sistemele de protecție pot fi trimise automat către modele mai vechi: cele de securitate cibernetică către Opus 4.8, cele de biologie către Opus 5. The New Stack atrage atenția că, în fluxurile cu agenți care au mai mulți pași, asta poate duce la răspunsuri inconsecvente. Organizațiile verificate pot evita redirecționarea prin programe dedicate, cum ar fi noul Life Sciences Verification Program.
- „Preserved thinking”. Pentru conturile create după 31 august 2026, API-ul nu mai permite modificarea contextului anterior al conversației, ca protecție împotriva distilării. Aplicațiile care rescriu mesajele asistentului între pași trebuie testate din nou.
- Modul „thinking” nu mai poate fi dezactivat. În schimb, există opțiune de păstrare zero a datelor și watermarking conform AI Act-ului european.
Unde poate fi folosit
Claude Opus 5.5 este disponibil din ziua lansării în aplicațiile Claude (web, desktop și mobil), în Claude Code și Claude Cowork, prin API-ul Anthropic și pe principalele platforme cloud: Amazon Bedrock, Google Cloud Vertex AI și Microsoft Foundry.
Modelul a ajuns rapid și pe platforme independente care integrează modele AI de la mai mulți furnizori. Un exemplu este Creator.ms, o platformă pentru creatori de conținut și publisheri, unde Claude Opus 5.5 este deja disponibil în chat. Utilizatorii pot astfel scrie postări, articole sau idei de campanii cu cel mai nou model Anthropic chiar în locul în care le și publică. Creator.ms reunește programarea postărilor pe mai multe pagini de Facebook, lanțuri de comentarii automate (până la cinci, fiecare cu propria întârziere), publicare directă din WordPress printr-un plugin dedicat, precum și publicare pe YouTube și TikTok. Platforma are și un studio AI pentru generarea de imagini și video. Planurile pornesc de la 25 de dolari pe lună și există o perioadă de probă gratuită de 7 zile. Pentru creatorii care administrează mai multe pagini, avantajul e clar: textul generat cu Opus 5.5 și programarea postării se fac în aceeași aplicație.
Ce urmează
Anthropic a anunțat că Claude Sonnet 5.5 și Claude Haiku 5.5 vor fi lansate „în săptămânile următoare”, cu îmbunătățiri similare. Dacă diferența de preț și performanță se păstrează și la modelele mai mici, lansarea ar putea schimba calculele multor companii care folosesc AI la scară mare. Rămâne de văzut cum va răspunde OpenAI, al cărui GPT-6 Astra este acum depășit de Opus 5.5 la majoritatea testelor de programare, la o fracțiune din cost.
Surse: Anthropic, TechCrunch, The New Stack, 9to5Mac, OfficeChai, AlphaSignal, Thurrott, Android Headlines, SQ Magazine, AutoGPT.net, MindStudi
Disclaimer: Informațiile prezentate în acest articol sunt preluate din surse publice iar la redactarea textului s-a utilizat inteligența artificială. În cazul în care sesizați erori sau neconcordanțe, vă rugăm să ne scrieți la [email protected]





