Claude conduce 26% din cercetarea AI a Anthropic
Claude a trecut într-o nouă etapă în dezvoltarea inteligenței artificiale la Anthropic: în august 2026, modelul conducea deja 26% din activitatea de cercetare și dezvoltare AI a companiei, după ce procentul era sub 1% în februarie. Datele Anthropic arată că AI poate prelua cea mai mare parte a unor sarcini complexe necesare construirii viitoarelor modele, însă cercetătorii umani continuă să supravegheze procesul, iar Claude nu funcționează încă autonom.

Claude, sistemul de inteligență artificială dezvoltat de Anthropic, conducea în august 2026 aproximativ 26% din activitatea de cercetare și dezvoltare AI a companiei, față de mai puțin de 1% în februarie. Modelul poate realiza cea mai mare parte a unor sarcini pornind de la o instrucțiune generală, însă lucrează în continuare sub supraveghere umană și nu a ajuns la autonomie completă.
Datele apar într-un nou set de indicatori publicat de Anthropic pentru a măsura cât de mult contribuie AI la dezvoltarea viitoarelor modele, cum sunt supravegheați agenții autonomi și ce parte din puterea de calcul pentru cercetare este alocată siguranței.
Rezultatele marchează o schimbare importantă în modul în care sunt construite modelele de frontieră: AI nu mai este folosit doar ca instrument punctual de programare sau analiză, ci poate prelua aproape integral anumite sarcini complexe din procesul de cercetare.
Claude conduce deja 26% din activitatea R&D
Anthropic a construit un indicator intern, „Anthropic R&D Automation Index”, care urmărește gradul de automatizare a activităților implicate în dezvoltarea modelelor sale.
Compania folosește o scară cu șase niveluri, de la AL0, unde AI nu este implicat, până la AL5, unde sistemul funcționează complet autonom, fără intervenție umană.
Claude a ajuns la nivelul AL4 — „AI leads” — pentru 26% din activitatea de cercetare și dezvoltare AI analizată în august 2026.
La acest nivel, sistemul poate primi o instrucțiune generală și poate realiza cea mai mare parte a sarcinii de la început până la sfârșit, în timp ce cercetătorul uman supraveghează procesul.
Creșterea s-a produs în numai câteva luni. În februarie 2026, mai puțin de 1% din activitatea analizată se afla la acest nivel.
În plus, peste 90% din cercetarea și dezvoltarea AI a Anthropic ajunsese cel puțin la nivelul „AI collaborates”, în care Claude realizează segmente importante ale unei sarcini sub coordonarea directă a oamenilor.
Claude nu își construiește singur succesorul
Cifra de 26% poate crea impresia că Claude dezvoltă deja autonom următoarele generații Claude. Datele Anthropic arată însă o situație mai nuanțată.
Compania precizează că modelul nu operează complet autonom în niciuna dintre categoriile de cercetare și dezvoltare măsurate.
Nivelul maxim al scalei, AL5, ar presupune ca AI să poată desfășura activitatea fără ca un om să mai fie implicat în proces. Claude nu a ajuns la acest prag.
Diferența este importantă: un sistem care „conduce” o sarcină poate executa cea mai mare parte a acesteia pornind de la o cerință generală, dar cercetătorul continuă să supravegheze activitatea.
💡 WoW Pulse | Își construiește Claude singur următoarea versiune?
Nu. Datele Anthropic arată că Claude poate conduce deja o parte importantă a sarcinilor folosite pentru dezvoltarea modelelor AI, dar oamenii rămân implicați. Compania nu a identificat nicio categorie măsurată în care Claude să funcționeze la nivelul maxim de autonomie.
Aproximativ 30.000 de agenți AI lucrează simultan
Raportul oferă și o imagine asupra dimensiunii infrastructurii interne bazate pe agenți AI.
În august 2026, Anthropic avea aproximativ 30.000 de agenți care desfășurau simultan activități de cercetare și inginerie pe cea mai utilizată platformă internă a companiei.
Cifra se referă exclusiv la platforma analizată de Anthropic, nu la toate sistemele sau produsele companiei.
Agenții pot lucra semi-autonom pentru perioade îndelungate și pot delega activități altor agenți. Tocmai această autonomie mai mare a determinat compania să dezvolte mecanisme prin care acțiunile lor să poată fi monitorizate și, atunci când este necesar, blocate.
Pentru platforma analizată, Anthropic afirmă că 100% dintre acțiunile agenților trec printr-un sistem de monitorizare în timp real înainte de executare. Activitatea este analizată și ulterior de un al doilea sistem.
Peste un miliard de decizii analizate într-o lună
Volumul de activitate este semnificativ.
În august 2026, Anthropic a analizat peste un miliard de decizii luate de agenții săi de cercetare și inginerie.
Dintre acestea, aproximativ 0,002% au fost blocate de sistemul de monitorizare, echivalentul unei decizii din aproximativ 47.000.
Separat, monitorizarea realizată după executarea acțiunilor semnalează pentru verificări suplimentare aproximativ una sau două transcrieri din fiecare 1.000.
Sistemele automate filtrează apoi aceste cazuri. Aproximativ 50 de semnalări cu prioritate ridicată pe săptămână sunt escaladate pentru verificare umană.
Procentul redus de acțiuni blocate nu reprezintă, în sine, o măsură a siguranței generale a modelelor. Indicatorul descrie comportamentul observat și intervențiile sistemelor de monitorizare pe platforma internă analizată.
Cum a calculat Anthropic nivelul de automatizare
Pentru construirea indicelui, Anthropic a analizat activitatea echipelor implicate în cercetarea și dezvoltarea modelelor.
În fiecare săptămână din iulie 2026, compania a selectat aleatoriu 20% dintre angajații departamentelor implicate în acest proces. Un agent Claude a analizat activitatea acestora din documentația internă și Slack.
Procesul a produs o listă de aproximativ 15.000 de sarcini individuale de cercetare și dezvoltare.
Claude a organizat ulterior activitățile într-o structură cu 542 de categorii și subcategorii, dintre care 378 reprezintă tipuri concrete de activitate.
Un alt sistem Claude a evaluat dovezile și a atribuit fiecărei categorii unul dintre cele șase niveluri de automatizare.
Anthropic a comparat rezultatele și cu evaluări făcute de propriii angajați. Modelul și evaluatorii umani au acordat exact același nivel în 59% dintre cazuri, iar în 97% dintre cazuri diferența dintre evaluări nu a depășit un nivel.
Metodologia are însă o limitare relevantă chiar pentru interpretarea procentului de 26%: Anthropic își folosește propriile modele pentru a evalua nivelul de automatizare al propriilor activități.
Compania intenționează să ofere unor evaluatori externi acces la procese, sisteme și date interne pentru verificarea unor astfel de indicatori.
6% din puterea de calcul pentru R&D a fost alocată siguranței
Anthropic a analizat separat modul în care a utilizat puterea de calcul în perioada 13–20 iulie 2026.
În acea săptămână, aproximativ 6% din resursele de calcul destinate cercetării și dezvoltării AI au fost alocate activităților clasificate drept muncă pentru siguranță.
Dacă sunt luate în calcul doar activitățile de cercetare AI realizate cu ajutorul AI, proporția ajunge la aproximativ 12%.
Compania consideră aceste estimări conservatoare și avertizează că puterea de calcul nu reflectă perfect efortul dedicat siguranței. Unele activități necesită mult timp din partea cercetătorilor, dar relativ puține resurse de calcul.
Miza următoare: „recursive self-improvement”
Anthropic leagă evoluția acestor indicatori de o problemă mai amplă pentru industria inteligenței artificiale: posibilitatea ca modelele să ajungă să automatizeze dezvoltarea propriilor succesori.
Compania folosește termenul de „recursive self-improvement” pentru situația în care un model ar putea construi complet autonom modelul care îi urmează.
Datele din august 2026 nu arată că acest prag a fost atins. Dimpotrivă, Anthropic precizează că Claude nu este complet autonom în niciuna dintre activitățile de cercetare și dezvoltare măsurate.
Ele arată însă cât de repede se modifică rolul AI în interiorul unui laborator de frontieră: în numai șase luni, proporția activităților în care Claude poate conduce cea mai mare parte a unei sarcini a crescut de la mai puțin de 1% la 26%.
📌 Citește și pe WoW Pulse


