Pereiti prie pagrindinio turinio
Skip to content
„Claude“ jau pats vadovauja 26 proc. savo kūrimo darbų: DI pradeda kurti savo įpėdinį

Dirbtinio intelekto „Claude“ vaidmens kuriant naujus „Anthropic“ DI modelius iliustracija

„Claude“ jau pats vadovauja 26 proc. savo kūrimo darbų: DI pradeda kurti savo įpėdinį

Dirbtinis intelektas jau ne tik atsakinėja į klausimus ar rašo programinį kodą – jis vis aktyviau dalyvauja kuriant naujas savo paties versijas. „Anthropic“ atskleidė, kad 2026 m. rugpjūtį jos modelis „Claude“ vadovavo 26 proc. bendrovės dirbtinio intelekto tyrimų ir plėtros darbų, o daugiau kaip 90 proc. šių darbų bent jau bendradarbiavo su žmonėmis. Vis dėlto bendrovė pabrėžia: nė vienoje vertintoje darbų srityje „Claude“ dar neveikia visiškai savarankiškai.

REKLAMA

Šie duomenys pateikti „Anthropic“ paskelbtoje DI kūrimo tempo matavimo apžvalgoje. Joje bendrovė pirmą kartą detaliau parodo, kiek pačios naujų modelių kūrimo grandinės jau patikėta DI, kaip prižiūrimi agentai ir kokie ištekliai naudojami jų plėtrai. Tai svarbu ne vien „Anthropic“: kuo daugiau modelių kūrimo darbo atlieka DI, tuo greičiau potencialiai gali vykti ir tolesnė technologijos pažanga.

Palyginimui, vasarį „Claude“ vadovaujamo darbo dalis nesiekė nė 1 proc. Vos per pusmetį ji išaugo iki daugiau nei ketvirtadalio, nors ši statistika yra bendrovės vidinis vertinimas, o ne nepriklausomai patvirtintas visos DI pramonės rodiklis.

REKLAMA

Ką iš tiesų reiškia tie 26 procentai?

„Anthropic“ darbus suskirstė pagal šešių lygių automatizavimo skalę. Viename jos gale – užduotys be jokio DI dalyvavimo, kitame – visiškai savarankiškai, be žmogaus įsikišimo veikianti sistema. Ketvirtajame automatizavimo lygyje (AL4), kurį bendrovė vadina „DI vadovauja“, modelis gavęs bendro pobūdžio nurodymą gali atlikti didžiąją užduoties dalį nuo pradžios iki pabaigos, tačiau žmogus vis dar prižiūri procesą.

Taigi 26 proc. nereiškia, kad ketvirtadalį naujo „Claude“ modelio DI sukūrė vienas, be žmonių. Tai pagal darbuotojų užduotims skirtą laiką pasvertas tyrimų ir plėtros darbų dalies įvertis, kuriame modelis atlieka pagrindinį vaidmenį. Bendradarbiavimo lygį ar aukštesnį pasiekė daugiau kaip 90 proc. vertintų darbų, tačiau likusią atsakomybę ir kontrolę išlaiko žmonės.

Indeksui sudaryti įmonė analizavo darbuotojų veiklą, sudarė apie 15 tūkst. konkrečių užduočių sąrašą ir jas sugrupavo į tyrimų bei plėtros darbų kategorijas. Automatizavimo lygį padėjo vertinti pats „Claude“, o atitinkamų sričių darbuotojai pateikė savo vertinimus. Bendrovė pripažįsta, kad DI vertinant DI išlieka paklaidų ir galimo šališkumo rizika: ne visada aišku, kur baigiasi bendradarbiavimas ir prasideda vadovavimas.

REKLAMA

Ši tendencija primena ir kitus eksperimentus su DI agentais. Anksčiau rašėme apie virtualią įmonę, kurioje veikė 37 tūkst. DI darbuotojų. Vis dėlto agentų skaičius ar automatizuotų užduočių dalis savaime dar nereiškia, kad sistemos veikia be žmogaus kontrolės.

30 tūkst. agentų vienu metu: ar žmonės spėja juos prižiūrėti?

„Anthropic“ skelbia, kad 2026 m. rugpjūtį jos dažniausiai naudojamoje vidinėje platformoje vienu metu dirbo apie 30 tūkst. tyrimų ir inžinerijos DI agentų. Šis skaičius apima tik konkrečią platformą, todėl jo nereikėtų laikyti visų bendrovėje veikiančių agentų skaičiumi.

Agentų veiksmai tikrinami dviem būdais. Vadinamieji internetiniai stebėsenos mechanizmai patikrina veiksmus dar prieš juos atliekant ir gali juos blokuoti, o kiti analizuoja jau užfiksuotą veiklą, ieškodami ilgiau besivystančių problemų. Bendrovės duomenimis, per rugpjūtį iš daugiau nei milijardo vidinių agentų veiksmų sprendimų automatinė sistema užblokavo apie 0,002 proc. – maždaug vieną iš 47 tūkst. Tai rodo blokavimo dažnį, bet savaime neįrodo, kad visi kiti veiksmai buvo saugūs.

„Anthropic“ siūlo, kad DI kūrėjai viešintų panašius rodiklius ir leistų juos tikrinti nepriklausomiems vertintojams. Bendrovė planuoja tokiems specialistams suteikti prieigą prie vidinių procesų, duomenų ir saugumo priemonių. Ši diskusija ypač aktuali po viešų perspėjimų apie pažangių DI sistemų saugumą.

Didysis klausimas – ne ar „Claude“ jau visiškai savarankiškai sukūrė savo įpėdinį. Bendrovės pateikti duomenys aiškiai rodo, kad ne. Kur kas svarbiau tai, kad DI iš pagalbininko tampa pagrindiniu vykdytoju vis didesnėje naujų DI sistemų kūrimo darbų dalyje. Kartu didėja poreikis suprasti, ką modeliai daro, kaip tikrinama jų veikla ir ar priežiūros mechanizmai pajėgia neatsilikti nuo automatizavimo tempo. Apie platesnį šių lenktynių kontekstą taip pat rašėme straipsnyje apie tai, kodėl Kinija ir JAV atmeta raginimus pristabdyti DI pažangą.

Kaip vertinate šį straipsnį?

NAUJIENOS IŠ INTERNETO

Trumpai, aiškiai ir be triukšmo – gaukite svarbiausias technologijų ir mokslo naujienas pirmieji.

Sekite mokslo ir technologijų tendencijas
Dalyvaukite diskusijose
Naujienas gaukite pirmieji
1 700+ narių jau seka mūsų puslapį, laukiame tavęs!
10

Taip pat skaitykite

Atrinkome panašius straipsnius, kurie gali jums patikti.