Dirbtinio intelekto „Claude“ vaidmens kuriant naujus „Anthropic“ DI modelius iliustracija
„Claude“ jau pats vadovauja 26 proc. savo kūrimo darbų: DI pradeda kurti savo įpėdinį
Dirbtinis intelektas jau ne tik atsakinėja į klausimus ar rašo programinį kodą – jis vis aktyviau dalyvauja kuriant naujas savo paties versijas. „Anthropic“ atskleidė, kad 2026 m. rugpjūtį jos modelis „Claude“ vadovavo 26 proc. bendrovės dirbtinio intelekto tyrimų ir plėtros darbų, o daugiau kaip 90 proc. šių darbų bent jau bendradarbiavo su žmonėmis. Vis dėlto bendrovė pabrėžia: nė vienoje vertintoje darbų srityje „Claude“ dar neveikia visiškai savarankiškai.
Šie duomenys pateikti „Anthropic“ paskelbtoje DI kūrimo tempo matavimo apžvalgoje. Joje bendrovė pirmą kartą detaliau parodo, kiek pačios naujų modelių kūrimo grandinės jau patikėta DI, kaip prižiūrimi agentai ir kokie ištekliai naudojami jų plėtrai. Tai svarbu ne vien „Anthropic“: kuo daugiau modelių kūrimo darbo atlieka DI, tuo greičiau potencialiai gali vykti ir tolesnė technologijos pažanga.
Palyginimui, vasarį „Claude“ vadovaujamo darbo dalis nesiekė nė 1 proc. Vos per pusmetį ji išaugo iki daugiau nei ketvirtadalio, nors ši statistika yra bendrovės vidinis vertinimas, o ne nepriklausomai patvirtintas visos DI pramonės rodiklis.
Ką iš tiesų reiškia tie 26 procentai?
„Anthropic“ darbus suskirstė pagal šešių lygių automatizavimo skalę. Viename jos gale – užduotys be jokio DI dalyvavimo, kitame – visiškai savarankiškai, be žmogaus įsikišimo veikianti sistema. Ketvirtajame automatizavimo lygyje (AL4), kurį bendrovė vadina „DI vadovauja“, modelis gavęs bendro pobūdžio nurodymą gali atlikti didžiąją užduoties dalį nuo pradžios iki pabaigos, tačiau žmogus vis dar prižiūri procesą.
Taigi 26 proc. nereiškia, kad ketvirtadalį naujo „Claude“ modelio DI sukūrė vienas, be žmonių. Tai pagal darbuotojų užduotims skirtą laiką pasvertas tyrimų ir plėtros darbų dalies įvertis, kuriame modelis atlieka pagrindinį vaidmenį. Bendradarbiavimo lygį ar aukštesnį pasiekė daugiau kaip 90 proc. vertintų darbų, tačiau likusią atsakomybę ir kontrolę išlaiko žmonės.
Indeksui sudaryti įmonė analizavo darbuotojų veiklą, sudarė apie 15 tūkst. konkrečių užduočių sąrašą ir jas sugrupavo į tyrimų bei plėtros darbų kategorijas. Automatizavimo lygį padėjo vertinti pats „Claude“, o atitinkamų sričių darbuotojai pateikė savo vertinimus. Bendrovė pripažįsta, kad DI vertinant DI išlieka paklaidų ir galimo šališkumo rizika: ne visada aišku, kur baigiasi bendradarbiavimas ir prasideda vadovavimas.
Ši tendencija primena ir kitus eksperimentus su DI agentais. Anksčiau rašėme apie virtualią įmonę, kurioje veikė 37 tūkst. DI darbuotojų. Vis dėlto agentų skaičius ar automatizuotų užduočių dalis savaime dar nereiškia, kad sistemos veikia be žmogaus kontrolės.
30 tūkst. agentų vienu metu: ar žmonės spėja juos prižiūrėti?
„Anthropic“ skelbia, kad 2026 m. rugpjūtį jos dažniausiai naudojamoje vidinėje platformoje vienu metu dirbo apie 30 tūkst. tyrimų ir inžinerijos DI agentų. Šis skaičius apima tik konkrečią platformą, todėl jo nereikėtų laikyti visų bendrovėje veikiančių agentų skaičiumi.
Agentų veiksmai tikrinami dviem būdais. Vadinamieji internetiniai stebėsenos mechanizmai patikrina veiksmus dar prieš juos atliekant ir gali juos blokuoti, o kiti analizuoja jau užfiksuotą veiklą, ieškodami ilgiau besivystančių problemų. Bendrovės duomenimis, per rugpjūtį iš daugiau nei milijardo vidinių agentų veiksmų sprendimų automatinė sistema užblokavo apie 0,002 proc. – maždaug vieną iš 47 tūkst. Tai rodo blokavimo dažnį, bet savaime neįrodo, kad visi kiti veiksmai buvo saugūs.
„Anthropic“ siūlo, kad DI kūrėjai viešintų panašius rodiklius ir leistų juos tikrinti nepriklausomiems vertintojams. Bendrovė planuoja tokiems specialistams suteikti prieigą prie vidinių procesų, duomenų ir saugumo priemonių. Ši diskusija ypač aktuali po viešų perspėjimų apie pažangių DI sistemų saugumą.
Didysis klausimas – ne ar „Claude“ jau visiškai savarankiškai sukūrė savo įpėdinį. Bendrovės pateikti duomenys aiškiai rodo, kad ne. Kur kas svarbiau tai, kad DI iš pagalbininko tampa pagrindiniu vykdytoju vis didesnėje naujų DI sistemų kūrimo darbų dalyje. Kartu didėja poreikis suprasti, ką modeliai daro, kaip tikrinama jų veikla ir ar priežiūros mechanizmai pajėgia neatsilikti nuo automatizavimo tempo. Apie platesnį šių lenktynių kontekstą taip pat rašėme straipsnyje apie tai, kodėl Kinija ir JAV atmeta raginimus pristabdyti DI pažangą.
Kaip vertinate šį straipsnį?
Prenumeruokite mūsų „YouTube“ kanalą ir mėgaukitės įdomiais vaizdo reportažais apie mokslą ir technologijas.
Trumpai, aiškiai ir be triukšmo – gaukite svarbiausias technologijų ir mokslo naujienas pirmieji.
DIENOS SKAITOMIAUSI
M+S padangos: ar tikrai Lietuvoje su jomis galima važinėti žiemą?
2„DI krikštatėvis“ perspėja: liko vos metai suvaldyti dirbtinį intelektą
3Europa pristatė naują sparnuotąją raketą: smūgiai už 300 km ir masinių atakų galimybė
4Kinija stato milžinišką povandeninių dronų motininį laivą: palydovai atskleidė neįprastą projektą
5Į Europos gatves išriedės 25 tūkst. autonominių taksi
NAUJAUSI
Taip pat skaitykite
Atrinkome panašius straipsnius, kurie gali jums patikti.