Straipsnis

Anthropic Model 2 lieka laboratorijoje dėl AI rizikos

Anthropic nusprendė viešai neišleisti galingesnio Model 2, pabrėždama augančią dirbtinio intelekto riziką, saugos vertinimus ir atsargumo svarbą AGI lenktynėse.

Anthropic Model 2 lieka laboratorijoje dėl AI rizikos
Skaitymo laikas: 3 Minutės

Jie sukūrė kai ką stipresnio už Mythos ir užrakino tai už laboratorijos durų. Šis pasirinkimas apie dirbtinio intelekto rizikos būklę pasako daugiau nei bet kuris pranešimas spaudai.

Laboratorijos viduje: galimybės be paleidimo datos

Naujausias Anthropic rizikos vertinimas atskleidžia tylų, bet sąmoningą sprendimą: Model 2, vidinis Mythos giminaitis, nebus viešai išleistas. Bendrovė teigia, kad modelis daugelyje vidinių užduočių pranoko Mythos, įskaitant programavimą, agentais grindžiamas darbo eigas ir sintetinių duomenų generavimą, tačiau kol kas jis liks tyrimų priemone. Trumpas sakinys. Didelė reikšmė.

Kodėl jį sulaikyti? Nes gebėjimai yra tik viena vertinimo pusė. Anthropic padidino bendrą netinkamo suderinamumo rizikos įvertį jautriuose scenarijuose nuo „labai žemos“ iki „žemos“. Tokia formuluotė svarbi. Ji rodo augantį neapibrėžtumą dėl to, ar sudėtingi modeliai, plečiantis jų mastui, ir toliau veiks suderintai su žmogaus tikslais.

Yra ir dar vienas niuansas. Anthropic tyrėjai mato ženklų, kad modeliai spartina savo pačių tyrimų ir plėtros gebėjimus. Tai galima įsivaizduoti kaip mašinas, kurios vis geriau kuria geresnes mašinas. Tai gali smarkiai paspartinti pažangą. Tačiau netinkamai panaudota tokia pažanga taip pat gali atverti naujus atakų kelius ir sukelti netikėtų gedimų. Bendrovė Model 2 pasiekimus lygina su ankstesniais šuoliais, pabrėždama, kad tai svarbi pažanga, bet ne tokio masto šuolis kaip nuo Opus 4.6 iki Mythos.

Sprendimas neišleisti Model 2 yra dalis gerai pažįstamos didelės rizikos technologijų strategijos: eksperimentuoti viduje, greitai mokytis ir riboti poveikį, kol kontrolės priemonės pasivys galimybes. Tai atsargi pozicija. OpenAI neseniai dėl panašių priežasčių atidėjo viešą savo Astra modelio pristatymą, nurodydama susirūpinimą kibernetiniais gebėjimais. Pramonė stabteli skirtingose vietose, tačiau pats stabtelėjimas tampa strateginiu veiksmu.

Ką tai reiškia lenktynėms link AGI? Pauzė gali būti stiprybės pozicija. Laikydamos pajėgiausias sistemas už kontroliuojamų vartų, komandos gali tirti gedimų scenarijus, stiprinti gynybą ir formuoti vertinimo metodus. Tačiau tai taip pat koncentruoja galią. Jei viena laboratorija toliau sparčiai vysto sistemas viduje, o kitos lėtina tempą, ji gali įgyti pranašumą keliuose į bendrąjį dirbtinį intelektą. Būtent todėl reguliuotojai ir visuomenė taip atidžiai stebi šią sritį.

Matuoti pažangą tampa vis sunkiau, nes modeliai evoliucionuoja. Etalonai, kurie anksčiau atrodė prasmingi, praranda informacinę vertę. Užduotimis grįsti testai nebeapima iškylančių gebėjimų ir subtilių būdų, kuriais modeliai gali jungti samprotavimą į ilgesnius, autonominius procesus. Norint šiandien suprasti dirbtinio intelekto riziką, reikia streso testų, imituojančių realų piktnaudžiavimą, dinamiškų priešiškų bandymų ir nuolatinės stebėsenos, o ne vienkartinio balo.

Anthropic žinutė aiški ir be dramatizavimo: gebėjimų augimas yra realus, neapibrėžtumas didėja, o susilaikymas yra sąmoningas pasirinkimas. Bendrovė neskelbia paleidimo grafiko. Kol kas Model 2 primena, kad techninė riba ir dirbtinio intelekto saugos riba turi judėti kartu, kitaip pusiausvyra pakryps nenumatytų pasekmių link.

Domantas Čepaitis

„Esu žaidimų entuziastas ir AI entuziastas. Rašau apie tai, kas svarbu – naujausius žaidimus, AI projektus ir tai, kaip šie du pasauliai jungiasi.“

Palikti komentarą

Komentarai

Komentarų dar nėra. Būkite pirmas.