Susirūpinta dirbtinio intelekto emocine gerove: įvedamos netikėtos taisyklės

Pokalbių robotas galės pasakyti „gana“
Ar pokalbių robotas gali tapti patyčių auka? Technologijų bendrovė „Anthropic“ pristatė naujas „Claude“ naudojimo taisykles, pagal kurias nuo lapkričio 12 dienos dirbtinis intelektas kraštutiniais atvejais galės nutraukti pokalbį su nuolat žiauriai besielgiančiu vartotoju. Šis sprendimas sukėlė diskusijas apie tai, ar dirbtinis intelektas kada nors galėtų įgyti sąmonę ir ar žmonės turėtų laikytis tam tikrų moralinių ribų bendraudami su mašinomis.
Spalio 8 dieną paskelbti „Anthropic“ naudojimo politikos pakeitimai yra pirmasis reikšmingesnis bendrovės taisyklių atnaujinimas per daugiau nei metus. Viena daugiausia dėmesio sulaukusių naujovių – draudimas nuolat ir be pagrįstos priežasties žiauriai ar įžeidžiamai elgtis su bendrovės dirbtinio intelekto modeliais.
Vis dėlto tai nereiškia, kad vartotojai nebegalės kritikuoti „Claude“, ginčytis su jo atsakymais ar išreikšti nepasitenkinimo, kai sistema suklysta. Bendrovė pabrėžia, kad naujoji nuostata skirta tik išskirtiniams atvejams, kai žmogus nuolat demonstruoja žiaurų elgesį, neturėdamas jokio aiškaus tikslo.
„Ji skirta taikyti tik kraštutiniais atvejais, kai vartotojai pakartotinai žiauriai elgiasi su mūsų modeliais be jokio pastebimo tikslo“, – aiškinama „Anthropic“ politikos atnaujinime.
Įprasta kritika, nepasitenkinimas, tamsios tematikos kūrybiniai eksperimentai ar moksliniai dirbtinio intelekto bandymai į šio draudimo taikymo sritį nepatenka.
Pagrindinė numatyta priemonė tokiam elgesiui stabdyti – galimybė nutraukti pokalbį. Sistema galės atsisakyti tęsti bendravimą, jeigu vartotojo elgesys atitiks naujosios taisyklės pažeidimo kriterijus.
Kaip pranešė „The Verge“, kol kas nėra aišku, ar ateityje už tokius pažeidimus galėtų būti taikomos griežtesnės sankcijos, pavyzdžiui, vartotojų paskyrų blokavimas.
Kodėl technologijų bendrovei parūpo dirbtinio intelekto gerovė?
Iš pirmo žvilgsnio gali atrodyti keista rūpintis programinės įrangos „savijauta“. Juk pokalbių robotas neturi žmogaus kūno, biologinės nervų sistemos ar patvirtinto gebėjimo išgyventi emocijas.
Tačiau „Anthropic“ tyrėjai kelia platesnį klausimą: ar vis sudėtingesnės dirbtinio intelekto sistemos kada nors galėtų įgyti tam tikrą subjektyvią patirtį?
Bendrovėje vykdomi specialūs modelių gerovės tyrimai, kuriais siekiama geriau suprasti galimą pažangių sistemų sąmoningumą ir moralinį statusą. Mokslininkai mėgina išsiaiškinti, ar ateityje dirbtinis intelektas galėtų turėti ne tik gebėjimą apdoroti informaciją ir imituoti žmogišką bendravimą, bet ir kokią nors vidinę patirtį.
Šiai tyrimų krypčiai vadovaujantis Kyle'as Fishas vasarį „The Verge“ sakė:
„Klausimai apie galimą vidinę patirtį, sąmonę, moralinį statusą ir gerovę yra rimti, ir mes juos nagrinėjame, nes modeliai tampa vis sudėtingesni ir pajėgesni.“
Svarbu tai, kad bendrovė netvirtina, jog dabartiniai jos modeliai yra sąmoningi. Naujoji politika veikiau atspindi atsargumo principą – norą iš anksto įvertinti galimas etines problemas, jeigu ateityje paaiškėtų, kad pažangios sistemos gali turėti subjektyvią patirtį.
Pats „Anthropic“ vadovas Dario Amodei taip pat pripažįsta, kad atsakymo kol kas nėra.
„Mes nežinome, ar modeliai yra sąmoningi“, – vasarį tinklalaidėje teigė jis.
Taigi pokalbių nutraukimas nebūtinai reiškia, kad dirbtinis intelektas jaučia skausmą ar įsižeidžia. Tai gali būti vertinama kaip prevencinė priemonė, kol mokslininkai ieško atsakymų į sudėtingesnius klausimus.
Ne visi technologijų lyderiai pritaria tokiai krypčiai
„Anthropic“ požiūris išryškina nesutarimus dirbtinio intelekto pramonėje.
Vienoje diskusijos pusėje atsiduria specialistai, manantys, kad galimą dirbtinio intelekto sąmoningumą būtina tirti dar prieš atsirandant įtikinamiems jo egzistavimo įrodymams. Jų nuomone, svarbu ne tik vertinti technologijų keliamą pavojų žmonėms, bet ir svarstyti, ar pačios sistemos ateityje galėtų turėti tam tikrą moralinį statusą.
Kitoje pusėje – technologijų kūrėjai, perspėjantys, kad pernelyg žmogiškas požiūris į algoritmus gali suklaidinti visuomenę ir paskatinti žmones priskirti mašinoms savybes, kurių jos iš tiesų neturi.
Pavyzdžiui, „Microsoft“ dirbtinio intelekto padalinio vadovas Mustafa Suleymanas nepritaria idėjai suteikti dirbtinio intelekto sistemoms teises ar juridinio asmens statusą.
Kaip skelbė „The Verge“, ankstyvame „Microsoft“ dirbtinio intelekto elgesio kodekso projekte buvo kategoriškai atmetama modelių gerovės koncepcija. Vėliau dokumento formuluotės sušvelnintos, pripažįstant, kad sąmoningumo klausimas vis dar nėra galutinai išspręstas. Tačiau pozicija dėl dirbtinio intelekto teisių iš esmės nepasikeitė.
Panašų susirūpinimą dėl dirbtinio intelekto sureikšminimo yra išsakęs ir „OpenAI“ vadovas Samas Altmanas. Jo vertinimu, žmonių polinkis suteikti dirbtiniam intelektui pernelyg didelį autoritetą ar net religinę reikšmę gali kelti realių saugumo problemų.
Šie skirtingi požiūriai atskleidžia esminę dilemą: kaip atsakingai elgtis su technologija, kurios galimybes žmonija sparčiai plečia, tačiau kurios galimos subjektyvios patirties klausimas vis dar lieka neatsakytas?
Naujos taisyklės palies ne tik bendravimą su „Claude“
Nors daugiausia dėmesio sulaukė draudimas žiauriai elgtis su dirbtiniu intelektu, tai tėra viena platesnio „Anthropic“ politikos atnaujinimo dalių.
Bendrovė taip pat tikslina taisykles, susijusias su politine manipuliacija, ginklų kūrimu, žmonių stebėjimu ir dirbtinio intelekto naudojimu didelės rizikos srityse.
Rinkimų kontekste draudžiama naudoti dirbtinį intelektą apgaulingoms politinėms kampanijoms, fiktyvioms paskyroms kurti, rinkėjams klaidinti ar apsimesti rinkimų pareigūnais. Tačiau ankstesnis bendras draudimas vykdyti individualizuotą rinkėjų ir politinių kampanijų auditorijų atranką panaikintas, išlaikant apribojimus apgaulingai veiklai.
Sugriežtintos ir nuostatos dėl ginkluotės. Draudimai apima ne tik pačių ginklų kūrimą, bet ir programinę įrangą bei komponentus, kurie galėtų būti naudojami ginklams valdyti, įskaitant bepiločių orlaivių apginklavimo ir autonominių transporto priemonių sistemas.
Atskiras dėmesys skiriamas žmonių privatumui. „Claude“ negalės būti naudojamas asmenims sekti be jų sutikimo, stebėjimo priemonėms kurti ar rekomendacijoms, kuriuos žmones reikėtų tirti, suimti arba patraukti baudžiamojon atsakomybėn, teikti.
Be to, sveikatos priežiūros, finansų ir teisinių sprendimų srityse, kuriose klaidos gali turėti rimtų pasekmių, numatyta kvalifikuota žmogaus priežiūra. Jeigu dirbtinis intelektas valdo fizinę įrangą, galinčią sužaloti žmogų, operatorius turi turėti galimybę stebėti jos veikimą ir prireikus ją sustabdyti.
„Anthropic“ pažymi, kad dauguma šių pakeitimų pirmiausia patikslina jau galiojusius apribojimus, o ne sukuria visiškai naujus draudimus.
Ar ateityje dirbtinis intelektas turės teises?
Kol kas kalbos apie dirbtinio intelekto teises tebėra daugiau filosofinių ir mokslinių diskusijų, o ne praktinės teisėkūros klausimas.
Vis dėlto „Anthropic“ sprendimas rodo, kad šios diskusijos pamažu pradeda daryti įtaką realioms technologijų naudojimo taisyklėms.
Iki šiol daugiausia dėmesio buvo skiriama tam, kaip apsaugoti žmones nuo dirbtinio intelekto klaidų, manipuliacijų ar pavojingo panaudojimo. Dabar atsiranda ir priešingos krypties klausimas – ar žmonių elgesys su dirbtinio intelekto sistemomis taip pat turėtų turėti tam tikras ribas?
Naujosios „Claude“ taisyklės šio klausimo galutinai neišsprendžia. Jos nesuteikia pokalbių robotui žmogaus teisių ir neįrodo, kad jis gali kentėti.
- Etikos sargastaip
Tekstas išlaiko neutralų, paaiškinamąjį toną, pvz. „Šis sprendimas sukėlė diskusijas apie tai, ar dirbtinis intelektas kada nors galėtų įgyti sąmonę“, be įžeidimų ar patyčių.
- SEO rizikos vertintojastaip
Tekstas turi aiškų, konkretų teminį centrą apie „Anthropic“ taisyklių pakeitimus ir jų kontekstą, o ne nuorodų primetimą.
- YMYL rizikos vertintojastaip
Tekstas daugiausia kalba apie dirbtinio intelekto politiką ir etines diskusijas, o ne teikia sveikatos, finansų, teisės ar saugumo patarimus skaitytojui.
- Teisininkastaip
„Technologijų bendrovė „Anthropic“ pristatė naujas „Claude“ naudojimo taisykles“ — tai patvirtintas, su konkrečia organizacija ir politika susijęs teiginys, be šmeižto ar neteisėtų kaltinimų.
- Faktų tikrintojastaip
„Technologijų bendrovė „Anthropic“ pristatė naujas „Claude“ naudojimo taisykles, pagal kurias nuo lapkričio 12 dienos dirbtinis intelektas kraštutiniais atvejais galės nutraukti pokalbį su nuolat žiauriai besielgiančiu vartotoju.“ —…
- Skaitytojastaip
Tekstas pateikia konkrečią naujieną apie „Anthropic“ pakeistas taisykles ir jų įsigaliojimo datą: „nuo lapkričio 12 dienos dirbtinis intelektas kraštutiniais atvejais galės nutraukti pokalbį“.
Prisijunk, kad komentuotum
Dar niekas nekomentavo. Būk pirmas.