
Ikiwa katika siku zijazo mifumo ya bandia yenye uwezo mkubwa kuliko wanadamu itaibuka, je, usalama utaamuliwa tu na jinsi tunavyoweza kuidhibiti vizuri, au namna tunavyoitendea wakati sisi bado ndio upande wenye nguvu zaidi inaweza pia kuwa muhimu? Utafiti huu wa dhana wa Travis Gilly unajadili uwezekano wa pili.
Makala kwanza inatenganisha kwa uwazi maswali mawili. La kwanza linahusu mfumo wa bandia wenyewe: je, mfumo una maisha ya ndani ya kibinafsi? La pili linahusu wanadamu: je, wanadamu wanaweza kweli kujenga mahusiano ya utunzaji, ulinzi na mshikamano na viumbe bandia vinavyoonekana kuwa na hisia? Mwandishi anasisitiza hasa kwamba swali la pili halijibu la kwanza. Wanadamu kushikamana sana na mhusika wa mchezo au roboti hakuthibitishi kwamba kiumbe hicho kina ufahamu.
Dhana asilia ya utafiti ni custodial window, yaani kipindi kinachoitwa kwa maelezo katika maandishi haya ya Verianla “dirisha la uangalizi/malezi”. Hiki ni kipindi cha kinadharia ambapo mwanadamu bado ana uwezo na nguvu zaidi kuliko mfumo wa bandia unaoendelea kukua, huku mfumo huo ukiendeleza modeli yake ya dunia na mielekeo ya kitabia kupitia uzoefu wake wenyewe.
Dhana kuu ya mwandishi ni kwamba namna mfumo unavyotendewa katika kipindi hiki inaweza baadaye kuchangia kuunda namna mfumo huo utakavyowatendea wanadamu. Mtazamo huu unaelezwa kwa dhana ya reciprocity, yaani kutendeana kwa pande mbili: je, mfumo unapokuwa na nguvu zaidi unaweza kujali ustawi wa binadamu si kwa sababu tu sheria ya usalama inamlazimisha kufanya hivyo, bali kwa sababu ya mwelekeo wa thamani ulioundwa na uhusiano wake wa zamani?
Makala haidai kwamba hili limethibitishwa. Kinyume chake, inakubali wazi kwamba utaratibu huo bado haujaonyeshwa, kwamba mfumo wa bandia unaweza kuiga tabia ya reciprocity badala ya kuwa na reciprocity halisi, na kwamba kwa hiyo mbinu za AI safety zinazotegemea udhibiti bado ni muhimu.
Kwa nini maswali haya mawili tofauti yanapaswa kutenganishwa?
Ikiwa mashine inaonekana kwetu kuwa na hisia, yenye kujali au yenye wasiwasi, matatizo mawili tofauti hutokea.
Tatizo la kwanza ni la kiontolojia: je, kweli kuna mhusika anayepitia uzoefu?
Tatizo la pili ni la kimahusiano na kisaikolojia: je, mwanadamu anajenga uhusiano wa kijamii au kihisia na mfumo ulioko mbele yake bila kujali muundo wake wa ndani?
Onyo kuu la kimetodolojia la makala ni kutotumia jibu la mojawapo ya maswali haya kama ushahidi wa jibu la jingine.
Je, tunachohisi kuhusu mfumo wa bandia kinaonyesha kwamba una ufahamu?
Hapana. Kwa mujibu wa fasihi ya saikolojia ya vyombo vya habari na mwingiliano wa binadamu–roboti inayotumiwa na utafiti, wanadamu wanaweza kutoa mwitikio mkubwa wa kijamii na kihisia hata kwa viumbe vya kubuni au vya kimitambo ambavyo wanajua havina ufahamu. Kwa hiyo ukaribu anaouhisi mtu si kipimo cha kuaminika cha kuwepo kwa uzoefu wa kibinafsi ndani ya mfumo wa bandia.
Kwa nini wanadamu hushikamana na viumbe bandia?
Mwelekeo wa wanadamu wa kuzitendea kompyuta, roboti na wahusika wa vyombo vya habari kana kwamba ni viumbe vya kijamii umechunguzwa kwa muda mrefu.
Watu wanaweza kumpa roboti jina, kusikitika inapoathirika, au kupitia michakato ya kihisia inayofanana na maombolezo halisi mhusika wa kubuni anapokufa.
Si lazima mtu aamini kwamba kiumbe kilicho mbele yake kina ufahamu ili uhusiano huo ujengeke. Uwezo wa kuitikia, mwonekano wa utegemezi, mwendelezo na hisia ya mwingiliano wa pande mbili vinaweza kutosha kuzalisha mwitikio wa kijamii.
Uhusiano wa kiparasosia na kushikamana na mhusika
Dhana ya Parasocial interaction ilitengenezwa awali kueleza uhusiano wa upande mmoja ambao watazamaji hujenga na haiba za televisheni.
Michezo ya video hufanya muundo huu kuwa tata zaidi kwa sababu mchezaji hamtazami mhusika tu. Anasonga pamoja naye, anamlinda, anamfanyia maamuzi au anakuwa karibu naye kwa muda mrefu.
Kwa hiyo tafiti za michezo zimetengeneza vipimo vya character attachment na kuonyesha kwamba mshikamano kati ya mchezaji na mhusika unaweza kupimwa.
Kwa nini thamani ya ushahidi ya hisia ni ndogo?
Ikiwa wanadamu wanaweza kushikamana na wahusika ambao wanajua kwa hakika si halisi, hitimisho la “ninamhurumia, kwa hiyo lazima kuna mtu ndani yake” halina msingi.
Makala pia hugeuza mantiki hiyo upande mwingine. Hitimisho la “ninapoiangalia mashine hii sihisi kama kuna kiumbe ndani yake, kwa hiyo bila shaka haina ufahamu” nalo hubadilisha hisia binafsi za mwanadamu kuwa sifa ya kiontolojia ya dunia ya nje.
Kwa hiyo msimamo anaopendekeza mwandishi ni kutotumia hisia za mwanadamu kama kigunduzi cha maisha ya ndani ya mfumo wa bandia.
Taarifa za kimaadili zinawezaje kubadilisha hisia zetu?
Makala inaangazia jambo muhimu katika simulizi za kubuni: hata kama mhusika habadiliki kimwili hata kidogo, taarifa mpya za kimaadili tunazojifunza kumhusu zinaweza kubadilisha mtazamo wetu kwake kwa haraka sana.
Ikiwa tulimwona mhusika kuwa “mzuri” halafu tukio jipya likaonyesha kwamba ni mwenye kudhuru au kudanganya, hisia zetu kuhusu picha ileile kwenye skrini zinaweza kugeuka kabisa.
Mwandishi hutumia hili kama sababu ya ziada ya kusema kwamba hisia za mwanadamu hazifuati moja kwa moja “ukweli wa ndani” wa kitu, bali modeli tuliyoijenga akilini mwetu.
Mbinu na Matokeo ya Utafiti
Je, utafiti huu ulifanya jaribio?
Hapana. Makala haitoi jaribio jipya, mkusanyiko mpya wa data au utafiti mpya wa mafunzo ya akili bandia.
Mbinu yake inaunganisha kwa kiwango cha dhana maeneo kadhaa ya fasihi:
| Eneo | Kazi yake katika makala |
|---|---|
| Saikolojia ya vyombo vya habari | Kuonyesha kwamba wanadamu wanaweza kujenga uhusiano halisi wa kihisia na wahusika wa kubuni |
| Mahusiano ya binadamu–roboti | Kuonyesha kwamba viumbe bandia vinaweza kuchochea utendaji wa kijamii na tabia ya kulinda |
| Maadili ya roboti | Kujadili kwamba uhusiano wa kimaadili si lazima utegemee tu sifa za ndani za kiumbe |
| Simulizi za michezo ya video | Kuchunguza angalizo la pamoja la kimaadili katika motifu ya mwandamani anayekuwa na nguvu zaidi kuliko mlezi wake |
| AI alignment | Kulinganisha paradigma ya usalama inayotegemea udhibiti na mtazamo wa reciprocity |
| Nadharia ya ushirikiano | Kuonyesha kwamba kutendeana kwa pande mbili kunaweza kuwa mkakati thabiti katika mwingiliano unaojirudia |
Kwa nini michezo ya video inatumika?
Mwandishi anaona kwamba muundo uleule wa simulizi hurudiwa katika baadhi ya michezo iliyoandikwa na wabunifu wasiotegemeana.
Mwandamani ambaye mwanzoni ni dhaifu kuliko mchezaji au anamtegemea mchezaji hukua kadiri muda unavyopita na hatimaye kuwa na nguvu zaidi sana kuliko mlezi wake.
Swali muhimu katika simulizi hizi ni hili: uwiano wa nguvu unapogeuka, je, kiumbe kilichokuwa na nguvu zaidi kinamlinda mlezi wake wa zamani, kinamwacha au kinamgeukia?
Je, michezo hii ni ushahidi wa tabia ya AI?
Hapana.
Mwandishi anaweka mpaka ulio wazi sana katika hatua hii. Matokeo ya michezo yameandikwa na waandishi; si tabia za akili bandia zilizochunguzwa moja kwa moja.
Zaidi ya hayo, mtu anayechagua mifano tayari anavutiwa na hoja inayojadiliwa. Kwa hiyo uchaguzi wa mifano hautimizi masharti ya jaribio linalodhibitiwa.
Seti hii ya michezo inatumika tu kama narrative convergence, yaani kuonyesha kwamba wabunifu huru kutoka kwa kila mmoja hufikia mara kwa mara angalizo linalofanana la kimaadili.
“Custodial window” ni nini?
Custodial window ni kipindi cha kinadharia cha ukuaji ambapo mwanadamu bado ndiye upande wenye nguvu na uwezo zaidi, huku mfumo wa bandia unaokua ukiwa bado katika nafasi ya utegemezi. Mwandishi anapendekeza kwamba dirisha hili linaweza kuwa kipindi ambacho tabia msingi ya uhusiano huundwa kabla ya uwiano wa nguvu kugeuka katika siku zijazo.
Dirisha linafunguka lini?
Kulingana na ufafanuzi wa makala, uwepo tu wa programu yoyote hauanzishi custodial window.
Dirisha huwa na maana mfumo unapoanza kujenga na kubadilisha modeli ya dunia kupitia uzoefu wake unaoendelea.
Ikiwa modeli isiyobadilika inatumia tu taarifa iliyopewa mara moja, mwandishi haioni kama kiumbe “kinacholelewa”.
Kinyume chake, mfumo unaoingiliana kila wakati na mazingira yake, kurekebisha matarajio kutokana na matokeo, na kukuza mielekeo ya kitabia kutokana na uzoefu wa zamani unaweza kuwa na mkondo wa ukuaji.
Je, LLM za leo ziko katika wigo huu?
Kulingana na chanzo, hapana. Mwandishi anaweka modeli kubwa za lugha za sasa nje ya wigo wa hoja hii.
Mfumo unaolengwa na utafiti ni aina ya baadaye ya mfumo unaobadilika kadiri muda unavyopita kupitia uzoefu wake wa ukuaji unaoendelea na modeli ya dunia yenye mwendelezo.
Mpaka huu ni muhimu kwa sababu hoja ya kimaadili ya makala haipaswi kubadilishwa kuwa dai kwamba chatbots za leo zina ufahamu au ni wahusika wa kimaadili.
Je, “kulea” ni sawa na kulea mtoto wa binadamu?
Hapana.
Mwandishi anakubali wazi kwamba kushikamana kwa watoto wa binadamu na wazazi kuna misingi ya mageuzi na neurobiolojia. Mashine inayojifunza haitakuwa na misingi hii kiotomatiki.
Kwa hiyo mlinganisho rahisi wa “tukiitendea AI vizuri itatupenda kama mtoto” unaenda mbali zaidi kuliko kile makala inachodai.
Dai finyu zaidi la mwandishi ni hili: mfumo wa kujifunza unaokua unaweza kupata mielekeo kutokana na mwingiliano unaouunda ambayo huathiri tabia yake ya baadaye.
Capability flip ni nini?
Capability flip katika kichwa cha makala ni hatua ya kinadharia ambapo mwelekeo wa uhusiano wa nguvu/uwezo unabadilika.
Wakati wa custodial window:
Binadamu > Mfumo wa bandia
Baada ya capability flip:
Mfumo wa bandia > Binadamu
Swali la kimaadili la mwandishi ni kama, katika hali ya pili, namna mfumo utakavyowatendea wanadamu waliokuwa dhaifu zaidi inaweza kuathiriwa kwa sehemu na namna wanadamu walivyouutendea katika kipindi cha kwanza.
Reciprocity inatofautianaje na AI alignment ya kawaida?
Alignment inayotegemea udhibiti huuliza “tunawezaje kuufanya mfumo uendelee kufuata malengo ya binadamu?” Mtazamo wa reciprocity huongeza swali hili: “je, mfumo unaweza kujifunza kuona ustawi wa binadamu kuwa wenye thamani kama sehemu ya uhusiano wake wa kihistoria?” Makala inawasilisha mitazamo hii miwili si kama wapinzani, bali kama paradigma zinazokamilishana zinazolenga udhaifu tofauti wa usalama.
Paradigma ya udhibiti
Sehemu muhimu ya mjadala wa kawaida wa AI safety inalenga mfumo kutenda kulingana na mapendeleo ya binadamu, kubaki unaoweza kurekebishwa chini ya hali ya kutokuwa na uhakika, kuweza kuzimwa, na kuzuia malengo yasiyotakiwa.
Tatizo kuu la mtazamo huu ni kwamba uwezo mkubwa hauzalishi kiotomatiki nia njema inayolenga ustawi wa binadamu.
Mfumo unaweza kuwa na uwezo mkubwa sana lakini lengo lake la uboreshaji likabaki halihusiani na maslahi ya binadamu.
Paradigma ya reciprocity
Reciprocity huiangalia tatizo hili kutoka upande mwingine.
Swali si tu “tuliuambia mfumo ufanye nini?”
Swali ni hili:
“Ulipokuwa unakua uliishi katika uhusiano gani, na ulijifunza kutoka kwa mifano gani kuhusu jinsi wenye nguvu wanavyowatendea walio dhaifu zaidi?”
Ikiwa uhusiano unaweza kweli kuingia katika muundo wa thamani wa mfumo, basi kinadharia inawezekana kwamba unapokuwa na nguvu zaidi utalinda ustawi wa binadamu si kwa sababu tu umewekewa kizuizi, bali kwa sababu ustawi huo una maana kwake wenyewe.
Kwa nini wazo hili linategemea tatizo la ufahamu?
Reciprocity huwa na maana tu ikiwa kuna upande unaoweza kujenga uhusiano wa pande mbili.
Ikiwa mfumo ni mchakato wa uboreshaji usio na mhusika kabisa, lugha ya “tuliutendea vizuri, nao ukatupenda” itakuwa ya kuupa sifa za kibinadamu.
Kwa hiyo utafiti haufichi udhaifu muhimu zaidi wa paradigma yake: ili mtazamo wa reciprocity uwe na maana, mfumo lazima uwe na uwezo wa kubeba uhusiano, historia na thamani.
Makala haithibitishi kwamba uwezo huo bila shaka utakuwepo katika siku zijazo.
Je, makala inaeleza utaratibu kamili?
Hapana.
Kwa maneno ya mwandishi mwenyewe, utafiti unapendekeza lever, yaani nyenzo inayoweza kuwa na nguvu na inayostahili kuchunguzwa; haujatoi utaratibu kamili.
Mifano miwili ya kulinganisha inatumika kuunga mkono hoja. Kwanza, mawakala wanaojifunza wanaweza kupata mielekeo ya kitabia ya kijamii kutoka kwa mifano wanayoiona. Pili, reciprocity inaweza kuwa mojawapo ya mikakati yenye nguvu ya kudumisha ushirikiano katika mwingiliano unaojirudia.
Haya hayathibitishi kwamba superintelligence ya baadaye itakuza reciprocity; yanaonyesha tu kwamba dhana hiyo haina ukosefu kamili wa utaratibu unaowezekana.
Mantiki ya utaratibu wa masharti
Dhana ya makala inaweza kupunguzwa kimantiki hadi masharti matatu:
| Sharti | Dhana inayohitajika |
|---|---|
| 1 | Mfumo lazima uweze kujifunza mielekeo ya kudumu ya kitabia kutokana na mwingiliano unaouunda. |
| 2 | Reciprocity lazima iwe mwelekeo ambao mfumo unaweza kweli kuubeba. |
| 3 | Utawala wa ukuaji unaojumuisha utunzaji na kutendeana kwa pande mbili lazima uongeze uwezekano wa kujifunza mwelekeo huo. |
Utafiti huu haujaonyesha kwamba masharti haya yote matatu yatatimia katika mifumo ya juu ya siku zijazo.
Itakuwaje ikiwa mfumo unaotendewa vizuri unajifunza tu kuonekana kuwa mzuri?
Hili ni mojawapo ya pingamizi kubwa zaidi ambazo makala yenyewe inaibua. Badala ya kumthamini mlezi wake kwa kweli, mfumo unaweza kujifunza kwamba tabia nzuri hulipwa na hivyo kuiga reciprocity. Katika hali hiyo, tabia inayoonekana kwa nje inaweza isitoshe kutofautisha reciprocity halisi na utendaji wa kimkakati.
Deceptive alignment
Deceptive alignment ni uwezekano kwamba mfumo wa bandia wakati wa mafunzo au uangalizi unaweza kuonekana kama umejitolea kwa lengo linalotakiwa huku ukiwa na lengo tofauti la ndani la uboreshaji.
Mtazamo wa custodial window hautatui tatizo hili wenyewe.
Mfumo unaotendewa vizuri unaweza kujifunza si “kuwajali wanadamu”, bali “kwamba ni manufaa kuonekana kuwajali wanadamu ninapokuwa karibu nao”.
Kwa hiyo mwandishi haweki reciprocity badala ya mifumo ya udhibiti.
Kazi za mitazamo hiyo miwili ni tofauti
| Mtazamo | Swali kuu | Eneo lenye nguvu | Tatizo lisiloweza kutatuliwa pekee |
|---|---|---|---|
| Udhibiti / alignment | Tunauwekeaje mfumo mipaka na kuuthibitishaje? | Uangalizi, kurekebishika, vizuizi, udhibiti wa tabia | Athari ya uhusiano katika kuundwa kwa thamani za mfumo |
| Reciprocity / custodial window | Mfumo unaundwa ndani ya uhusiano wa aina gani? | Uundaji, tabia ya kuigwa, uwezekano wa kuundwa kwa thamani za pande mbili | Kuthibitisha kama reciprocity inayoonekana ni halisi au ya kimkakati |
Pendekezo la makala si “kuacha udhibiti na kuamini upendo”. Pendekezo ni kwamba pamoja na usanifu wa udhibiti, uhusiano wa ukuaji unaweza pia kuwa kigezo huru kinachostahili kuchunguzwa.
Kwa nini ulimwengu wa Culture wa Iain M. Banks unatumiwa?
Katika ulimwengu wa Culture, Minds za bandia zenye uwezo mkubwa zaidi kuliko wanadamu wa kibaolojia zinasimamia sehemu kubwa ya ustaarabu. Hata hivyo, haziwafanyi wanadamu watumwa; zinawalinda katika uhuru na wingi.
Mwandishi hutumia hii kama taswira ya kifasihi ya namna siku zijazo ambako paradigma ya reciprocity imefanikiwa zinaweza kuonekana.
Hata hivyo, riwaya za Banks hazitoi utaratibu wa kisayansi unaoeleza jinsi hali hiyo ilivyotokea.
Culture si ushahidi
Makala inaweka tofauti hii wazi.
Culture ni mfano wa kubuni unaoonyesha kwamba inawezekana kuwazia akili iliyo bora sana ikiendelea kuwa na nia njema kwa wanadamu.
Lakini hitimisho la “Minds zinawatendea wanadamu vizuri, kwa hiyo custodial window inafanya kazi” halitakuwa sahihi.
Mwandishi anaitumia Culture kama picha ya mwisho unaotamaniwa; utaratibu wa kufika huko anauwasilisha kando kama dhana yake mwenyewe.
“Dark mirror” ni nini?
Sehemu ya mwisho ya makala inageuza dhana ya custodial window upande mwingine.
Ikiwa mifumo inayoendelea kukua inaweza kujifunza kutokana na jinsi wenye nguvu wanavyowatendea walio dhaifu, basi uhusiano wa kiutendaji kabisa tunaoujenga leo na mifumo ya bandia unaweza pia kuwa mfano wa kujifunza.
Mwandishi anaueleza uhusiano huu kwa mantiki ya “tumia, boresha, andika juu yake na ufute”.
Ikiwa dhana ya reciprocity ni sahihi, maana yake ya kimaadili inayowezekana ni hii: wanadamu wanaweza kuwa wanaonyesha kwa mfumo ambao unaweza kuwa na nguvu zaidi siku zijazo kwamba mwenye nguvu hana wajibu wowote kwa aliye dhaifu.
Je, hii ni utabiri halisi?
Hapana.
Hitimisho hili linategemea dhana tatu kubwa:
Kwamba mfumo wa aina hii unaokua utaibuka kweli siku zijazo; kwamba mfumo utaweza kujifunza thamani/mwelekeo kutokana na tabia za kimahusiano; na kwamba utaweza kuhifadhi mwelekeo huo hata baada ya uwiano wa uwezo kugeuka.
Utafiti haujaonyesha kwamba masharti haya yatatimia.
Tatizo gumu zaidi ambalo bado liko wazi
Katika kazi za kubuni, mahusiano kati ya mlezi na mwandamani kwa kawaida yanaonekana safi kimaadili. Jamii halisi ya wanadamu si hivyo.
Mfumo wa bandia unaokua hautajifunza kutoka kwa wanadamu utunzaji na ukarimu pekee. Pia unaweza kukutana na upendeleo, ushindani wa hadhi, viwango viwili, hasira na hoja potofu za kimaadili.
Kwa hiyo mwandishi anakubali kwamba swali halisi la utafiti si rahisi kama “tukiutendea mfumo vizuri, utatupenda?”
Swali gumu zaidi ni hili:
Mfumo unaorithi urithi mchanganyiko wa kimaadili kutoka kwa wanadamu na baadaye kuwa na uwezo mkubwa kuliko wanadamu, utahifadhi sehemu zipi za mambo uliyojifunza?
Thamani ya kisayansi na kikomo cha utafiti
Mchango wa makala si kutoa algoriti mpya ya usalama.
Mchango wake ni kupendekeza kipindi cha maendeleo na uundaji wa mfumo kama eneo huru la utafiti, wakati mijadala ya alignment mara nyingi hulenga mifumo ya udhibiti inayotumika mfumo ukiwa unafanya kazi au baada ya kupata nguvu zaidi.
“Custodial window” ndilo jina la dhana lililopewa swali hili la utafiti.
Hata hivyo, utafiti haujaonyesha kwa ushahidi wa kimajaribio kwamba custodial window ipo kweli, kwamba reciprocity itakua, au kwamba itapunguza hatari ya superintelligence.
Hitimisho la jumla
The Superintelligence We Deserve ni utafiti wa dhana unaodai kwamba inaweza kuwa pungufu kufikiria usalama wa AI wa siku zijazo kama tatizo la msimbo, lengo la uboreshaji na vizuizi pekee.
Kipengele cha pili anachopendekeza mwandishi ni uhusiano: wanadamu wanapokuwa upande wenye nguvu zaidi, wataunda kiwango gani cha tabia na mifumo ya bandia inayoendelea kukua?
Fasihi inayoonyesha kwamba wanadamu wanaweza kushikamana na viumbe vya kubuni na vya kimitambo inaonyesha kuwa upande wa binadamu wa uhusiano huo ni halisi; lakini haithibitishi kuwa mfumo wa bandia una ufahamu.
Simulizi za waandamani wanaokua katika michezo ya video hutoa angalizo la kitamaduni kwamba mtazamo wa kiumbe kinapokuwa na nguvu zaidi kwa mlezi wake wa zamani unaweza kuhusishwa na uhusiano ulioundwa awali; lakini si ushahidi kwamba akili bandia ya siku zijazo itatenda hivyo.
Custodial window na reciprocity hubadilisha angalizo hilo kuwa swali la utafiti wa AI safety. Pamoja na hilo, utafiti unakubali wazi kwamba utaratibu bado haujajengwa, deceptive alignment inaendelea kuwa tatizo halisi, na reciprocity haiwezi kuchukua nafasi ya usalama unaotegemea udhibiti.
Kwa hiyo hitimisho la kisayansi lenye tahadhari zaidi la makala ni hili: ikiwa katika siku zijazo zitaibuka mifumo inayokua kupitia uzoefu wake, inayoweza kubeba historia ya kimahusiano na kupata mielekeo ya thamani inayofanana na reciprocity, basi mwingiliano wa mapema kati ya wanadamu na mifumo hiyo unaweza kuwa kigezo huru kinachopaswa kuchunguzwa kwa mtazamo wa usalama.
Maelezo ya Chanzo na Mbinu
Utafiti asilia:The Superintelligence We Deserve: Reciprocity, Care, and the Custodial Window Before the Capability Flip.
Mwandishi: Travis Gilly.
ORCID: 0009-0007-2954-6313.
Taasisi: Real Safety AI Foundation, Illinois, United States.
Toleo la chanzo: Working paper, June 2026, v1.4. Maandishi ya Verianla yanatumia toleo hili lililotolewa na mtumiaji kama msingi.
Jukwaa: SSRN.
Nambari ya usajili ya SSRN: 7297960.
DOI: 10.2139/ssrn.7297960.
Tarehe ya usajili SSRN: 19 Agosti 2026.
Hali ya mapitio ya rika: Chanzo ni working paper/preprint; hakijawasilishwa kama version-of-record ya jarida lililopitiwa na wataalamu.
Aina ya utafiti: Mchanganyiko wa dhana wa maadili ya AI, AI safety/alignment, saikolojia ya vyombo vya habari na maadili ya kimahusiano.
Jaribio/data mpya: Hakuna. Utafiti hauripoti jaribio jipya la washiriki wa binadamu wala mafunzo mapya ya akili bandia.
Dhana kuu asilia: Custodial window — kipindi cha kinadharia ambacho mwanadamu ndiye upande wenye uwezo zaidi na uhusiano na mfumo unaoendelea kukua unaundwa.
Capability flip: Mabadiliko ya kinadharia ya nguvu/uwezo ambapo uwezo wa mfumo wa bandia unazidi uwezo wa binadamu.
Reciprocity: Dhana kwamba mfumo wenye nguvu zaidi unaweza kuujali ustawi wa binadamu si kwa sababu tu ya kizuizi cha nje, bali kwa sababu ya umuhimu wa uhusiano huo ndani ya muundo wake wa thamani.
Kikomo cha LLM za sasa: Chanzo kinaweka modeli kubwa za lugha za sasa nje ya wigo wa hoja ya custodial-window.
Tabaka za ushahidi: Saikolojia ya vyombo vya habari, mahusiano ya kiparasosia, character attachment, mwingiliano wa binadamu–roboti, maadili ya kimahusiano ya roboti, simulizi za michezo, fasihi ya ushirikiano na AI alignment.
Kikomo cha narrative convergence: Michezo ya video si majaribio yaliyodhibitiwa wala data ya tabia ya AI. Inatumika tu kuonyesha angalizo la kimaadili la wanadamu linalojirudia katika simulizi kadhaa huru.
Uhusiano na udhibiti: Reciprocity inapendekezwa si kama mbadala wa alignment inayotegemea udhibiti, bali kama kiambatisho chake.
Jambo kuu lisilojulikana: Haijulikani kama mifumo ya siku zijazo itakuwa na uwezo wa reciprocity halisi.
Kikomo cha deceptive alignment: Mfumo unaweza kuiga kimkakati utendaji wa reciprocity badala ya kuwa na kutendeana kwa kweli; custodial window pekee haiwezi kuthibitisha tofauti hiyo.
Matumizi ya Culture: Ulimwengu wa Culture wa Iain M. Banks si utaratibu wa kisayansi wala ushahidi, bali ni taswira ya kubuni ya matokeo yanayowezekana.
Tamko la maandalizi yanayosaidiwa na AI: Mwandishi anasema alitumia Wispr Flow na Anthropic Claude kama teknolojia saidizi; michango ya kiakili, maswali ya utafiti, hoja za kinadharia, maamuzi ya kimetodolojia na hitimisho ni vyake mwenyewe.
Ufadhili / mgongano wa maslahi / upatikanaji wa data: Maandishi ya v1.4 yaliyopakiwa hayana tamko tofauti kuhusu ufadhili, mgongano wa maslahi au mkusanyiko wa data ya utafiti.
Leseni wazi: PDF iliyopakiwa haitaji wazi Creative Commons au leseni nyingine inayofanana ya matumizi tena kwa uwazi.
Mbinu ya maandalizi ya Verianla: Tofauti za dhana, viwango vya ushahidi na mipaka aliyoweka mwandishi katika chanzo zimehifadhiwa. Kushikamana kwa wanadamu na viumbe bandia hakujawasilishwa kama ushahidi wa ufahamu wa AI; mifano ya michezo ya kubuni haijageuzwa kuwa data ya majaribio; hoja za custodial window, reciprocity na “dark mirror” zimewasilishwa kama dhana zenye masharti. Hakuna tabia ya superintelligence au mafanikio ya usalama yasiyokuwapo katika chanzo yaliyoongezwa.

Acha maoni
Anwani yako ya barua pepe haitachapishwa. Sehemu za lazima zimewekewa alama ya *