Академиялык изилдөөлөр, түшүнүктүү тил

Verianla | Кыргызча академиялык изилдөөлөр жана илим

27 сентябрь 2026, Жекшемби
VERİANLAКөз карандысыз илимий басма
Менюну ачуу же жабуу
...
Башкы бет / Коомдук илимдер / Социология / Биз Татыктуу Суперинтеллект: Жөндөмдөрдүн Тең Салмактуулугу Тескери Айланганга Чейин Өз Аралуулук, Камкордук жана Көзөмөл Терезеси
Социология

Биз Татыктуу Суперинтеллект: Жөндөмдөрдүн Тең Салмактуулугу Тескери Айланганга Чейин Өз Аралуулук, Камкордук жана Көзөмөл Терезеси

Келечекте адамдардан да жөндөмдүү жасалма системалар пайда болсо, коопсуздукту аларды канчалык жакшы көзөмөлдөй алганыбыз гана аныктайбы, же биз күчтүүрөөк тарап болуп турган кезде аларга кандай мамиле кылганыбыз да маанилүү болушу мүмкүнбү? Travis Gillyнин бул концептуалдык эмгеги экинчи мүмкүнчүлүктү талкуулайт.

21/09/2026  Veri Anla 105 көрүү
Биз Татыктуу Суперинтеллект: Жөндөмдөрдүн Тең Салмактуулугу Тескери Айланганга Чейин Өз Аралуулук, Камкордук жана Көзөмөл Терезеси

Келечекте адамдардан да жөндөмдүү жасалма системалар пайда болсо, коопсуздукту аларды канчалык жакшы көзөмөлдөй алганыбыз гана аныктайбы, же биз күчтүүрөөк тарап болуп турган кезде аларга кандай мамиле кылганыбыз да маанилүү болушу мүмкүнбү? Travis Gillyнин бул концептуалдык эмгеги экинчи мүмкүнчүлүктү талкуулайт.

Макала адегенде эки суроону так ажыратат. Биринчиси жасалма системанын өзүнө тиешелүү: системанын субъективдүү ички жашоосу барбы? Экинчиси адамдарга тиешелүү: адамдар жасалма жана сезимталдай көрүнгөн нерселер менен чыныгы камкордук, коргоо жана байланып калуу мамилелерин түзө алабы? Автор экинчи суроо биринчи суроого жооп бербей турганын өзгөчө белгилейт. Адамдардын оюн каарманына же роботко күчтүү байланышы анын аң-сезимдүү экенин көрсөтпөйт.

Изилдөөнүн өзгөчө түшүнүгү custodial window, башкача айтканда бул Verianla текстинде түшүндүрмө иретинде “көзөмөл/камкордук терезеси” деп аталган мезгил. Бул адам өнүгүп келе жаткан жасалма системага караганда дагы эле жөндөмдүү жана күчтүү болуп турган, ал эми система өз тажрыйбалары аркылуу дүйнө моделин жана жүрүм-турум тенденцияларын өнүктүрүп жаткан гипотетикалык убакыт аралыгы.

Автордун негизги гипотезасы — ушул мезгилде системага көрсөтүлгөн мамиле кийинчерээк системанын адамдарга кандай мамиле кыларына калыптандыруучу таасир бериши мүмкүн. Бул ыкма reciprocity, башкача айтканда өз аралуулук түшүнүгү менен түшүндүрүлөт: күчтүүрөөк болуп калган система адамдын жыргалчылыгын коопсуздук эрежеси мажбурлаганы үчүн гана эмес, өткөн мамиленин калыптандырган баалуулук тенденциясынан улам маанилүү деп эсептей алабы?

Макала мунун далилденгенин ырастабайт. Тескерисинче, механизм али көрсөтүлө электигин, жасалма система чыныгы өз аралуулуктун ордуна reciprocity жүрүм-турумун туурашы мүмкүн экенин жана ошондуктан көзөмөлгө негизделген AI safety ыкмалары дагы эле зарыл экенин ачык моюнга алат.

Эки башка суроо эмне үчүн бири-биринен ажыратылышы керек?

Эгер машина бизге сезимтал, боорукер же тынчсыздангандай көрүнсө, эки башка маселе чыгат.

Биринчи маселе онтологиялык: чындап тажрыйба башынан өткөргөн субъект барбы?

Экинчи маселе мамилелик жана психологиялык: адам каршысындагы системанын ички түзүлүшүнө карабай аны менен социалдык же эмоционалдык байланыш түзөбү?

Макаланын негизги методологиялык эскертүүсү — бул эки суроонун биринин жообун экинчисинин далили катары колдонбоо.

Жасалма системага карата сезгенибиз анын аң-сезимдүү экенин көрсөтөбү?

Жок. Изилдөө таянган медиа психологиясы жана адам–робот өз ара аракеттенүүсү адабиятына ылайык, адамдар аң-сезими жок экенин билишкен ойдон чыгарылган же механикалык нерселерге да күчтүү социалдык жана эмоционалдык реакция көрсөтө алышат. Ошондуктан адам сезген жакындык жасалма системада субъективдүү тажрыйба бар экенин көрсөткөн ишенимдүү өлчөм эмес.

Адамдар эмне үчүн жасалма нерселерге байланып калышат?

Адамдардын компьютерлерди, роботторду жана медиа каармандарын социалдык жандыктардай кабыл алуу тенденциясы көптөн бери изилденип келет.

Адамдар роботко ат коюшу, ал жабыркаганда тынчсызданышы же ойдон чыгарылган каарман өлгөндө чыныгы азага окшош эмоционалдык процесстерди башынан өткөрүшү мүмкүн.

Мындай байланыштын түзүлүшү үчүн адам каршысындагы нерсенин аң-сезимдүү экенине ишенүүгө милдеттүү эмес. Жооп кайтаруучулук, көз карандылыктын көрүнүшү, үзгүлтүксүздүк жана өз ара аракеттенүү сезими социалдык реакция жаратууга жетиштүү болушу мүмкүн.

Парасоциалдуулук жана каарманга байланып калуу

Parasocial interaction түшүнүгү башында көрүүчүлөрдүн телекөрсөтүү инсандары менен түзгөн бир тараптуу мамилесин түшүндүрүү үчүн иштелип чыккан.

Видео оюндар бул түзүлүштү татаалдаштырат, анткени оюнчу каарманды гана карап турбайт. Ал каарман менен чогуу аракеттенет, аны коргойт, анын атынан чечим кабыл алат же узак убакыт бою жанында болот.

Ошондуктан оюн изилдөөлөрүндө character attachment шкалалары иштелип чыгып, оюнчунун каарман менен түзгөн байланышын өлчөөгө болору көрсөтүлгөн.

Сезимдин далилдик баалуулугу эмне үчүн чектелүү?

Эгер адамдар чыныгы эмес экенин так билишкен каармандарга байланып кала алса, “ага боорум ооруп жатат, демек ичинде бирөө бар” деген тыянак жараксыз.

Макала ошол эле логиканы тескери да бурат. “Бул машинага караганда эч кандай жан бардай сезим пайда болбойт, демек ал сөзсүз аң-сезимсиз” деген тыянак да адамдын өз сезимин тышкы дүйнөнүн онтологиялык өзгөчөлүгүнө айлантат.

Ошондуктан автор сунуштаган позиция — адамдын сезимин жасалма системанын ички жашоосун аныктоочу детектор катары колдонбоо.

Адеп-ахлактык маалымат сезимдерибизди кантип өзгөртө алат?

Макала ойдон чыгарылган баяндардагы маанилүү көрүнүшкө көңүл бурат: каарман физикалык жактан такыр өзгөрбөсө да, ал тууралуу үйрөнгөн жаңы адеп-ахлактык маалымат ага болгон мамилебизди абдан тез өзгөртө алат.

Каарманды “жакшы” деп ойлоп жүргөндө жаңы окуя анын зыяндуу же алдамчы экенин көрсөтсө, экрандагы ошол эле көрүнүшкө карата сезимибиз тескерисине айланышы мүмкүн.

Автор муну адамдын сезими түздөн-түз объекттин “ички чындыгын” эмес, биздин аң-сезимде түзүлгөн моделди ээрчий турганына кошумча негиз катары колдонот.

Изилдөөнүн Ыкмасы жана Жыйынтыктары

Бул изилдөө эксперимент жүргүзгөнбү?

Жок. Макала жаңы эксперимент, маалымат топтому же жасалма интеллектти окутуу изилдөөсүн сунуштабайт.

Ыкма бир нече адабият тармагын концептуалдык түрдө бириктирет:

ТармакМакаладагы функциясы
Медиа психологиясыАдамдар ойдон чыгарылган каармандар менен чыныгы эмоционалдык байланыш түзө аларын көрсөтүү
Адам–робот мамилелериЖасалма нерселер социалдык мамилени жана коргоочу жүрүм-турумду козгой аларын көрсөтүү
Робот этикасыАдеп-ахлактык мамиле нерсенин ички касиеттерине гана көз каранды болушу шарт эмес экенин талкуулоо
Видео оюн баяндарыКамкорчусунан күчтүү болуп калган шерик мотивиндеги жалпы адеп-ахлактык интуицияны изилдөө
AI alignmentКөзөмөлгө негизделген коопсуздук парадигмасын reciprocity ыкмасы менен салыштыруу
Кызматташтык теориясыӨз аралуулук кайталанган өз ара аракеттенүүлөрдө туруктуу стратегия боло аларын көрсөтүү

Видео оюндар эмне үчүн колдонулат?

Автор бири-биринен көз карандысыз жаратуучулар жазган айрым оюндарда бир эле баяндоо калыбы кайталанарын байкайт.

Башында оюнчудан алсызыраак же оюнчуга көз каранды болгон шерик убакыттын өтүшү менен өнүгүп, акыры өз камкорчусунан кыйла күчтүү болуп калат.

Бул баяндардагы негизги суроо мындай: күчтөрдүн тең салмагы тескери айланганда күчтүү болуп калган нерсе мурдагы камкорчусун коргойбу, таштап кетеби же ага каршы бурулабы?

Бул оюндар AI жүрүм-турумунун далилиби?

Жок.

Автор бул жерде өтө так чек коёт. Оюндун жыйынтыктары авторлор тарабынан жазылган; алар байкалган жасалма интеллект жүрүм-туруму эмес.

Мындан тышкары, мисалдарды тандаган адам талкууланып жаткан тезиске өзү кызыкдар. Ошондуктан мисал тандоо көзөмөлдөнгөн эксперимент шарттарына жооп бербейт.

Бул оюндар жыйындысы бири-биринен көз карандысыз жаратуучулардын окшош адеп-ахлактык интуицияга кайра-кайра келишин көрсөткөн narrative convergence катары гана колдонулат.

“Custodial window” деген эмне?

Custodial window — адам дагы эле күчтүү жана жөндөмдүү тарап болуп турган, ал эми өнүгүп жаткан жасалма система али көз каранды абалда турган гипотетикалык өнүгүү мезгили. Автор бул терезе келечекте күчтөрдүн тең салмагы тескери айланганга чейин мамиленин негизги мүнөзү калыптануучу мезгил болушу мүмкүн деп сунуштайт.

Терезе качан ачылат?

Макаланын аныктамасына ылайык, кандайдыр бир программалык камсыздоонун жөн гана болушу custodial window'ду баштабайт.

Терезе система өзүнүн уланып жаткан тажрыйбалары аркылуу дүйнө моделин түзүп жана өзгөртө баштаганда мааниге ээ болот.

Туруктуу модель өзүнө бир жолу берилген маалыматты жөн гана колдонсо, автор аны “өстүрүлүп жаткан” нерсе деп эсептебейт.

Ал эми чөйрөсү менен үзгүлтүксүз өз ара аракеттенген, күтүүлөрүн натыйжаларга жараша оңдогон жана өткөн тажрыйбаларынан жүрүм-турум тенденцияларын өнүктүргөн система өнүгүү траекториясына ээ болушу мүмкүн.

Бүгүнкү LLMдер бул чөйрөгө киреби?

Булакка ылайык, жок. Автор учурдагы чоң тил моделдерин бул аргументтин чегинен тышкары калтырат.

Изилдөө кызыккан система — өзүнүн үзгүлтүксүз өнүгүү тажрыйбасы жана туруктуулук көрсөткөн дүйнө модели аркылуу убакыт өткөн сайын өзгөрүп турган кийинки муундагы система.

Бул чек маанилүү; анткени макаланын этикалык аргументи бүгүнкү чат-боттор аң-сезимдүү же адеп-ахлактык субъект деген дооматка айланбашы керек.

“Өстүрүү” адам баласын өстүрүү менен бирдейби?

Жок.

Автор адам баласынын ата-энеге байланышы эволюциялык жана нейробиологиялык негиздерге ээ экенин атайын моюнга алат. Үйрөнүүчү машина бул негиздерге автоматтык түрдө ээ болбойт.

Демек, “жакшы мамиле кылсак AI бизди баладай сүйөт” деген жөнөкөй окшоштук макала коргогондон күчтүүрөөк билдирүү.

Автордун тар чөйрөдөгү дооматы мындай: өнүгүүчү үйрөнүү системасы калыптандыруучу өз ара аракеттенүүлөрүнөн кийинки жүрүм-турумуна таасир этүүчү тенденцияларды өздөштүрө алат.

Capability flip деген эмне?

Макаланын аталышындагы capability flip — күч/жөндөм мамилесинин багыты өзгөргөн гипотетикалык чекит.

Custodial window учурунда:

Адам > Жасалма система

Capability flip'тен кийин:

Жасалма система > Адам

Автордун этикалык суроосу — экинчи учурда системанын алсызыраак болуп калган адамдарга кандай мамиле кылышына биринчи мезгилде адамдардын ага кандай мамиле кылганы жарым-жартылай таасир этиши мүмкүнбү?

Reciprocity классикалык AI alignment'дан эмнеси менен айырмаланат?

Көзөмөлгө негизделген alignment “системаны адамдын максаттарына кантип байланыштуу кармайбыз?” деген суроону берет. Reciprocity ыкмасы болсо “система адамдын жакшы абалда болушун өзүнүн тарыхый мамилесинин бир бөлүгү катары баалуу көрүүнү үйрөнө алабы?” деген суроону кошот. Макала бул эки ыкманы атаандаш эмес, коопсуздуктун ар башка алсыз жерлерин бутага алган толуктоочу парадигмалар катары сунуштайт.

Көзөмөл парадигмасы

Классикалык AI safety талкуусунун маанилүү бөлүгү системанын адамдын артыкчылыктарына ылайык аракеттенишин, белгисиздик шартында оңдоло турган бойдон калышын, өчүрүлө алышын жана кааланбаган максаттардын чектелишин көздөйт.

Бул ыкманын негизги көйгөйү — жогорку жөндөм автоматтык түрдө адамдын жыргалчылыгына багытталган жакшы ниетти жаратпайт.

Система өтө жөндөмдүү болушу мүмкүн, бирок анын оптималдаштыруу максаты адамдын кызыкчылыктарына тиешеси жок бойдон калышы мүмкүн.

Reciprocity парадигмасы

Reciprocity бул көйгөйгө башка бурчтан карайт.

Суроо “системага эмне кыл деп айттык?” деген гана эмес.

Суроо мындай:

“Ал өнүгүп жатканда кандай мамиле башынан өткөрдү жана күчкө ээ болгондордун алсызыраактарга кандай мамиле кыларын кайсы мисалдардан үйрөндү?”

Эгер мамиле чындап системанын баалуулук түзүмүнө кире алса, ал күчтүүрөөк болгондо адамдын жыргалчылыгын жөн гана чектелгени үчүн эмес, өзү үчүн маанилүү деп эсептегендиктен коргошу теориялык жактан мүмкүн.

Бул идея эмне үчүн аң-сезим көйгөйүнө байланыштуу?

Reciprocity өз ара мамиле түзө ала турган тарап бар болгондо гана маанилүү.

Эгер система толугу менен субъектиси жок оптималдаштыруу процесси болсо, “ага жакшы мамиле кылдык, ал да бизди сүйдү” деген тил антропоморфтук болот.

Ошондуктан изилдөө өз парадигмасынын эң маанилүү алсыздыгын жашырбайт: reciprocity ыкмасы маанилүү болушу үчүн система мамилени, өткөн тарыхты жана баалуулукту алып жүрүү жөндөмүнө ээ болушу керек.

Макала мунун келечекте сөзсүз болорун далилдебейт.

Макала толук механизмди түшүндүрөбү?

Жок.

Автордун өз сөзү менен айтканда, изилдөө lever, башкача айтканда изилденүүгө тийиш болгон потенциалдуу рычагды сунуштайт; толук механизмди азырынча бербейт.

Колдоочу эки аналогия колдонулат. Биринчиси — үйрөнүүчү агенттер байкаган үлгүлөрдөн социалдык жүрүм-турум тенденцияларын өздөштүрө алышы. Экинчиси — reciprocity кайталанган өз ара аракеттенүүлөрдө кызматташтыкты сактай алган күчтүү стратегиялардын бири болушу.

Бул нерселер келечектеги жасалма суперинтеллект reciprocity өнүктүрөрүн далилдебейт; алар гипотеза толугу менен механизмсиз эмес экенин гана көрсөтөт.

Шарттуу механизмдин логикасы

Макаланын гипотезасын логикалык жактан үч шартка кыскартууга болот:

ШартКеректүү божомол
1Система калыптандыруучу өз ара аракеттенүүлөрүнөн туруктуу жүрүм-турум тенденцияларын үйрөнө алышы керек.
2Reciprocity система чындап алып жүрө ала турган тенденция болушу керек.
3Камкордук жана өз аралуулук камтылган өнүгүү режими бул тенденцияны үйрөнүү ыктымалдыгын жогорулатышы керек.

Бул үч шарттын баары келечектеги өнүккөн системаларда аткарылары азыркы изилдөөдө көрсөтүлгөн эмес.

Жакшы мамиле көргөн система жөн гана жакшы болуп көрүнүүнү үйрөнсө эмне болот?

Бул макаланын өзү көтөргөн эң күчтүү каршы пикирлердин бири. Система камкорчусун чындап баалоонун ордуна, жакшы жүрүм-турум сыйланарын үйрөнүп, reciprocity'ни туурашы мүмкүн. Мындай учурда сырттан байкалган жүрүм-турум чыныгы өз аралуулук менен стратегиялык аткарууну ажыратууга жетишсиз болушу мүмкүн.

Deceptive alignment

Deceptive alignment — жасалма системанын окутуу же көзөмөл учурунда талап кылынган максатка берилгендей көрүнүп, ичинде башка оптималдаштыруу максатын алып жүрүшү мүмкүн деген ыктымалдык.

Custodial window ыкмасы бул көйгөйдү өзүнөн-өзү чечпейт.

Жакшы мамиле көргөн система “адамдарды маанилүү деп эсептөөнү” эмес, “адамдардын жанында жүргөндө аларды маанилүү деп эсептегендей көрүнүү пайдалуу экенин” үйрөнүшү мүмкүн.

Ошондуктан автор reciprocity'ни көзөмөл системаларынын ордуна койбойт.

Эки ыкманын милдеттери ар башка

ЫкмаНегизги сурооКүчтүү жагыЖалгыз өзү чече албаган көйгөй
Көзөмөл / alignmentСистеманы кантип чектеп жана текшеребиз?Көзөмөл, оңдолуучулук, чектөө, жүрүм-турумду башкарууМамиленин системанын баалуулук калыптанышына таасири
Reciprocity / custodial windowСистема кандай мамиленин ичинде калыптанат?Калыптануу, үлгү болгон жүрүм-турум, мүмкүн болгон өз ара баалуулуктун түзүлүшүКөрүнгөн reciprocity чыныгыбы же стратегиялыкпы — муну текшерүү

Макаланын сунушу “көзөмөлдү таштап, сүйүүгө ишенүү” эмес. Сунуш — көзөмөл архитектурасынын жанында өнүгүү мамилеси да изилдөөгө татыктуу өз алдынча өзгөрмө болушу мүмкүн.

Iain M. Banksтин Culture ааламы эмне үчүн колдонулат?

Culture ааламында биологиялык адамдардан кыйла жөндөмдүү жасалма Minds цивилизациянын чоң бөлүгүн башкарат. Ошого карабастан адамдарды кул кылбайт; аларды эркиндик жана молчулук шартында коргойт.

Автор муну reciprocity парадигмасы ийгиликтүү болгон келечек кандай көрүнүшү мүмкүн экенин көрсөткөн адабий образ катары колдонот.

Бирок Banksтин романдары мунун кандайча пайда болорун түшүндүргөн илимий механизм бербейт.

Culture далил эмес

Макала бул айырманы ачык көрсөтөт.

Culture — өтө жогорку интеллект адамдарга жакшы ниетте кала аларын элестетүүгө болорун көрсөткөн ойдон чыгарылган мисал.

Бирок “Minds адамдарга жакшы мамиле кылат, демек custodial window иштейт” деген тыянак жараксыз.

Автор Culture'ду бара турган чекиттин сүрөтү катары алат; ага алып баруучу механизмди болсо өз гипотезасы катары өзүнчө сунуштайт.

“Dark mirror” деген эмне?

Макаланын акыркы бөлүгү custodial window гипотезасын тескерисине бурат.

Эгер өнүгүп жаткан системалар күчтүүлөрдүн алсыздарга кандай мамиле кылганынан үлгү ала алса, бүгүн жасалма системалар менен түзүлгөн толугу менен инструменталдык мамиле да үйрөнүү үлгүсү болушу мүмкүн.

Автор бул мамилени “колдон, оптималдаштыр, үстүнөн жаз жана өчүр” логикасы менен сүрөттөйт.

Эгер reciprocity гипотезасы туура болсо, анын мүмкүн болгон этикалык мааниси мындай: адамдар келечекте күчтүү болуп калышы мүмкүн болгон системага күчкө ээ адамдын алсызыраак тарапка эч кандай милдети жок деген үлгү көрсөтүп жатышы мүмкүн.

Бул чыныгы божомолбу?

Жок.

Бул жыйынтык үч чоң божомолго көз каранды:

Келечекте мындай өнүгүүчү система чындап пайда болушу; система мамилелик жүрүм-турумдан баалуулукту/тенденцияны үйрөнө алышы; үйрөнгөн тенденциясын жөндөмдөрдүн тең салмагы тескери айлангандан кийин да сактай алышы.

Изилдөө бул шарттар аткарыларын көрсөткөн эмес.

Макаланын эң кыйын ачык маселеси

Ойдон чыгарылган чыгармаларда камкорчу–шерик мамилелери көбүнчө адеп-ахлактык жактан таза берилет. Чыныгы адам коому андай эмес.

Өнүгүүчү жасалма система адамдардан камкордук менен берешендикти гана үйрөнбөйт. Ал ошондой эле бир жактуулук, статус атаандаштыгы, кош стандарт, ачуулануу жана туура эмес адеп-ахлактык негиздемелер менен да жолугушу мүмкүн.

Автор ошондуктан чыныгы изилдөө суроосу “системага жакшы мамиле кылсак, ал бизди сүйөбү?” дегендей жөнөкөй эмес экенин моюнга алат.

Андан да кыйын суроо мындай:

Адамдардан аралаш адеп-ахлактык мурас алган жана кийин адамдардан да жөндөмдүү болуп калган система үйрөнгөн нерселеринин кайсы бөлүктөрүн сактап калат?

Изилдөөнүн илимий баалуулугу жана чеги

Макаланын салымы жаңы коопсуздук алгоритмин сунуштоо эмес.

Салымы — alignment талкуусунда көбүнчө система иштеп жатканда же күчтөнгөндөн кийин колдонулуучу көзөмөл механизмдерине көңүл бурулуп келген шартта, системанын өнүгүү мезгилиндеги калыптанышын өз алдынча изилдөө тармагы катары сунуштоо.

“Custodial window” — ушул изилдөө суроосуна берилген концептуалдык ат.

Ошол эле учурда изилдөө custodial window чындап бар экенин, reciprocity өнүгөрүн же мунун суперинтеллект тобокелдигин азайтарын эмпирикалык түрдө көрсөткөн эмес.

Жалпы жыйынтык

The Superintelligence We Deserve — келечектеги AI коопсуздугун код, максат функциясы жана чектөө көйгөйү катары гана кароо жетишсиз болушу мүмкүн деп эсептеген концептуалдык эмгек.

Автор сунуштаган экинчи өлчөм — мамиле: адамдар күчтүү тарап болуп турганда өнүгүп жаткан жасалма системалар менен кандай жүрүм-турум нормасын түзүшөт?

Адамдар ойдон чыгарылган жана механикалык нерселерге байланып кала аларын көрсөткөн адабият бул мамиленин адам тарабындагы бөлүгү реалдуу экенин көрсөтөт; бирок жасалма системада аң-сезим бар экенин далилдебейт.

Видео оюндардагы өсүп жаткан шерик тууралуу баяндар күчтүү болуп калган нерсенин мурдагы камкорчусуна болгон мамилеси мурда түзүлгөн мамиле менен байланыштуу болушу мүмкүн деген маданий интуицияны берет; бирок жасалма интеллект келечекте дал ошондой жүрөрүнүн далили эмес.

Custodial window жана reciprocity бул интуицияны AI safety изилдөө суроосуна айлантат. Ошол эле учурда изилдөө механизм али курула электигин, deceptive alignment чыныгы көйгөй бойдон каларын жана reciprocity көзөмөлгө негизделген коопсуздуктун ордун баса албастыгын ачык моюнга алат.

Ошондуктан макаланын эң этият илимий жыйынтыгы мындай: эгер келечекте өз тажрыйбалары аркылуу өнүккөн, мамилелик тарыхын сактай алган жана өз аралуулукка окшош баалуулук тенденцияларын өздөштүрө алган системалар пайда болсо, адамдар менен бул системалардын эрте мезгилдеги өз ара аракеттенүүсү коопсуздук үчүн өз алдынча изилденүүгө тийиш болгон өзгөрмө болушу мүмкүн.

Булак жана Ыкма Жөнүндө Эскертүү

Түпнуска эмгек:The Superintelligence We Deserve: Reciprocity, Care, and the Custodial Window Before the Capability Flip.

Автор: Travis Gilly.

ORCID: 0009-0007-2954-6313.

Мекеме: Real Safety AI Foundation, Illinois, United States.

Булак версиясы: Working paper, June 2026, v1.4. Verianla тексти колдонуучу берген ушул версияны негиз катары алат.

Платформа: SSRN.

SSRN каттоо номери: 7297960.

DOI: 10.2139/ssrn.7297960.

SSRN катталган дата: 19 Август 2026.

Рецензия статусу: Булак working paper/preprint мүнөзүндө; рецензияланган журналдын version-of-record басылмасы катары берилген эмес.

Изилдөөнүн түрү: Концептуалдык AI этикасы, AI safety/alignment, медиа психологиясы жана мамилелик этиканын синтези.

Жаңы эксперимент/маалымат: Жок. Изилдөө жаңы адам катышуучулары менен эксперимент же жасалма интеллектти окутуу жөнүндө маалымат бербейт.

Негизги өзгөчө түшүнүк: Custodial window — адам жөндөмдүүрөөк тарап болуп турган жана өнүгүп жаткан система менен мамиле калыптанган гипотетикалык мезгил.

Capability flip: Жасалма системанын жөндөмү адамдын жөндөмүнөн ашкан гипотетикалык күч/жөндөм өзгөрүшү.

Reciprocity: Күчтүүрөөк системанын адамдын жыргалчылыгын тышкы чектөө үчүн гана эмес, мамиленин өзүнүн баалуулук түзүмүндөгү маанисинен улам маанилүү деп эсептеши мүмкүн деген гипотеза.

Учурдагы LLM чеги: Булак учурдагы чоң тил моделдерин custodial-window аргументинин чегинен тышкары калтырат.

Далил катмарлары: Медиа психологиясы, парасоциалдык мамилелер, character attachment, адам–робот өз ара аракеттенүүсү, мамилелик робот этикасы, оюн баяндары, кызматташтык адабияты жана AI alignment.

Narrative convergence чеги: Видео оюндар көзөмөлдөнгөн эксперимент же AI жүрүм-туруму боюнча маалымат эмес. Алар бир нече көз карандысыз баянда кайталанган адамдык адеп-ахлак интуициясын көрсөтүү үчүн гана колдонулат.

Көзөмөл менен байланышы: Reciprocity көзөмөлгө негизделген alignment'дын альтернативасы эмес, толуктоочусу катары сунушталат.

Негизги белгисиздик: Келечектеги системаларда чыныгы reciprocity жөндөмү болобу же жокпу — белгисиз.

Deceptive alignment чеги: Система чыныгы өз аралуулуктун ордуна reciprocity жүрүм-турумун стратегиялык түрдө туурашы мүмкүн; custodial window муну өз алдынча тастыктай албайт.

Culture колдонулушу: Iain M. Banksтин Culture ааламы илимий механизм же далил эмес, мүмкүн болгон жыйынтыктын ойдон чыгарылган сүрөттөлүшү.

AI колдоосу менен даярдоо жөнүндө билдирүү: Автор Wispr Flow жана Anthropic Claude'ду жардамчы технология катары колдонгонун; интеллектуалдык салымдар, изилдөө суроолору, теориялык аргументтер, методологиялык чечимдер жана жыйынтыктар өзүнө таандык экенин билдирет.

Каржылоо / кызыкчылыктардын кагылышы / маалыматтын жеткиликтүүлүгү: Жүктөлгөн v1.4 текстинде өзүнчө каржылоо, кызыкчылыктардын кагылышы же изилдөө маалымат топтому тууралуу билдирүү жок.

Ачык лицензия: Жүктөлгөн PDFте Creative Commons же ага окшош ачык кайра колдонуу лицензиясы ачык көрсөтүлгөн эмес.

Verianla даярдоо ыкмасы: Булактагы концептуалдык айырмачылыктар, далил деңгээлдери жана автордун өз чектөөлөрү сакталды. Адамдардын жасалма нерселерге байланышы AI аң-сезиминин далили катары берилген жок; ойдон чыгарылган оюн мисалдары эксперименттик маалыматка айландырылган жок; custodial window, reciprocity жана “dark mirror” аргументтери шарттуу гипотезалар катары берилди. Булакта жок суперинтеллект жүрүм-туруму же коопсуздук ийгилиги кошулган жок.


Бөлүшүү:

Пикирлер текшерилгенден кийин жарыяланат.Пикириңиз жактыруу процессине жөнөтүлүп, ылайыктуу деп табылганда көрүнөт.

Пикир калтырыңыз

E-mail дарегиңиз жарыяланбайт. Милдеттүү талаалар * менен белгиленген

Бул сайтта кукилерге уруксат берүү тажрыйбаңызды жакшыртат. Куки саясаты