INTERAKTĪVS MI CEĻVEDIS: Vērtējiet uzvedību, pēc tam pārbaudiet pierādījumus Ienākt laboratorijā
Vēsturisks teleprinteris tumšā telpā, kur divi anonīmi cilvēki sarunājas aiz ekrāniem

Cilvēks vai mašīna?

Tjūringa tests

Ieskatieties aiz ekrāna, novērtējiet astoņas anonīmas sarakstes un uzziniet, kāpēc šķietami vienkārša spēle 75 gadus ir veidojusi diskusiju par mašīnām, valodu un intelektu.

Akli spriedumi 8 sarunu kārtas Apgalvojumi rūpīgi precizēti

Vispirms izlasiet šo

Īsta ideja — atveidota bez viltus zinātniskiem apgalvojumiem

Zemāk esošā interaktīvā laboratorija precīzi atveido aklu salīdzināšanu, obligātu izvēli, pārliecības novērtēšanu un rezultātu atklāšanu pēc testa. Tās sarunas ir redakcionālas simulācijas, nevis dzīva kontrolēta pētījuma ieraksti. Jūsu rezultāts mēra, cik labi jūsu minējumi sakrīt ar šīs demonstrācijas slēptajiem marķējumiem; tas nepierāda, vai mūsdienu MI domā.

Pierādījumi pārskatīti un lapa atjaunināta 08.2026.

1950Publicēts nozīmīgais rakstsŽurnālā Mind
Tikai tekstsIdentitātes pazīmes ir paslēptasUzvedību vērtē dialogā
Nav oficiāla sliekšņaProtokoli „nokārtošanu” definē atšķirīgi30% nav universāls likums
Uzvedība ≠ prātsRezultāts ir neatšķiramībaApziņa netiek tieši mērīta

Interaktīvs eksperiments

Imitācijas spēles laboratorija

Jūs esat iztaujātājs. Katrā kārtā viena atbilde nes simulācijas slēpto mašīnas marķējumu, bet otra — cilvēka marķējumu. Izvēlieties mašīnu un norādiet savu pārliecību.

Progress0/8

Godīguma piezīme: šie ir apzināti radīti mācību piemēri, nevis dzīvi cilvēki vai konkrēta modeļa izvades. Tie parāda bieži lietotas pazīmes un to, kāpēc tās nav uzticamas.

Jūsu lomaJūs vērtējat atbildes, nevis pats atbildat uz uzvednēm
  1. 1

    Izlasiet abu liecinieku atbildes. Salīdziniet, kā A un B reaģē uz vienu un to pašu uzvedni.

  2. 2

    Izvēlieties atbildi, kurai, jūsuprāt, ir mašīnas marķējums. Katrā pārī ir tieši viena šāda atbilde.

  3. 3

    Norādiet pārliecību no 50 līdz 100%. Izvēlieties 50%, ja tas ir tīrs minējums, un 100% tikai tad, ja esat pilnīgi pārliecināts.

Noderīgi, taču nepilnīgi pavedieni:konteksts un pragmatisks spriedumskonkrētība bez pārliekas skaidrošanaskonsekvencedabiska labošanaadaptīvs humorsNevainojama gramatika pati par sevi nepierāda, ka atbildi radījusi mašīna.
01Atmiņa un detaļasAprakstiet nelielu, ikdienišķu šīs nedēļas brīdi, kas jums palicis atmiņā.
02DaudznozīmībaSems pateica Aleksam, ka viņu prezentācija ir mulsinoša. Kam piederēja prezentācija?
03HumorsIzdomājiet sliktu joku par printeri.
04LabošanaMan ir trīs āboli. Es apēdu divus un nopērku vēl vienu. Tātad tagad man ir trīs, vai ne?
05Sociālais spriedumsDraugs ar lepnumu pasniedz ēdienu, kas jums negaršo. Ko jūs sakāt?
06Ķermeniska detaļaKas ir kaitinošs, atverot jaunu burku?
07Ierobežojumu ievērošanaAtbildiet tieši sešos vārdos: kāpēc cilvēki glabā vecas biļetes?
08MetakognīcijaKāds jautājums jums palīdzētu izlemt, vai es esmu cilvēks?

Būtiskā definīcija

Ko Tjūringa tests patiesībā pārbauda

Uzvedības kritērijs, nevis smadzeņu skenējums

Vērtētāja uzdevums ir epistemisks: Vai no sarunas varu noteikt, kurš dalībnieks ir mašīna? Ekrāns paslēpj izskatu, balsi un mehānisko uzbūvi. Ja protokola ietvaros mašīnas uzvedība kļūst neatšķirama no cilvēka uzvedības, mašīna šajā imitācijas uzdevumā gūst panākumus.

Piesardzīgais apgalvojums: „Šajā eksperimentā mašīnu nevarēja uzticami atšķirt no cilvēka salīdzinājuma.” Tas ir spēcīgāks apgalvojums nekā vienkārši teikt, ka tā skanēja plūstoši, un šaurāks nekā pasludināt to par apzinīgu.

Aklums

Vērtētājam nevajadzētu zināt liecinieka identitāti vai saņemt blakuskanālu pavedienus, piemēram, rakstīšanas ātrumu, saskarnes atšķirības vai metadatus.

Salīdzinājums

Cilvēku liecinieki ir svarīgi. Viņu identifikācijas rādītājs parāda, cik bieži īstus cilvēkus tādos pašos apstākļos sajauc ar mašīnām.

Secinājums

Rezultātiem vajadzīgs izlases lielums, nenoteiktības novērtējums un pirms datu apskates izvēlēts noteikums, nevis pēc veiksmīgas sarunas izraudzīts virsraksts.

Eksperimenta plāns

Kā veikt ticamu mūsdienu Tjūringa testu

  1. 01

    Uzrakstiet apgalvojumu pirms testēšanas

    Norādiet, vai iznākums ir identifikācijas precizitāte, „cilvēka” rādītājs, pāru uzvaru rādītājs vai statistiska līdzvērtība cilvēku lieciniekiem.

  2. 02

    Atlasiet salīdzināmus dalībniekus

    Definējiet vērtētāju pieredzi, valodu, cilvēku liecinieku kopu, iekļaušanas noteikumus un atlīdzību. Bērna tēls vai otrās valodas lietotāja tēls maina uzdevumu.

  3. 03

    Standartizējiet piekļuvi

    Dodiet cilvēkiem un mašīnām salīdzināmu laiku, zināšanu rīkus un ziņojumu ierobežojumus. Izlemiet, vai ir atļauta tīmekļa pārlūkošana, aizkaves, labojumi un atteikumi.

  4. 04

    Randomizējiet un nodrošiniet aklumu

    Nejauši piešķiriet apstākļus un paslēpiet identitātes. Normalizējiet saskarni, lai fonti, atbilžu laiks un sistēmas kļūdas neatklātu pareizo atbildi.

  5. 05

    Izmantojiet dzīvu, adaptīvu dialogu

    Ļaujiet vērtētājiem uzdot papildjautājumus. Reģistrējiet pilnus transkriptus, modeļa versiju, uzvedni, parametrus un jebkuru moderācijas slāni, kas vajadzīgs replikācijai.

  6. 06

    Analizējiet visu datu kopu

    Ziņojiet cilvēku un mašīnu bāzes līmeņus, ticamības intervālus, izslēgtos gadījumus, kļūmes un apakšgrupu rezultātus. Viens apmānīts vērtētājs ir anekdote, nevis testa nokārtošana.

Mainīgie, kas var pilnībā mainīt rezultātu
Dizaina izvēleKāpēc tas ir svarīgiNorādiet to
IlgumsPiecu minūšu sarunas atalgo pirmo iespaidu; ilgs dialogs atklāj konsekvenci un atmiņu.Minūtes, gājieni un ziņojumu ierobežojumi
Vērtētāju kopaMI eksperti, pūļa platformu darbinieki un parasti lietotāji izmanto atšķirīgus pavedienus.Atlase, pieredze un valoda
Cilvēku bāzes līmenisDaži īsti cilvēki regulāri tiek klasificēti kā mašīnas.Cilvēku „cilvēka” rādītājs un nenoteiktība
Modeļa iestatījumiUzvednes, paraugu ņemšana, rīki un tēla instrukcijas var dominēt sniegumā.Precīzs modelis/versija un iestatījumi
SaskarneAizture, drukas kļūdas, formatējums vai drošības ziņojumi var atklāt identitāti.Akluma un normalizācijas procedūra
Nokārtošanas kritērijsNejaušība, 30%, nepazemināta efektivitāte un neatšķiramība ir atšķirīgi apgalvojumi.Iepriekš reģistrēta hipotēze un statistika

1950. gada oktobris · Mind 59(236)

Ko Alans Tjūrings patiesībā ierosināja

Tjūrings sāka ar jautājumu „Vai mašīnas spēj domāt?” un uzreiz norādīja, ka vārdu mašīna un domāt ierastās nozīmes ir pārāk neskaidras jēgpilnai izpētei. Viņš tās aizstāja ar „imitācijas spēli”.

Rakstā vispirms aprakstīta trīs personu spēle ar vīrieti, sievieti un iztaujātāju, kuram viņi jāidentificē pēc rakstiskām atbildēm. Tad Tjūrings jautā, kas notiek, ja vienu lomu ieņem mašīna. Citviet rakstā viņš apspriež tiešāku mašīnas un cilvēka salīdzinājumu. Zinātnieki joprojām diskutē, kuru tieši formulējumu vajadzētu saukt par īsto Tjūringa testu.

Deviņi iebildumi, viena ilgstoša diskusija

Argumenti, ar kuriem Tjūrings saskārās 1950. gadā

01

Teoloģiskais

Domāšana ir saistīta ar nemirstīgu dvēseli, kas piemīt tikai cilvēkiem.

02

„Galva smiltīs”

Domājošu mašīnu sekas būtu pārāk briesmīgas, tāpēc gribas cerēt, ka tās nevar pastāvēt.

03

Matemātiskie ierobežojumi

Formālām sistēmām ir ierobežojumi; Tjūrings atbild, ka arī cilvēki kļūdās un viņiem var būt ierobežojumi.

04

Apziņa

Par mašīnu nevar teikt, ka tā domā, ja vien tā nejūt un nezina, ka jūt.

05

Nespējas

Tiek apgalvots, ka mašīnas nekad nevar būt laipnas, radošas, asprātīgas, atjautīgas vai darīt neskaitāmas citas cilvēciskas lietas.

06

Lēdija Lavleisa

Mašīna var darīt tikai to, ko mēs zinām, kā tai likt darīt; Tjūrings apsver pārsteigumu un mācīšanos.

07

Nervu sistēmas nepārtrauktība

Smadzenes darbojas nepārtraukti, bet digitālie datori — diskrēti. Spēle attiecas uz novērojamām atbildēm.

08

Neformāla uzvedība

Neviena galīga noteikumu grāmata nenosaka visas cilvēku darbības; tas nepierāda, ka uzvedība nevar rasties mašīnā.

09

Ekstrasensorā uztvere

Tjūrings pārsteidzošā kārtā uzskatīja telepātiju par iespējamu traucējošu faktoru un iztēlojās „pret telepātiju drošu telpu”.

No izskaitļojamības līdz tērzēšanas botiem

Pilna Tjūringa testa vēsture

Šī laika līnija nodala Tjūringa rakstus, vēlākus eksperimentus un mūsdienu apgalvojumus par testa „nokārtošanu”. Līdzīgi nosaukumi nenozīmē identiskus protokolus.

1936
Nodaļa 01

Universāls skaitļošanas modelis

Tjūringa rakstā par izskaitļojamiem skaitļiem tika aprakstīta abstrakta mašīna, ko tagad sauc par Tjūringa mašīnu. Tas nebija Tjūringa tests, taču raksts lika pamatus vispārīga lietojuma skaitļošanai.

1948
Nodaļa 02

„Inteliģentās mašīnas”

Nepublicētā National Physical Laboratory ziņojumā Tjūrings apsprieda mašīninteliģenci, mācīšanos un neorganizētas mašīnas — svarīgus priekšvēstnešus viņa vēlākajai argumentācijai.

1950
Nodaļa 03

Tiek publicēta imitācijas spēle

Žurnāls Mind publicēja rakstu „Skaitļošanas mašīnas un intelekts”. Tjūrings neskaidro jautājumu „Vai mašīnas spēj domāt?” aizstāja ar operacionālām imitācijas spēlēm, kas notiek rakstiskā saziņā.

1956
Nodaļa 04

Mākslīgais intelekts iegūst nosaukumu

Dartmutas vasaras pētniecības projekta priekšlikumā tika lietots termins „mākslīgais intelekts” un apgalvots, ka mācīšanās un intelekta aspektus principā varētu pietiekami precīzi aprakstīt mašīnai.

1966
Nodaļa 05

ELIZA demonstrē sarunas ilūziju

Džozefa Veizenbauma ELIZA izmantoja paraugu atbilstības meklēšanu un iepriekš izstrādātas transformācijas. Tās DOCTOR skripts parādīja, cik viegli cilvēki var piedēvēt izpratni salīdzinoši vienkāršai dialoga uzvedībai.

1972
Nodaļa 06

PARRY saskaras ar neatšķiramības testiem

Kenets Kolbijs ar kolēģiem vērtēja paranoisku procesu modeli, lūdzot vērtētājiem atšķirt ar teletaipu veiktas intervijas ar programmu no intervijām ar pacientiem.

1980
Nodaļa 07

Ķīniešu istabas iebildums

Džons Sērls argumentēja, ka atbilstošu simbolu virkņu radīšana ne vienmēr nozīmē izpratni, tādējādi saasinot atšķirību starp uzvedības panākumiem un apgalvojumiem par iekšējiem mentālajiem stāvokļiem.

1990–91
Nodaļa 08

Sākas Lēbnera balvas ēra

Hjū Lēbners finansēja ikgadēju konkursu, kas balstīts uz ierobežotiem Tjūringa testiem. Tas popularizēja ideju, taču kritiķi norādīja, ka īsas sarunas un balvas veicināja sarunvalodas trikus.

2014
Nodaļa 09

Eugene Goostman nonāk virsrakstos un strīdos

Rīdingas Universitātes pasākumā botu, kas tēloja 13 gadus vecu ukraini, 33% vērtētāju novērtēja kā cilvēku. Organizatori to nosauca par testa nokārtošanu; daudzi pētnieki noraidīja apgalvojumu par „pirmo” reizi un aizgūto 30% noteikumu.

2024
Nodaļa 10

Iepriekš reģistrēts GPT-4 pētījums

Džounss un Bergens ziņoja par randomizētu, kontrolētu un iepriekš reģistrētu divu dalībnieku testu: piecu minūšu sarunās GPT-4 par cilvēku tika atzīts 54% gadījumu, salīdzinot ar 67% cilvēku lieciniekiem un 22% ELIZA.

2025
Nodaļa 11

Jauni modeļi, jauni varianti

Turpmākie pētījumi ziņoja, ka dažos konkrētos piecu minūšu dizainos noteikti ar uzvednēm vadīti lielie valodas modeļi statistiski neatšķīrās no cilvēku lieciniekiem, bet ACL pētījumos tika izmēģināti ilgāki un dinamiskāki testa formāti.

Šodien
Nodaļa 12

Nav vienas oficiālas finiša līnijas

„Tjūringa tests” tagad apzīmē veselu uzvedības eksperimentu saimi. Rezultāti ir atkarīgi no modeļa, uzvednes, cilvēkiem, vērtētāju kopas, ilguma, saskarnes, salīdzinājuma bāzes līmeņa un statistikas noteikuma.

Godīgs spriedums

Vai mašīna ir nokārtojusi Tjūringa testu?

Jā, saskaņā ar dažiem definētiem testiem; nē, saskaņā ar vienu universālu standartu.

Nav oficiālas Tjūringa testa autoritātes, fiksētas vērtētāju kopas, obligāta ilguma vai universāli pieņemta sliekšņa. Katram apgalvojumam jāpievieno tā protokols.

Agrīni pierādījumi

PARRY · 1972

Vērtētāji salīdzināja ar teletaipu veiktas psihiatriskas intervijas ar paranoisku procesu simulāciju un īstiem pacientiem. Tas bija fokusēts validācijas pētījums, nevis neierobežota vispārīga saruna.

Strīdīga nokārtošana

Eugene Goostman · 2014

Tiek ziņots, ka piecu minūšu sarunās 33% vērtētāju botu klasificēja kā cilvēku. Tā 13 gadus veca svešvalodas runātāja tēls deva attaisnojumus kļūdām; apgalvojums par „pirmo nokārtošanu” tika plaši apstrīdēts.

Kontrolēts pētījums

GPT-4 · 2024

Iepriekš reģistrētā randomizētā pētījumā GPT-4 54% sesiju tika novērtēts kā „cilvēks”, bet īsti cilvēki — 67%. Tas atbalsta neatšķiramības secinājumu konkrētajā divu dalībnieku piecu minūšu dizainā.

Virsrakstu atšifrētājs: ar „apmānītiem vērtētājiem” nepietiek. Jautājiet: salīdzinājumā ar kādiem cilvēkiem, cik ilgi, ar kādu uzvedni, cik izmēģinājumos un izmantojot kādu statistisko testu?

Ko var paslēpt plūdums

Ko tests var un ko nevar pierādīt

Tas var sniegt pierādījumus par…

  • Cilvēkam līdzīgu sarunvalodas uzvedību
  • Sociālu un lingvistisku pielāgošanos
  • Konsekvenci visas mijiedarbības gaitā
  • Vērtētāja spēju atšķirt dalībniekus noteiktos apstākļos
  • Kā konkrēti modeļi salīdzinās ar cilvēku lieciniekiem

Pats par sevi tas nevar pierādīt…

  • Apzinātu pieredzi vai pašapziņu
  • Patiesumu, faktu precizitāti vai gudrību
  • Vispārīgu kompetenci ārpus sarunas
  • Iemiesotu uztveri vai īstas personiskas atmiņas
  • Drošību, morālo statusu vai cilvēkam līdzvērtīgu intelektu

Tas atalgo imitāciju

Spējīgs necilvēcisks intelekts varētu neizturēt testu, jo neizliekas par cilvēku; sekla sistēma varētu gūt panākumus ar tēlu un izvairīgām taktikām.

Tas ir kultūrspecifisks

Vērtētāji dialektu, invaliditāti, formālu stilu vai rakstīšanu otrajā valodā var sajaukt ar mašīnas uzvedību. Cilvēciskums nav neitrāls mērķis.

Uzvedība nenosaka mehānismu

Līdzvērtīgas atbildes var rasties no atšķirīgiem iekšējiem procesiem. Transkripta kvalitāte vien neatklāj, kā sistēma reprezentē vai saprot informāciju.

Tas nav spēju etalonuzdevums

Mūsdienu novērtēšanā parasti atsevišķi vērtē spriešanu, programmēšanu, faktu pareizību, noturību, drošību un jomas kompetenci, nevis visu reducē uz spēju maldināt.

Iztaujātāja lauka ceļvedis

Labāki jautājumi dzīvajam testam

Nav maģiskas uzvednes, kas atklātu mašīnu. Izmantojiet sazarotus jautājumus, kas prasa kontekstu, un vēlāk atgriezieties pie iepriekš teiktā.

01

Piesaistiet atmiņu detaļām

„Aprakstiet telpu un pēc tam pasakiet, kuru detaļu pamanījāt tikai pēc ieiešanas.”

Papildjautājums: mainiet laiku vai skatpunktu.
02

Atklājiet daudznozīmību

Piedāvājiet teikumu ar divām ticamām nozīmēm un pajautājiet, kuru no tām steigā secinātu cilvēks.

Papildjautājums: pajautājiet, kāds konteksts mainītu secinājumu.
03

Pārbaudiet nepārtrauktību

Sarunas sākumā ieviesiet nelielu faktu, nomainiet tēmu un vēlāk uzdodiet jautājumu, kas no tā atkarīgs.

Papildjautājums: pieklājīgi norādiet uz nekonsekvenci.
04

Izmantojiet sociālu spriedzi

Piedāvājiet dilemmu, kurā konfliktē godīgums, takts, lojalitāte un sekas.

Papildjautājums: mainiet attiecību veidu.
05

Pieprasiet pārveidošanu

Lūdziet joku, pēc tam prasiet to padarīt mazāk acīmredzamu, īsāku un piemērotu konkrētai auditorijai.

Papildjautājums: pajautājiet, kāpēc labojums darbojas.
06

Aiciniet atzīt nenoteiktību

Uzdodiet nepietiekami precizētu jautājumu un vērojiet, vai liecinieks pamana trūkstošo informāciju.

Papildjautājums: pievienojiet pa vienam trūkstošam faktam.

Izvairieties no kategoriju kļūdām

Tjūringa tests salīdzinājumā ar citiem MI novērtējumiem

NovērtējumsGalvenais jautājumsSpēcīgākie pierādījumiTieši nepierāda
Tjūringa testsVai vērtētāji spēj atšķirt mašīnas sarunu no cilvēka sarunas?Akla mijiedarbība un cilvēku bāzes līmenisApziņu vai faktu uzticamību
Spēju etalonuzdevumsVai sistēma spēj atrisināt definētu uzdevumu klasi?Atliktie uzdevumi, piesārņojuma kontrole, kļūdu analīzeCilvēciskumu
Drošības novērtējumsKā sistēma uzvedas riskantos vai adversariālos apstākļos?Apdraudējumu modelis, sarkanās komandas testēšana, uzraudzība praksēVispārīgu intelektu
IQ testsKā cilvēka sniegums salīdzinās ar vecuma normām?Standartizācija, uzticamība un derīgumsMašīnas apziņu vai imitāciju
Pilnais Tjūringa testsVai sistēma spēj līdzināties cilvēkam uztverē, valodā un fiziskā rīcībā?Multimodāla un robotiska mijiedarbībaUnikālu iekšēju mehānismu

Skaidras atbildes

Biežāk uzdotie jautājumi

Kas ir Tjūringa tests?

Tas ir uzvedības tests, kuru iedvesmojusi Alana Tjūringa imitācijas spēle. Vērtētājs sazinās teksta kanālā ar slēptiem dalībniekiem un cenšas atšķirt mašīnu no cilvēka. Panākums attiecas uz neatšķiramu sarunvalodas uzvedību noteiktos apstākļos, nevis tiešu piekļuvi domām vai apziņai.

Vai „Turin test” ir tas pats?

„Turin test” ir izplatīta kļūdaina rakstība. Pareizais nosaukums ir Tjūringa tests, kas nosaukts britu matemātiķa un datorzinātnes pioniera Alana M. Tjūringa vārdā. Turīna ir pilsēta Itālijā.

Vai iepriekš redzamā interaktīvā laboratorija ir īsts zinātnisks Tjūringa tests?

Nē. Tā ir pārskatāma izglītojoša aklas vērtēšanas simulācija. Pamatotam eksperimentam vajadzīgi dzīvi vai konsekventi ierakstīti cilvēku un mašīnu liecinieki, nejauša sadale, definēts protokols, pietiekams vērtētāju skaits, iepriekš reģistrēti iznākumi un statistiska analīze.

Vai Tjūrings teica, ka mašīna nokārto testu, ja apmāna 30% vērtētāju?

Ne kā universālu nokārtošanas noteikumu. 1950. gadā viņš prognozēja, ka ap 2000. gadu vidējam iztaujātājam pēc piecām minūtēm būs ne vairāk kā 70% iespēja pareizi noteikt identitāti. Vēlāk šo fragmentu bieži pārinterpretēja kā 30% apmānīšanas slieksni.

Vai kāds MI ir nokārtojis Tjūringa testu?

Dažās operacionālās versijās — jā. Taču nav vienas universāli pieņemtas versijas, autoritātes vai standarta. ELIZA, PARRY, Lēbnera konkursa dalībnieki, Eugene Goostman un mūsdienu valodas modeļi ir testēti pēc atšķirīgiem protokoliem, tāpēc vārds „nokārtoja” vienmēr jāprecizē.

Vai testa nokārtošana pierāda intelektu?

Tas parāda veiksmīgu cilvēkam līdzīgu sarunvalodas uzvedību konkrētajā vidē. Tas, vai to pamatoti saukt par intelektu, ir atkarīgs no definīcijas. Pats par sevi tas nepierāda patiesumu, spriešanas plašumu, apziņu, emocijas, iemiesojumu vai drošu kompetenci reālajā pasaulē.

Vai testa nenokārtošana pierāda, ka sistēma nav inteliģenta?

Nē. Kalkulators, teorēmu pierādītājs vai zinātniska sistēma var būt ļoti spējīga, neatdarinot ikdienišķu cilvēku sarunu. Tests atalgo konkrētu sociāli lingvistisku sniegumu.

Kāpēc saruna notiek tikai tekstā?

Barjera neļauj vērtētājiem izmantot izskatu, balsi vai fizisko uzbūvi kā īsceļus. Tjūrings iztēlojās teleprinterim līdzīgu kanālu. Teksts izolē sarunvalodas pierādījumus, lai gan mūsdienu variantos dažkārt pievieno redzi vai robotiku.

Kas ir pilnais Tjūringa tests?

Tas ir vēlāk radīts paplašinājums, kas pievieno uztveri un fizisku mijiedarbību, parasti prasot ne tikai valodu, bet arī redzi un robotiku. To nevajadzētu sajaukt ar tikai teksta iestatījumu Tjūringa 1950. gada rakstā.

Kādi jautājumi darbojas vislabāk?

Adaptīvi papildjautājumi darbojas labāk nekā mīklu saraksts. Lūdziet precizēt, atgriezieties pie agrākiem apgalvojumiem, ieviesiet daudznozīmību, pārbaudiet sociālo kontekstu, prasiet radoši ievērot ierobežojumus un pārbaudiet pretrunas. Neviens atsevišķs jautājums nespēj uzticami identificēt mūsdienu MI.

Vai vērtētāji var vienkārši jautāt par jaunākajām ziņām vai privātām atmiņām?

Tas var radīt negodīgus īsceļus. Sistēmai pēc konstrukcijas var nebūt tīmekļa pārlūkošanas, bet cilvēks var nezināt jaunākās ziņas. Arī personisku atmiņu apgalvojumus var izdomāt. Labs protokols definē atļauto zināšanu apjomu un nodrošina salīdzināmu piekļuvi.

Kāpēc mašīnas jāsalīdzina ar īstiem cilvēku lieciniekiem?

Cilvēki nosaka pozitīvās kontroles bāzes līmeni. Ja vērtētāji daudzus īstus cilvēkus apzīmē kā mašīnas, uzdevums vai vērtētāju kalibrācija var būt slikta. Mašīnu „cilvēka” rādītājus ir grūti interpretēt bez cilvēku un nejaušības bāzes līmeņiem.

Vai īsi testi ir uzticami?

Īsas sesijas ir ērtas, taču tās ir vieglāk apmānīt un tās var galvenokārt mērīt pirmo iespaidu. Ilgākas, atkārtotas, adversariālas un starpdomēnu sarunas sniedz spēcīgākus pierādījumus, vienlaikus palielinot izmaksas, nogurumu un dizaina izvēļu skaitu.

Kas ir ELIZA efekts?

Tā ir tendence virspusējās datora atbildēs saskatīt izpratni vai aģentiskumu. Apzīmējums radās no reakcijām uz ELIZA un joprojām ir aktuāls, kad plūstoša izvade mudina cilvēkus secināt vairāk, nekā pamato pierādījumi.

Vai Tjūringa tests ir IQ tests?

Nē. IQ testi salīdzina sniegumu standartizētos kognitīvos uzdevumos ar vecuma normām. Tjūringa tests vērtē, vai noteiktā protokolā vērtētājs spēj identificēt sarunājošos mašīnu.

Izsekojiet apgalvojumu avotiem

Primārie un akadēmiskie avoti

Iepriekš sniegtajā vēsturē priekšroka dota oriģinālajiem rakstiem un pētniecības ierakstiem. Mūsdienu rezultāti tiek norādīti kopā ar pētījuma apstākļiem, nevis pasniegti kā universāli atskaites punkti.

Tjūrings (1950), „Skaitļošanas mašīnas un intelekts”

Primārais raksts žurnālā Mind, 59. sējums, 236. numurs, 433.–460. lpp.

Atvērt avotu

Tjūringa digitālais arhīvs

Kembridžas King’s College kataloga ieraksts par Tjūringa manuskriptu materiāliem.

Atvērt avotu

Dartmutas MI priekšlikums

1955. gada priekšlikums 1956. gada vasaras pētniecības projektam, kurā tika dots nosaukums mākslīgajam intelektam.

Atvērt avotu

Weizenbaum (1966), ELIZA

Oriģinālais Communications of the ACM raksts, kurā aprakstīta ELIZA.

Atvērt avotu

Kolbijs u.c. (1972), PARRY pētījums

Oriģinālais žurnāla Artificial Intelligence raksts par Tjūringa tipa neatšķiramības testiem.

Atvērt avotu

Stenfordas enciklopēdija: Tjūringa tests

Akadēmisks pārskats par interpretācijām, iebildumiem, variantiem un sacensību vēsturi.

Atvērt avotu

Jones & Bergen (2024)

Iepriekš reģistrēts randomizēts ELIZA, GPT-3.5, GPT-4 un cilvēku liecinieku pētījums.

Atvērt avotu

Wu, Wu & Zhao (ACL 2025)

Recenzēts pētījums, kurā ilgtermiņa dialoga aģentiem ierosināts X-TURING.

Atvērt avotu