Testul Turing este un experiment conceptual propus de matematicianul și pionierul informaticii Alan Turing în 1950, conceput ca o metodă practică de evaluare a capacității unei mașini de a manifesta un comportament inteligent indistinguibil de cel al unui om, prin intermediul unei conversații text, fără a se baza pe definiții filosofice abstracte ale „gândirii” sau „conștiinței”.
Formatul original al testului implică un evaluator uman care poartă conversații scrise, simultan, cu doi interlocutori ascunși — un om real și o mașină — fără a ști care este care. Dacă, după o perioadă rezonabilă de interacțiune, evaluatorul nu poate distinge cu încredere mașina de om pe baza răspunsurilor primite, mașina este considerată să fi „trecut” testul, demonstrând un comportament conversațional echivalent funcțional cu inteligența umană, cel puțin în acel context restrâns.
Turing a propus acest test ca alternativă pragmatică la întrebarea filosofică mult mai dificilă „poate o mașină să gândească?”, argumentând că un comportament indistinguibil de inteligența umană, observat obiectiv, este o măsură mai utilă și mai testabilă decât speculațiile despre experiența subiectivă internă a unei mașini.
Modelele mari de limbaj moderne, precum ChatGPT sau Claude, sunt capabile să poarte conversații suficient de fluente și de coerente încât ar trece, cu mare probabilitate, versiuni simple ale testului Turing original în multe scenarii practice — un fapt care a reaprins dezbaterea privind relevanța și limitele acestui test ca măsură semnificativă a inteligenței reale. Criticii moderni argumentează că trecerea testului Turing demonstrează capacitate de a genera text convingător din punct de vedere statistic, nu neapărat înțelegere, raționament sau conștiință în sensul deplin uman al termenilor, motiv pentru care testul rămâne mai degrabă un reper istoric și filozofic important decât o măsură tehnică rigidă folosită astăzi pentru evaluarea modelelor AI de ultimă generație.
