एआयने घेतलेल्या सर्वेक्षणांत चुकीचे आकडे, प्यू रिसर्च सेंटरच्या प्रयोगात मानवी मतांशी मोठी तफावत
प्यू रिसर्च सेंटरने खऱ्या सहभागींचे एआय 'डिजिटल ट्विन' बनवून तीन जुनी सर्वेक्षणे पुन्हा घेतली आणि निकाल प्रत्यक्ष मानवी उत्तरांशी जुळले नाहीत.
कृत्रिम बुद्धिमत्ता म्हणजेच एआय आज रोजच्या कामापासून क्लिष्ट डेटा विश्लेषणापर्यंत सगळीकडे वापरले जाते. लोक एखाद्या विषयावर काय विचार करतात, याचा अंदाज घेण्यासाठीही एआयचा वापर करून 'कृत्रिम सर्वेक्षणे' (Synthetic Polls) घेण्याचे प्रयोग सुरू झाले आहेत. पण जगप्रसिद्ध प्यू रिसर्च सेंटर (Pew Research Center) या आंतरराष्ट्रीय संशोधन संस्थेने केलेल्या एका प्रयोगामुळे या पद्धतीच्या अचूकतेवर मोठे प्रश्नचिन्ह उभे राहिले आहे.
३० सप्टेंबर २०२६ रोजी प्रसिद्ध झालेल्या प्यू रिसर्च सेंटरच्या अहवालानुसार, एआयने तयार केलेल्या डिजिटल सहभागींमार्फत घेतलेली सर्वेक्षणे खऱ्या मानवी जनमताचे प्रतिनिधित्व करण्यात पूर्णपणे अपयशी ठरली. या प्रयोगासाठी संस्थेने आपल्या अमेरिकन ट्रेंड्स पॅनेल (ATP) मधील खऱ्या सहभागींचे वय, जनसांख्यिकीय माहिती (Demographics) आणि इतर वैयक्तिक वैशिष्ट्ये वापरून एआयचे 'डिजिटल ट्विन' (Digital Twins) बनवले. यापूर्वी घेतलेली तीन सर्वेक्षणे या एआय सहभागींसोबत पुन्हा घेण्यात आली आणि त्यांची उत्तरे प्रत्यक्ष माणसांकडून मिळालेल्या डेटाशी ताडून पाहिली गेली.
जवळपास ३०० वेगवेगळ्या मानवी आणि राजकीय प्रश्नांचा अभ्यास केल्यावर एआय आणि खऱ्या माणसांच्या उत्तरांमध्ये सरासरी १२ टक्के गुणांचा फरक आढळला. सुमारे २८ टक्के प्रश्नांमध्ये हा फरक १५ टक्के गुणांपेक्षा जास्त होता. काही मुद्द्यांवर तर एआय आणि माणसांच्या मतांमधली दरी २०, ३० आणि अगदी ४० टक्के गुणांपर्यंत गेली.
काही सामाजिक आणि राजकीय गटांबाबत एआयच्या चुका जास्त गंभीर होत्या. एआयने अंदाज लावला की ९७% हिस्पॅनिक्स प्रौढ फुटबॉल विश्वचषक किमान काही प्रमाणात पाहतील, पण प्रत्यक्ष सर्वेक्षणात हा आकडा फक्त ४३% होता. एआयने ९५% रिपब्लिकन समर्थकांचा इस्रायलकडे पाहण्याचा दृष्टिकोन सकारात्मक असल्याचा अंदाज केला, तर प्रत्यक्षात फक्त ५८% रिपब्लिकन नागरिकांनी तशी भूमिका मांडली. तसेच ८६% डेमोक्रॅट्स अब्जाधीशांना देशासाठी वाईट मानतात असे एआयला वाटले, पण खरी आकडेवारी ४५% होती.
माणसे एखाद्या प्रश्नाचे उत्तर माहीत नसेल किंवा मत ठरलेले नसेल, तर सहज 'मला खात्री नाही' (Not Sure) हा पर्याय निवडतात. या प्रयोगात खऱ्या लोकांनी सुमारे १६% वेळा हा पर्याय निवडला, तर एआय सहभागींनी तो फक्त ४% वेळाच निवडला. म्हणजेच जनमतातला संभ्रम टिपण्यात एआय कमी पडले.
२०२६ च्या सुरुवातीला समोर आलेल्या काही मोठ्या राजकीय घडामोडींबाबतही एआयचे अंदाज चुकले. अमेरिकेच्या राष्ट्राध्यक्षपदाच्या कामगिरीला मान्यता देणाऱ्या नागरिकांची संख्या एआयने गरजेपेक्षा जास्त दाखवली. इमिग्रेशन अधिकाऱ्यांनी ओळख लपवण्यासाठी चेहरे झाकणे योग्य मानणाऱ्या रिपब्लिकन नागरिकांची संख्या मात्र एआयने प्रत्यक्ष आकडेवारीपेक्षा खूपच कमी दाखवली.
चाचणीसाठी प्यू संशोधन केंद्राने OpenAI चे GPT-5.1 आणि Anthropic चे Claude Opus 4.6 हे दोन अत्याधुनिक एआय मॉडेल्स वापरले होते. या दोन्ही मॉडेल्सचे निकाल खऱ्या मानवी मतांशी जुळले नाहीतच, शिवाय त्यांच्या आपापसातही लक्षणीय फरक दिसला. त्यामुळे फक्त 'एआयने सर्वेक्षण केले' असे सांगणे पुरेसे नाही, कोणते मॉडेल आणि कोणता अल्गोरिदम वापरला हेही समजणे तितकेच महत्त्वाचे आहे, असे यावरून दिसते.
याचा अर्थ एआय पूर्णपणे निरुपयोगी आहे असा नाही. प्रचंड डेटाचे जलद विश्लेषण, भविष्यातील शक्यतांचा मसुदा तयार करणे किंवा ट्रेंड्सचा अभ्यास करणे यासाठी एआय उपयुक्त साधन आहे. मात्र माणसांचे विचार, वैयक्तिक अनुभव, सामाजिक मूल्ये आणि भावना यांचा अचूक कौल घ्यायचा असेल, तर प्रत्यक्ष माणसांशी बोलून त्यांचे मत जाणून घेणे हीच एकमेव खात्रीशीर पद्धत आहे.