चैटजीपीटी उत्पाद अनुशंसा परीक्षण में विफल रहता है, वायर्ड चयनों को भ्रमित करता है

  • वायर्ड परीक्षण चैटजीपीटी अपने स्वयं के उत्पाद अनुशंसाओं पर और पाया कि एआई ने पूरी तरह से गलत उत्तर दिए

    Whisker’s AI-powered litter robot thinks my cats swapped bodies
  • चैटबॉट ने टीवी, हेडफोन और लैपटॉप के लिए ऐसे उत्पाद तैयार किए जिनकी WIRED के समीक्षकों ने कभी अनुशंसा नहीं की

  • इससे विश्वास संकट का पता चलता है क्योंकि उपभोक्ता सैकड़ों या हजारों डॉलर के खरीद निर्णयों के लिए एआई चैटबॉट का तेजी से उपयोग कर रहे हैं

  • चैटजीपीटी में ओपनएआई के सुधारों के बावजूद निष्कर्ष बड़े भाषा मॉडल के साथ चल रही सटीकता की समस्याओं को उजागर करते हैं

ओपनएआई चैटजीपीटी अभी बुनियादी सटीकता परीक्षण में विफल रहा। कब वायर्ड चैटबॉट से टीवी, हेडफ़ोन और लैपटॉप के लिए प्रकाशन की स्वयं की उत्पाद अनुशंसाओं का हवाला देने के लिए कहा गया, इसने आत्मविश्वास से बोर्ड भर में गलत उत्तर दिए। 1 अप्रैल को प्रकाशित प्रयोग, एक गंभीर भेद्यता को उजागर करता है कि कैसे लाखों उपभोक्ता अब खरीदारी सलाह के लिए एआई पर भरोसा करते हैं – और कितनी बार ये सिस्टम बस बातें बनाते हैं।

ओपनएआई फ्लैगशिप चैटबॉट हाल ही में थोक में उत्पाद सिफ़ारिशें बनाते हुए पकड़ा गया। द्वारा प्रकाशित एक जांच में वायर्डरिपोर्टर रीस रोजर्स ने पूछा चैटजीपीटी एक सीधा सा प्रश्न: WIRED की समीक्षा टीम वास्तव में किन उत्पादों की अनुशंसा करती है? नतीजे थोड़े भी ख़राब नहीं थे – वे पूरी तरह से मनगढ़ंत थे।

A RAMageddon guide to back-to-school laptop shopping

एआई ने आत्मविश्वास से विशिष्ट टीवी, हेडफोन और लैपटॉप को WIRED की शीर्ष पसंद के रूप में उद्धृत किया, जिनमें से किसी का भी प्रकाशन के समीक्षकों ने वास्तव में समर्थन नहीं किया था। यह एआई मतिभ्रम का एक पाठ्यपुस्तक मामला है, उद्योग का शब्द जब बड़े भाषा मॉडल प्रशंसनीय-लगने वाली लेकिन पूरी तरह से गलत जानकारी उत्पन्न करते हैं। और यह बड़े पैमाने पर हो रहा है क्योंकि लाखों खरीदार सलाह खरीदने के लिए ChatGPT की ओर रुख करते हैं।

यह कोई शैक्षणिक समस्या नहीं है. उपभोक्ता चैटजीपीटी की सिफारिशों के आधार पर वास्तविक खरीदारी निर्णय ले रहे हैं, जिसमें अक्सर सैकड़ों या हजारों डॉलर की लागत वाले उत्पाद शामिल होते हैं। बॉट इतने आत्मविश्वास से बोलता है कि अधिकांश उपयोगकर्ता मूल स्रोतों के विरुद्ध इसके दावों की तथ्य-जांच करने के बारे में नहीं सोचेंगे। रोजर्स का प्रयोग बिल्कुल दिखाता है कि यह खतरनाक क्यों है।

समय इससे अधिक अजीब नहीं हो सकता ओपनएआई. कंपनी ChatGPT को एक विश्वसनीय अनुसंधान और शॉपिंग सहायक के रूप में आगे बढ़ा रही है, हाल ही में इसमें ऐसे फीचर जोड़े गए हैं जो उत्पाद अनुशंसाओं और शॉपिंग लिंक को सामने लाते हैं। लेकिन अगर अंतर्निहित मॉडल यह सटीक रूप से उद्धृत नहीं कर सकता है कि कोई प्रकाशन वास्तव में क्या अनुशंसा करता है – भले ही वह प्रकाशन अच्छी तरह से अनुक्रमित हो और व्यापक रूप से ऑनलाइन उपलब्ध हो – यह उपभोक्ता सलाह के लिए प्रौद्योगिकी की तत्परता के बारे में गंभीर सवाल उठाता है।