नए शोध का दावा है कि एआई एजेंट गणितीय रूप से विफल होने के लिए अभिशप्त हैं

  • एसएपी के पूर्व सीटीओ विशाल सिक्का का अखबार तर्क देता है एलएलएम गणितीय रूप से अक्षम हैं कुछ जटिलता सीमाओं से परे विश्वसनीय एजेंटिक व्यवहार का

    So viel Spaß hatte ich beim Fensterputzen noch nie
  • ओपनएआई सितंबर 2025 में शोधकर्ताओं ने स्वीकार किया कि “सटीकता कभी भी 100 प्रतिशत तक नहीं पहुंच पाएगी” क्योंकि उनके स्वयं के मॉडल ने नकली शोध प्रबंध शीर्षकों को भ्रमित कर दिया था

  • स्टार्टअप हार्मोनिक एआई कोडिंग विश्वसनीयता की गारंटी के लिए गणितीय सत्यापन का उपयोग करके सफलता का दावा करता है, बेंचमार्क में शीर्ष पर है

  • गूगल का डेमिस हसाबिस ने इस सप्ताह दावोस में मतिभ्रम को कम करने में प्रगति की सूचना दी क्योंकि उद्योग बुनियादी चिंताओं के बावजूद एजेंटों को अपनाने पर जोर दे रहा है

एक विवादास्पद शोध पत्र एआई उद्योग के एजेंट सपनों पर पानी फेर रहा है। 2025 के मध्य में प्रकाशित, “मतिभ्रम स्टेशन: ट्रांसफार्मर-आधारित भाषा मॉडल की कुछ बुनियादी सीमाओं पर” गणितीय रूप से यह साबित करने का दावा करता है कि बड़े भाषा मॉडल जटिल कम्प्यूटेशनल और एजेंटिक कार्यों को विश्वसनीय रूप से संभाल नहीं सकते हैं। परंतु जैसे गूगल, ओपनएआईऔर दर्जनों स्टार्टअप एजेंट एआई में अरबों डॉलर डालते हैं, वे शर्त लगा रहे हैं कि गणित गलत है – या कम से कम अधूरा है।

बड़ी एआई कंपनियों ने वादा किया था कि 2025 “एआई एजेंटों का वर्ष” होगा। यह एआई एजेंटों के बारे में बात करने का वर्ष बन गया। अब एक शोध पत्र सुझाव दे रहा है कि प्रतीक्षा स्थायी हो सकती है।

Whisker’s AI-powered litter robot thinks my cats swapped bodies

एजेंट प्रचार के चरम के दौरान बिना धूमधाम के प्रकाशित, “मतिभ्रम स्टेशन: ट्रांसफार्मर-आधारित भाषा मॉडल की कुछ बुनियादी सीमाओं पर” एजेंट एआई दृष्टि के लिए एक गणितीय गहन पंच प्रदान करता है। एसएपी के पूर्व सीटीओ विशाल सिक्का और उनके किशोर प्रतिभाशाली बेटे द्वारा लिखित यह पेपर यह साबित करने का दावा करता है एलएलएम मौलिक रूप से अक्षम हैं एक निश्चित जटिलता से परे कम्प्यूटेशनल और एजेंटिक कार्यों को पूरा करना। उनके विश्लेषण के अनुसार, शुद्ध शब्द भविष्यवाणी से परे जाने वाले तर्क मॉडल भी समस्या का समाधान नहीं करेंगे।

सिक्का ने बताया, “ऐसा कोई तरीका नहीं है जिससे वे भरोसेमंद हो सकें।” तारयुक्त एक हालिया साक्षात्कार में. शोधकर्ता, जिन्होंने एसएपी, इंफोसिस और ओरेकल में अपने करियर से पहले एआई अग्रणी जॉन मैक्कार्थी के तहत अध्ययन किया था, अब एआई सेवा स्टार्टअप चलाते हैं। वियानाइ. परमाणु ऊर्जा संयंत्र जैसी महत्वपूर्ण प्रणाली चलाने वाले एजेंटों पर उनका फैसला? रहने भी दो। आपको कुछ कागजात दाखिल करने और समय बचाने के लिए कोई मिल सकता है, लेकिन गलतियाँ अपरिहार्य हैं।

यह समय उस उद्योग के लिए इससे अधिक अजीब नहीं हो सकता है जो स्वायत्त एआई सिस्टम पर अपना भविष्य दांव पर लगा रहा है। गूगल का डेमिस हसाबिस बस मतिभ्रम को कम करने में सफलताओं की सूचना दी इस सप्ताह दावोस में, जबकि हाइपरस्केलर्स और स्टार्टअप एजेंट उत्पादों को शिप करने के लिए दौड़ रहे हैं। लेकिन गणितीय आलोचना को एक अप्रत्याशित स्रोत से समर्थन प्राप्त है –