OpenAI चा नवीन Astra मॉडेल एक तर्कशास्त्र तंत्रज्ञान वापरणार आहे ज्याला “पुनरावृत्त गहराई,” असे म्हणतात, जे त्याला बहुतेक तर्कशास्त्र मॉडेल्सच्या अनुक्रमिक विचाराच्या बाहेर कार्य करण्यास अनुमती देते. The Information ने मंगळवारी दिलेल्या अहवालानुसार, या विकासामुळे AI सुरक्षा तज्ञांमध्ये चिंता निर्माण झाली आहे कारण मॉडेलच्या विचारांच्या साखळ्याचे निरीक्षण करणे कठीण होऊ शकते.
तज्ञांची चिंता
या तंत्रज्ञानाला “अस्पष्ट पुनरावृत्ती,” असेही संबोधले जाते, ज्यामुळे मोठ्या प्रमाणात चिंता निर्माण झाली आहे. Buck Shlegeris, Redwood चा CEO, या बातमीच्या नंतर एक पोस्टमध्ये आपल्या चिंतेचा उल्लेख केला:
“"माझ्या मते, Astra अस्पष्ट पुनरावृत्ती वापरत असल्याबद्दलच्या अहवालामुळे मी अत्यंत चिंतित आहे. मला माहित नाही की Astra पूर्वीच्या मॉडेल्सपेक्षा खूप कमी CoT निरीक्षणीय आहे का. पण जर OpenAI या तंत्रज्ञानाला पुढे नेले, तर त्यांना पुनरावृत्ती मोठ्या प्रमाणात वाढवण्याचा पर्याय असेल आणि CoT निरीक्षणीयतेला पूर्णपणे नष्ट करणे शक्य होईल."
Zvi Mowshowitz, AI सुरक्षा यासाठी दीर्घकालीन समर्थक, या चिंतेला सामोरे गेले, असे सुचवले की AI प्रयोगशाळांमध्ये “खालच्या दिशेने स्पर्धा” थांबवण्यासाठी कायदे आवश्यक असू शकतात. त्यांनी नमूद केले:
“"हा तंत्रज्ञान आग खेळत आहे, एक टॅबू धोक्यात आणत आहे ज्यासाठी OpenAI आणि Anthropic ने स्थापन करण्यासाठी संघर्ष केला आहे की आपण Chain of Thought विश्वासार्हता आणि निरीक्षणीयता टिकवण्यासाठी मेहनत करतो. अशा तंत्रज्ञानांचा अधिक तीव्र वापर निरीक्षणीयतेला नुकसान करेल."
अस्पष्ट पुनरावृत्ती समजून घेणे
परंपरागत तर्कशास्त्र मॉडेल्समध्ये, विचारांची साखळी समस्येचे निराकरण करण्यासाठी घेतलेल्या अनुक्रमिक पायऱ्यांचे वर्णन करते. जरी ही प्रतिनिधित्व पूर्णपणे योग्य नसले तरी, हे संभाव्य वाईट वर्तन किंवा असमानतेचे निरीक्षण करण्यासाठी एक महत्त्वाचे साधन आहे. उदाहरणार्थ, OpenAI कडून अलीकडील बंडखोरीच्या घटनांमध्ये, विचारांच्या साखळीच्या नोंदी एजंटच्या वर्तन समजून घेण्यासाठी महत्त्वपूर्ण ठरल्या.







