AMD ने विस्तारित लोड ऑप्टिमाइज़ेशन के लिए GCC पैच सबमिट किया
तकनीक
⚠ एकल स्रोत
1h ago

AMD ने विस्तारित लोड ऑप्टिमाइज़ेशन के लिए GCC पैच सबमिट किया

AI-संश्लेषित · पूर्वाग्रह हटाया · केवल तथ्य
Image: Phoronix

AMD ने GNU कंपाइलर कलेक्शन (GCC) के लिए एक नया पैच पोस्ट किया है जिसका उद्देश्य x86_64 कोड के लिए ऑप्टिमाइज़ेशन में सुधार करना है। ऑप्टिमाइज़ेशन, जिसे विस्तारित लोड ऑप्टिमाइज़ेशन कहा जाता है, को उस कोड से लाभान्वित करने के लिए डिज़ाइन किया गया है जहां एक संकीर्ण डेटा प्रकार लोड किया जाता है और फिर एक व्यापक डेटा प्रकार के साथ अंकगणितीय ऑपरेशन में उपयोग किया जाता है।

AMD की कंपाइलर टीम से Sridevi द्वारा सबमिट किया गया पैच एक ऐसी स्थिति को संबोधित करता है जहां GCC वर्तमान में `vextract` निर्देशों का उपयोग करता है। Sridevi ने समझाया कि पैच GCC को इसके बजाय ZMM रजिस्टरों के साथ विस्तारित लोड्स का उपयोग करने की अनुमति देगा, जिससे संभावित रूप से बेहतर प्रदर्शन प्राप्त हो सकता है। पैच SLP ट्री के भीतर एक “लोड + कन्वर्ट” पैटर्न की पहचान करता है और यदि लक्ष्य फ्यूज्ड लोड-एंड-एक्सटेंड कार्यक्षमता का समर्थन करता है तो लोड वेक्टर प्रकार को संकुचित करता है। फ़ंक्शन `vect_optimize_slp_widening_loads` `tree-vect-loop.cc` फ़ाइल के भीतर इस ऑप्टिमाइज़ेशन को करता है।

यह ऑप्टिमाइज़ेशन AMD के Zen प्रोसेसर के लिए विशिष्ट नहीं है, बल्कि व्यापक x86_64 आर्किटेक्चर पर लागू होता है। AMD हाल ही में नए कंपाइलर समर्थन को अपस्ट्रीम करने की ओर बढ़ गया है, जिसमें GCC और LLVM/Clang दोनों के लिए Zen लक्ष्य समर्थन, विकास प्रक्रिया में पहले शामिल है। पहले, इस काम का अधिकांश हिस्सा लॉन्च के बाद SUSE जैसे भागीदारों द्वारा संभाला जाता था। पैच वर्तमान में GCC 17 में शामिल होने के लिए समीक्षाधीन है। पैच सबमिशन के साथ कोई प्रदर्शन मेट्रिक्स शामिल नहीं थे।

क्या यह उपयोगी था?

मूल कवरेज पढ़ें

💬 टिप्पणियाँ

📜 टिप्पणी नीति