Provisioning to Runtime Optimization of a +100 MW AI Cluster
यह शोध पत्र एक हाइपर-स्केल एआई डेटासेंटर के लिए पावर मैनेजमेंट का पहला एंड-टू-एंड विवरण प्रस्तुत करता है, जिसमें अगली पीढ़ी के एक्सेलेरेटर्स के लिए प्रारंभिक पावर प्लानिंग से लेकर 83,000 GB200 GPUs को होस्ट करने वाली 150 MW की सुविधा के रनटाइम ऑप्टिमाइज़ेशन तक की प्रक्रिया का विस्तृत विवरण दिया गया है।