उच्च-प्रदर्शन ML सिस्टम्स: GPU, distributed training, कंप्रेशन और LLM serving
यह कोर्स औद्योगिक स्तर के मॉडल्स के ट्रेनिंग और डिप्लॉयमेंट के लिए आवश्यक सिस्टम्स इंजीनियरिंग को कवर करता है। इसमें GPU आर्किटेक्चर, CUDA kernels के ऑप्टिमाइज़ेशन, distributed training की तकनीकें (data/model/pipeline parallelism), मॉडल कंप्रेशन, और उच्च-प्रदर्शन LLM inference सिस्टम्स का अध्ययन किया जाता है। यह कोर्स प्रैक्टिकम 3 में टीम की सफलता के लिए सीधे तौर पर आधार तैयार करता है और कुशल आर्किटेक्चर पर research विषयों के लिए प्रवेश-बिंदु है।