Multimodal AI: talaba tanloviga ko'ra Computer Vision yoki audio/nutqni qayta ishlash
Kurs multimodal yo'nalishlardan birida ixtisoslashuvni chuqurlashtiradi: Computer Vision (detektsiya, segmentatsiya, vision-language modellar) yoki Audio/Speech (ASR, TTS, speaker diarization, multimodal audio modellar). Modalitaga xos arxitektura yechimlari, shuningdek umumiy multimodal fusion yondashuvlari o'rganiladi. Kurs ilmiy-tadqiqot yo'nalishiga (s3-ai-research) va amaliy loyihalarga (s3-applied-ai) tayyorlaydi.