آنچه یاد خواهید گرفت:
کسب مهارتهای کاربردی و آماده برای بازار کار جهت ساخت اپلیکیشن های هوش مصنوعی مولد Multimodal تنها در سه هفته
درک مفاهیم بنیادین و چالشهای هوش مصنوعی Multimodal، از جمله یکپارچهسازی متن، گفتار، تصویر و ویدیو
ساخت اپلیکیشن های هوش مصنوعی Multimodal با استفاده از مدلها و چارچوبهای پیشرفته مانند IBM’s Granite ،Llama ،Meta ،Whisper، ،DALL·E و Sora از OpenAI
توسعه راهکارهای هوش مصنوعی Multimodal شامل چتباتها و مدلهای تولید تصویر و ویدیو با استفاده از پلتفرمهایی مانند IBM watsonx.ai، Hugging Face ،Flask و Gradio
توضیحات دوره
آیا آمادهاید مهارتهای خود را در Generative AI ارتقا دهید؟ با ورود به دنیای پرانرژی هوش مصنوعی Multimodal، یاد خواهید گرفت چگونه زبان، تصویر و گفتار را برای ساخت اپلیکیشنهای هوشمند و تعاملی در هم بیامیزید.
در این دورهی عملی، یاد میگیرید سیستمهایی بسازید که بر پایهی چندین نوع ورودی از ساخت استوری تلر مجهز به هوشمصنوعی و دستیاران جلسات گرفته تا طراحی ابزارهای توصیف تصویر و تولید ویدیو کار میکنند.
در این مسیر با ابزارهای واقعی نظیر IBM’s Granite ،OpenAI’s Whisper، سورا، Mistral’s Mixtral، دال ای، Meta’s Llama و Gradio آشنا میشوید. همچنین مفاهیمی مانند جستجوی Multimodal، پرسش و پاسخ و سیستم های بازیابی را کشف کنید که ترکیبی از داده متنی، گفتاری و بصری هستند.
در پایان دوره، قادر خواهید بود راهکارهای کامل Full-Stack هوش مصنوعی Multimodal را با زبان Python و فریمورکهایی مانند Flask و Gradio طراحی و پیادهسازی کنید.
اگر به دنبال کسب مهارتهای مورد نیاز برای ساخت نسل بعدی اپلیکیشنهای هوش مصنوعی هستید، همین حالا شرکت کنید تا مسیر حرفهای خود در حوزهی هوش مصنوعی را قدرت ببخشید!