آنچه یاد خواهید گرفت:
ایجاد پایپلاینهای استریمینگ کلان داده با اسپارک و پایتون
یاد بگیرید چگونه اسپارک را در دیتافریمهای توزیعشده بهکار بگیرید.
استفاده از پایتون با کلان داده در چارچوب توزیعشده (آپاچی اسپارک)
پیشنیازهای دوره
نیاز به داشتن تجربه قبلی نیست.
توضیحات دوره
این دوره کل اصول مربوط به استریمینگ داده با Apache Spark و پایتون را پوشش میدهد و همه آنچه برای توسعه اپلیکیشنهای استریمینگ با PySpark، یعنی Python API برای اسپارک، نیاز دارید را ارائه میکند. در پایان این دوره، دانش عمیقی از استریمینگ اسپارک و مهارتهای عمومی کار با کلان داده کسب میکنید که به شرکت شما کمک میکند استریمینگ اسپارک را برای ساخت پایپلاینهای پردازش کلان داده و اپلیکیشنهای تحلیل داده به کار گیرد.
این دوره با یک آموزش فشرده پایتون شروع میشود و سپس وارد یادگیری چگونگی استفاده از دیتافریمهای اسپارک با جدیدترین سینتکس Spark 2.0 میشویم. پس از آن، به استفاده از کتابخانه ماشین MLlib با سینتکس دیتافریم و اسپارک میپردازیم. در طول دوره، تمرینها و پروژههای شبیهسازی مشاوره وجود دارد که شما را در موقعیتهای واقعی قرار میدهد که باید با مهارتهای جدید خود مشکلات واقعی را حل کنید!
همچنین تکنولوژیهای جدید اسپارک مانند Spark SQL، استریمینگ اسپارک و مدلهای پیشرفتهای مانند Gradient Boosted Trees را پوشش میدهیم! پس از پایان این دوره، به راحتی میتوانید اسپارک و PySpark را در رزومه خود قرار دهید!
اگر آماده ورود به دنیای پایتون، Spark و کلان داده هستید، این دوره مناسب شماست!
این دوره برای چه کسانی مناسب است؟
کسانی که با پایتون آشنا هستند و میخواهند آن را برای کلان داده به کار ببرند.
افرادی که با زبان برنامهنویسی دیگری آشنایی دارند و نیازمند یادگیری اسپارک هستند.
توسعهدهندگانی که از زبانهای دیگر به پایتون مهاجرت میکنند.
توسعهدهندگان پایتون که میخواهند در حوزه استریمینگ داده بهتر شوند.
توسعهدهندگان اسپارک که میل به گسترش مهارتهای خود دارند.