مطالب دارای تگ: big data

65 مورد برای عبارت مورد نظر پیدا شد.

دانلود Modern Data Workflows with Databricks آموزش دیتابریکس

دانلود Modern Data Workflows with Databricks - آموزش دیتابریکس

پلتفرم دیتابریکس به یکی از ابزارهای محور و اساسی در دنیای مهندسی داده تبدیل شده است و فراگیری آن برای متخصصان داده اهمیت بسیار زیادی دارد. در این دوره آموزشی جامع، شرکت‌کنندگان با مسیر کامل و گام‌به‌گام فرایند ساخت جریان‌های کاری داده مدرن در بستر دیتابریکس آشنا می‌شوند. فرایند آموزش از نخستین مرحله، یعنی استخراج و وارد کردن داده‌های خام به محیط سیستم آغاز می‌شود و تا مرحله انتقال، بازسازی، تبدیل و تنظیم نهایی داده‌ها ادامه می‌یابد. در نهایت، فراگیران یاد می‌گیرند که چگونه داده‌هایی کاملاً پاک‌سازی‌شده، مرتب و آماده برای تحلیل‌های پیشرفته تجاری و آماری ارائه دهند.
صرف‌نظر از اینکه فراگیران در ابتدای مسیر یادگیری دیتابریکس باشند یا قصد داشته باشند مهارت‌های مهندسی داده خود را به سطوح بالاتر و حرفه‌ای‌تری ارتقا دهند، این دوره تمامی مفاهیم پیچیده را به روشی کاملاً ساده، کاربردی و مناسب برای افراد مبتدی تشریح می‌کند. آموزش‌ها تنها به مباحث نظری محدود نمی‌شوند، بلکه با ارائه پیش‌نمایش‌های عملی، تمرین‌های دست‌به‌نقد و نمونه‌های واقعی در دنیای تجارت همراه است تا شرکت‌کنندگان تجربه ملموسی از کار با پروژه کسب کنند. لازم به ذکر است که این دوره آموزشی ارزشمند توسط الکس فربیرگ و مجموعه آنالیست بیल्डर تهیه و تولید شده است و محتوای آن برای بهره‌مندی علاقه‌مندان در اختیار کاربران قرار گرفته است تا بتوانند دانش فنی خود را در حوزه داده گسترش دهند.
در دوره Modern Data Workflows with Databricks با مهندسی و مدیریت داده‌ها در دیتابریکس آشنا خواهید شد.

دانلود Splunk Core Certified User - آموزش اسپلانک

دانلود Splunk Core Certified User - آموزش اسپلانک

این گواهینامه مدرکی بسیار معتبر و ارزشمند برای متقاضیان مشاغلی همچون تحلیل‌گر مرکز عملیات امنیت (SOC)، تحلیل‌گر امنیت، تحلیل‌گر عملیات فناوری اطلاعات و همچنین نقش‌های مبتدی در زمینه سامانه مدیریت اطلاعات و رویدادهای امنیتی به شمار می‌رود. از آنجا که نرم‌افزار اسپلانک یکی از گسترده‌ترین و پرکاربردترین پلتفرم‌های سیستم مدیریت رویدادها و اطلاعات امنیتی در سراسر جهان است، داشتن این گواهینامه نشان‌دهنده توانایی و مهارت فرد در زمینه جستجو، اولویت‌بندی رویدادها و گزارش‌گیری در یک محیط واقعی اسپلانک خواهد بود. اگرچه دریافت این گواهینامه به تنهایی تضمین‌کننده دست‌یابی به موقعیت شغلی در مرکز عملیات امنیت نیست، اما مکمل و ارتقادهنده بسیار مناسبی برای رزومه کاری محسوب می‌شود؛ به‌ویژه برای افرادی که قصد تغییر مسیر شغلی به سمت حوزه امنیت یا عملیات فناوری اطلاعات را دارند. آزمون گواهی کاربر هسته اسپلانک از طریق مرکز برگزاری آزمون‌های پیِرسون وی‌یو (Pearson VUE) برگزار می‌شود و هزینه هر بار شرکت در آن معادل ۱۳۰ دلار آمریکا است. این آزمون هیچ‌گونه پیش‌نیازی ندارد و مدت زمان پاسخ‌گویی به سؤالات آن ۶۰ دقیقه تعیین شده است. در صورتی که شرکت‌کننده در تلاش اول موفق به کسب نمره قبولی نشود، برای شرکت مجدد در آزمون ملزم به پرداخت مجدد این هزینه خواهد بود. بنابراین، منطقی و ارزشمند است که افراد پیش از ثبت‌نام و شرکت در آزمون، زمان کافی را صرف یادگیری و مطالعه از طریق دوره‌های آموزشی باکیفیت کنند.
جهت ورود به این دوره آموزشی هیچ‌گونه نیازی به داشتن تجربه قبلی در کار با نرم‌افزار اسپلانک وجود ندارد. این دوره و آزمون مربوط به آن کاملاً در سطح مبتدی طراحی شده‌اند و مبنا بر این است که یادگیرنده مسیر خود را از نقطه صفر آغاز می‌کند. البته اگر فراگیران پیش از این با مفاهیم دوره‌های امنیتی عمومی یا مباحث دوره امنیت سيسكو (SCOR) آشنایی داشته باشند، برخی از مفاهیم سامانه مدیریت اطلاعات و رویدادهای امنیتی برای آن‌ها آشنا به نظر خواهد رسید؛ اما این دوره به طور اختصاصی به بررسی عمیق و کاربردی نرم‌افزار اسپلانک می‌پردازد و نیازی به لمس یا تجربه قبلی این نرم‌افزار قبل از شروع دوره نخواهد بود.

در دوره آموزشی Splunk Core Certified User با مفاهیم پایه، جستجو، اولویت‌بندی و گزارش‌گیری در نرم‌افزار اسپلانک آشنا خواهید شد.

دانلود ElasticSearch With Python: Hands-On Guide with Real Projects آموزش الاستیک‌سرچ

دانلود ElasticSearch With Python: Hands-On Guide with Real Projects - آموزش الاستیک‌سرچ

در دنیای امروز که داده‌ها حرف اول را می‌زنند، مفهوم جست‌وجو دیگر به تطابق ساده کلمات کلیدی محدود نمی‌شود. اپلیکیشن‌های مدرن و پیشرفته نیازمند تجربه‌ای از جست‌وجو هستند که نه تنها سریع و مقیاس‌پذیر باشد، بلکه از هوشمندی و دقت بالایی نیز برخوردار باشد تا مرتبط‌ترین نتایج را در کمترین زمان ممکن به کاربر ارائه دهد. الاستیک‌سرچ (ElasticSearch) به عنوان ستون فقرات چنین سیستم‌هایی شناخته می‌شود و امروزه زیرساخت اصلی بسیاری از موتورهای جست‌وجو، پلتفرم‌های تحلیل داده، سیستم‌های پیشنهادگر، ابزارهای نظارت بر لاگ‌ها و خط‌لوله‌های بازیابی اطلاعات مبتنی بر هوش مصنوعی را تشکیل می‌دهد.
این دوره به گونه‌ای طراحی شده است که شرکت‌کنندگان را با معماری داخلی و نحوه عملکرد این تکنولوژی آشنا کند. در این مسیر آموزشی، مفاهیم حیاتی مانند ایندکس‌گذاری (Indexing)، خرد کردن داده‌ها (Sharding) و نحوه توزیع داده‌ها در خوشه‌ها (Clusters) به تفصیل بررسی می‌شود. هدف این است که یادگیرنده بتواند فراتر از یک جست‌وجوی ساده، سیستم‌هایی را طراحی کند که توانایی پردازش میلیون‌ها رکورد را در کسری از ثانیه داشته باشند.
در دوره آموزشی ElasticSearch With Python: Hands-On Guide with Real Projects با تمام مهارت‌های لازم برای تبدیل شدن به یک متخصص در حوزه جست‌وجو و تحلیل داده آشنا خواهید شد.

دانلود MS SQL to Databricks Spark ETL Training for Data Engineers آموزش ام‌اس اس‌کیو‌ال و دیتابریکس

دانلود MS SQL to Databricks Spark ETL Training for Data Engineers - آموزش ام‌اس اس‌کیو‌ال و دیتابریک

دوره حاضر با هدف توانمندسازی مهندسان داده در مدیریت و انتقال داده‌ها بین سیستم‌های رابطه‌ای سنتی و پلتفرم‌های ابری مدرن طراحی شده است. در بخش نخست، این آموزش بر توانمندی‌های MS SQL Server تمرکز می‌کند؛ سیستمی که به عنوان یکی از پرکاربردترین بانک‌های اطلاعاتی رابطه‌ای در جهان شناخته می‌شود. شرکت‌کنندگان در این بخش می‌آموزند که چگونه از محیط قدرتمند این نرم‌افزار برای ذخیره‌سازی داده‌ها، اجرای پرس‌وجوهای پیچیده، بهینه‌سازی جداول و انجام تحلیل‌های سطح سازمانی استفاده کنند. همچنین، کار با زبان T-SQL برای نوشتن کوئری‌های پیشرفته و مدیریت ساختارهای رابطه‌ای جهت آماده‌سازی داده‌ها برای بارهای کاری ETL (استخراج، تبدیل و بارگذاری) به طور کامل تشریح می‌شود.
در بخش دوم، تمرکز اصلی بر روی پلتفرم Databricks معتبر است که بر پایه Apache Spark بنا شده است. این پلتفرم به عنوان یک محیط یکپارچه برای مهندسی داده و تحلیل‌های کلان‌داده شناخته می‌شود و ابزارهای لازم برای پردازش داده‌ها در مقیاس بسیار بزرگ را فراهم می‌کند. در این دوره، دانش‌جویان با نحوه ایجاد جریان‌های کاری ETL کارآمد، بهره‌گیری از ذخیره‌سازهای Delta Lake و اعمال حاکمیت داده در سطح سازمانی از طریق Unity Catalog آشنا می‌شوند.
مدرس در طول این مسیر آموزشی، تمامی دانش فنی لازم برای تسلط بر مهندسی داده با استفاده از ترکیب MS SQL و Apache Spark را به صورت گام‌به‌گام ارائه می‌دهد. آموزش‌ها با استفاده از دیاگرام‌های مفهومی، مثال‌های عملی و پروژه‌های واقعیِ توسعه خط لوله (Pipeline) داده همراه است تا اطمینان حاصل شود که یادگیرندگان می‌توانند داده‌ها را به شکلی بهینه تغییر شکل داده و برای سیستم‌های تحلیلی آماده سازند. این دوره شکاف بین پایگاه داده‌های سنتی و پردازش ابری را پر کرده و مهارت‌های لازم برای کار در محیط‌های داده‌محور امروزی را به ارمغان می‌آورد.
در دوره آموزشی MS SQL to Databricks Spark ETL Training for Data Engineers با فرآیندهای پیشرفته مهندسی داده و طراحی خط لوله‌های ETL آشنا خواهید شد.

دانلود Python, Databricks & Apache Spark: Complete ETL Engineering آموزش پایتون، دیتابریکس و آپاچی اسپارک

دانلود Python, Databricks & Apache Spark: Complete ETL Engineering - آموزش پایتون، دیتابریکس و آپاچی

پایتون به عنوان یکی از منعطف‌ترین و پرکاربردترین زبان‌های برنامه‌نویسی در حوزه مهندسی و تحلیل داده شناخته می‌شود. اکوسیستم غنی این زبان، شامل کتابخانه‌های محبوبی نظیر Pandas ،PySpark و NumPy، به متخصصان اجازه می‌دهد تا داده‌ها را با سرعت بالا پردازش کرده، حجم کاری را خودکارسازی کنند و سیستم‌های ETL مقیاس‌پذیری را ایجاد نمایند که توانایی مدیریت حجم عظیم اطلاعات را داشته باشند. از سوی دیگر، دیتا‌بریکس به عنوان یک پلتفرم یکپارچه برای تحلیل و مهندسی داده معرفی می‌شود که جهت ساده‌سازی فرآیندهای داده‌های حجیم (Big Data) و یادگیری ماشین توسعه یافته است. این پلتفرم که بر پایه آپاچی اسپارک بنا شده، محیطی بهینه برای ایجاد خطوط لوله ETL با کارایی بالا فراهم می‌کند. شرکت‌کنندگان در این دوره می‌آموزند که چگونه از نوت‌بوک‌های مشارکتی استفاده کنند و حاکمیت داده‌ها را در سطح سازمانی با ابزارهایی مانند Unity Catalog مدیریت نمایند.
این دوره آموزشی تمام دانش لازم برای تبدیل شدن به یک متخصص مهندسی داده را در اختیار کاربران قرار می‌دهد. آموزش‌ها با استفاده از نمودارهای بصری، مثال‌های کاربردی و پروژه‌های واقعیِ توسعه خط لوله ETL همراه است تا مفاهیم به عمیق‌ترین شکل ممکن منتقل شوند. در طول این مسیر، از مراحل اولیه ورود داده‌ها تا پاکسازی، تغییر شکل و در نهایت بارگذاری آن‌ها در مخازن داده، به صورت گام‌به‌گام بررسی خواهد شد.
در دوره آموزشی Python, Databricks & Apache Spark: Complete ETL Engineering با اصول طراحی و اجرای فرآیندهای مهندسی داده آشنا خواهید شد.

دانلود Complete Databricks & PySpark Bootcamp: Zero to Hero آموزش دیتا بریکس و پای اسپارک

دانلود Complete Databricks & PySpark Bootcamp: Zero to Hero - آموزش دیتا بریکس و پای اسپارک

این دوره برای کسانی طراحی شده که می‌خواهند به یک مهندس داده تبدیل شوند و بر یکی از پرتقاضاترین پلتفرم‌های این صنعت مسلط گردند. این بوت‌کمپ، افراد را از سطح مبتدی تا پیشرفته در حوزه‌های Databricks، کتابخانه PySpark و Delta Lake ارتقا می‌دهد. یادگیری از طریق ساخت گام به گام پروژه‌های واقعی و کاربردی مهندسی داده انجام می‌شود. صرف نظر از اینکه فرد تازه با Databricks آشنا شده یا پیش‌تر تجربه داشته است، این بوت‌کمپ مهارت‌های عملی مورد نیاز برای طراحی، ساخت و بهینه‌سازی خطوط لوله ETL (استخراج، تبدیل، بارگذاری) در محیط ابری را فراهم می‌آورد. شرکت‌کنندگان با تسلط بر معماری Medallion (شامل لایه‌های Bronze، Silver و Gold) به صورت عملی، توانایی مدیریت و پردازش داده‌های حجیم را کسب می‌کنند.
در طول دوره، شرکت‌کنندگان مهارت‌هایی حیاتی مانند ساخت خطوط لوله ETL سرتاسری با استفاده از PySpark و SQL را فرا می‌گیرند. همچنین، کار با Delta Lake برای انجام تراکنش‌های ACID، مدیریت تکامل طرحواره (Schema Evolution) و قابلیت سفر در زمان (Time Travel) پوشش داده می‌شود. روش‌های ورود و پردازش داده‌ها با استفاده از ابزارهایی مانند Auto Loader و Delta Live Tables (DLT) آموزش داده شده و نحوه پاکسازی داده‌های نامرتب با تبدیل‌های PySpark و اجرای قوانین کیفیت داده فرا گرفته خواهد شد.
در دوره آموزشی Complete Databricks & PySpark Bootcamp: Zero to Hero با اصول و کاربردهای پیشرفته Databricks و PySpark برای ساخت خطوط لوله ETL در مقیاس بزرگ آشنا خواهید شد.

دانلود Machine Learning & Data Science: The Complete Visual Guide آموزش یادگیری ماشین

دانلود Machine Learning & Data Science: The Complete Visual Guide - آموزش یادگیری ماشین

در این دوره، دانش‌پذیران با دموهای گام به گام و هدایت‌شده، اعتماد به نفس خود را برای یادگیری مهارت‌های بنیادی افزایش می‌دهند. به جای حفظ کردن فرمول‌های ریاضی پیچیده یا یادگیری یک زبان برنامه‌نویسی جدید، تکنیک‌های یادگیری ماشین به صورت مفهومی تشریح می‌شوند تا فراگیران دقیقا درک کنند که این تکنیک‌ها چگونه و چرا کار می‌کنند. با دنبال کردن مثال‌های ساده و بصری و تعامل با مدل‌های کاربرپسند مبتنی بر اکسل، شرکت‌کنندگان می‌توانند موضوعاتی مانند رگرسیون خطی و لجستیک، درخت‌های تصمیم، کا-نزدیک‌ترین همسایه‌ها (KNN)، نایو بیز، خوشه‌بندی سلسله‌مراتبی و تحلیل احساسات را بدون نیاز به نوشتن حتی یک خط کد یاد بگیرند. در بخش ۱ این دوره، شرکت‌کنندگان با گردش کار یادگیری ماشین و تکنیک‌های رایج برای پاکسازی و آماده‌سازی داده‌های خام جهت تحلیل آشنا می‌شوند. همچنین، با استفاده از جداول فراوانی، هیستوگرام‌ها و نمودارهای توزیع، تحلیل تک‌متغیره را بررسی خواهند کرد و سپس به ابزارهای تحلیل چندمتغیره مانند نقشه‌های حرارتی، نمودارهای ویولن و جعبه‌ای، نمودارهای پراکندگی و همبستگی خواهند پرداخت.
در دوره آموزشی Machine Learning & Data Science: The Complete Visual Guide با مفاهیم و تکنیک‌های یادگیری ماشین و علم داده آشنا خواهید شد.

دانلود Azure Data Factory (ADF): Build Scalable Data Pipelines آموزش فکتوری داده آژور

دانلود Azure Data Factory (ADF): Build Scalable Data Pipelines - آموزش فکتوری داده آژور

Azure Data Factory (ADF) یک سرویس مبتنی بر فضای ابری برای ETL (استخراج، تبدیل، بارگذاری) و یکپارچه‌سازی داده‌ها است که توسط مایکروسافت ارائه شده است. این سرویس به سازمان‌ها امکان می‌دهد تا داده‌ها را از منابع متعدد، از جمله منابع محلی، در فضای ابری یا در پلتفرم‌های مختلف، انتقال، تبدیل و هماهنگ‌سازی کنند. این سرویس به عنوان خط لوله داده در محیط Azure عمل می‌کند و امکان اتصال، پاک‌سازی و تحویل داده‌ها به سیستم‌هایی مانند دریاچه‌های داده، انبارهای داده، پلتفرم‌های هوش تجاری و خطوط لوله یادگیری ماشین را فراهم می‌آورد. عملکرد Azure Data Factory بر اساس یک رویکرد گردش کاری است که شامل چهار مرحله اصلی است: ADF از طریق سرویس‌های پیوندی به بیش از ۱۰۰ منبع داده مانند SQL Server، Azure Blob Storage، Amazon S3، Google Cloud Storage، Salesforce و SAP متصل می‌شود. داده‌ها به صورت دسته‌ای یا در زمان واقعی دریافت می‌شوند. ADF از Data Flows (یک رابط بصری و بدون نیاز به کد برای تبدیل داده) یا فعالیت‌های سفارشی مانند اسکریپت‌های SQL، وظایف Spark، نوت‌بوک‌های Databricks و رویه‌های ذخیره‌شده استفاده می‌کند. تبدیل‌ها ممکن است شامل ادغام، فیلتر کردن، تجمیع، تبدیل فرمت (مانند تبدیل CSV به JSON و Parquet) و پاک‌سازی داده‌ها باشد.
در دوره آموزشی Azure Data Factory (ADF): Build Scalable Data Pipelines با مبانی Azure Data Factory و ساخت خطوط لوله داده آشنا خواهید شد.

دانلود Mastering Azure Data Factory : Real-World Projects With ADF آموزش فکتوری داده آژور

دانلود Mastering Azure Data Factory : Real-World Projects With ADF - آموزش فکتوری داده آژور

این دوره برای کسانی طراحی شده است که می‌خواهند پلتفرم Azure Data Factory را به صورت عملی و با پروژه‌های واقعی، خطوط داده پویا و حل مشکلات کاربردی بیاموزند. این دوره از سخنرانی‌های تئوری و آماده‌سازی عمومی برای گواهینامه‌ها فاصله گرفته و بر کاربرد واقعی تمرکز دارد. مسترینگ دیتا فکتوری آژور دوره‌ای است که به شرکت‌کنندگان کمک می‌کند تا به طور عملی و از طریق سناریوهای واقعی، مهارت‌های خود را در Azure Data Factory (ADF) ارتقا دهند. این دوره به جای تمرکز بر مفاهیم تئوریک، بر حل مسائل عملی و پیاده‌سازی پروژه‌های دنیای واقعی تمرکز دارد. شرکت‌کنندگان با یادگیری و استفاده از Azure Data Factory، می‌توانند داده‌ها را از منابع مختلفی مانند SQL، REST APIs، Snowflake و PostgreSQL جمع‌آوری کنند. علاوه بر این، دوره شامل آموزش ساخت چارچوب‌های قابل استفاده مجدد، پیاده‌سازی بارهای افزایشی و تبدیل داده‌ها با استفاده از Data Flows است. این دوره توسط CloudPandith (Mallaiah)، یک معمار ارشد داده و مربی حرفه‌ای، هدایت می‌شود و بیش از ۴۰ سناریوی بلادرنگ ADF را دربرمی‌گیرد. مخاطبان این دوره، چه مبتدی باشند و چه افراد حرفه‌ای، یاد می‌گیرند که چگونه خطوط داده را با استفاده از تمام ویژگی‌های ADF مانند SHIR (محیط‌های یکپارچه‌سازی خودمیزبان)، تریگرها (محرک‌ها)، ادغام Key Vault، CDC (تغییر داده‌های ضبط شده)، و زمان‌بندی Databricks طراحی، خودکارسازی و بهینه کنند. در این دوره، هر بخش آموزشی بر مبنای کاربردهای واقعی ساخته شده و نه بر اساس تئوری‌های کتابی.
در دوره آموزشی Mastering Azure Data Factory : Real-World Projects With ADF با ساخت و بهینه‌سازی خطوط داده در پلتفرم Azure آشنا خواهید شد.

دانلود Complete Google Earth Engine for Remote Sensing & GIS آموزش گوگل ارث انجین

دانلود Complete Google Earth Engine for Remote Sensing & GIS - آموزش گوگل ارث انجین

این دوره آموزشی برای آشنایی کامل با مفاهیم پایه سنجش از راه دور ماهواره‌ای و تحلیل داده‌های GIS با استفاده از گوگل ارث انجین (GEE)، پلتفرمی در مقیاس سیاره‌ای برای داده‌ها و تحلیل‌های علوم زمین، طراحی شده است. این پلتفرم از زیرساخت‌های ابری گوگل بهره می‌برد و قادر به پردازش پتابایت‌ها داده تصویری است. در این دوره، با تمرین‌های عملی و داده‌های واقعی سنجش از راه دور و GIS، شرکت‌کنندگان به صورت گام به گام با این ابزار قدرتمند آشنا می‌شوند. با شرکت در این دوره، گامی مهم در مسیر تبدیل شدن به یک متخصص تحلیل داده‌های مکانی برداشته می‌شود. مدرس دوره، فارغ‌التحصیل مقطع MPhil از دانشگاه آکسفورد و دارای مدرک دکترا از دانشگاه کمبریج است. او چندین سال تجربه در تحلیل داده‌های واقعی سنجش از راه دور و انتشار مقالات در مجلات معتبر بین‌المللی را دارد. در طول دوره، از داده‌های واقعی سنجش از راه دور مانند داده‌های لندست (Landsat) از USGS و داده‌های راداری از JAXA استفاده می‌شود تا تجربه عملی کار با سنجش از راه دور و درک کاربرد آن فراهم گردد. این دوره تضمین می‌کند که شرکت‌کنندگان تکنیک‌های تحلیل داده‌های سنجش از راه دور را به طور عملی یاد گرفته و مهارت خود را در تحلیل‌های مکانی افزایش دهند.
در دوره آموزشی Complete Google Earth Engine for Remote Sensing & GIS با تحلیل داده‌های سنجش از راه دور و GIS با استفاده از گوگل ارث انجین آشنا خواهید شد.