big data

علوم داده - Data Science

پردازش داده‌های بدون ساختار

الگوهای پردازش داده‌های بدون ساختار در مقیاس بزرگ: مهندسی آشوب 🔴 مقدمه: بیداری غول خفته در پردازش داده‌های بدون ساختار…

بیشتر بخوانید »
آموزش

مراحل افزودن دیتا نود به کلاستر هدوپ

1. پیش نیازها: سخت افزار: کامپیوتر با حداقل 4 گیگابایت رم و 40 گیگابایت فضای ذخیره سازی سیستم عامل لینوکس…

بیشتر بخوانید »
آموزش

دستورات مدیریتی HDFS

در اینجا تعدادی از دستورات پرکاربرد برای مدیریت HDFS آورده شده است: 1. دستورات مربوط به NameNode: hdfs namenode -format:…

بیشتر بخوانید »
آموزش

مراحل پیاده سازی HDFS

پیش نیازها: سیستم عامل: لینوکس (مانند Ubuntu، CentOS) سخت افزار: حداقل 2 کامپیوتر با 4 گیگابایت رم و 40 گیگابایت فضای ذخیره…

بیشتر بخوانید »
آموزش

MapReduce در هدوپ

MapReduce یک چارچوب پردازش موازی توزیع شده است که برای پردازش مجموعه داده های بزرگ در خوشه های رایانه ای…

بیشتر بخوانید »
اصطلاحات

DataNode در هدوپ

در هدوپ، DataNode یک جزء کلیدی سیستم فایل توزیع شده HDFS (Hadoop Distributed File System) است. وظیفه اصلی DataNode ذخیره…

بیشتر بخوانید »
آموزش

کار با HDFS توسط کدهای پایتون

1. آپلود فایل به HDFS: from hdfs import Client client = Client("hdfs://namenode.example.com:9000") with open("/local/file.txt", "rb") as f: client.write("/hdfs/file.txt", f) 2.…

بیشتر بخوانید »
آموزش

مراحل پیاده سازی آپاچی هدوپ با داکر

مراحل پیاده سازی آپاچی هدوپ با داکر: مرحله 1: پیش نیازها: نصب Docker: Docker Desktop را در سیستم خود نصب کنید.…

بیشتر بخوانید »
آموزش

مراحل پیاده سازی آپاچی هدوپ در لینوکس

پیش نیازها: سیستم عامل: لینوکس (مانند Ubuntu، CentOS) سخت افزار: حداقل 2 کامپیوتر با 4 گیگابایت رم و 40 گیگابایت فضای ذخیره…

بیشتر بخوانید »
اصطلاحات

HDFS (Hadoop Distributed File System)

HDFS مخفف Hadoop Distributed File System است، که یک سیستم فایل توزیع شده است و یکی از اجزای اصلی چارچوب…

بیشتر بخوانید »
دکمه بازگشت به بالا