Beginning Apache Spark Using Azure Databricks: Unleashing Large Cluster Analytics in the Cloud
Robert Ilijason
کشف منابع
در دنیای مدرن امروزی، کلان دادهها به یکی از مهمترین منابع برای کسبوکارها و صنایع مختلف تبدیل شدهاند. از مدیریت هوشمند شهری گرفته تا پزشکی و اقتصاد، کاربرد کلان دادهها غیرقابل اغماض است.
کلان دادهها (Big Data) به مجموعهای از دادهها گفته میشود که به دلیل حجم بالا، سرعت تولید یا تنوع، با ابزارهای سنتی و معمول پردازش داده قابل مدیریت نیستند. این دادهها میتوانند از منابع مختلفی جمعآوری شوند و اغلب به شکل بدون ساختار هستند، به گونهای که برای تحلیل و استخراج اطلاعات مفید، به روشها و الگوریتمهای پیشرفتهای نیاز است.
کلان دادهها در حوزههای مختلفی به کار میرود و کارایی فراوانی دارد. در زیر به برخی از کاربردهای مهم آن اشاره میکنیم:
کلان دادهها دارای ویژگیهایی خاص هستند که آنها را از دیگر انواع دادهها متمایز میکند. برخی از این ویژگیها عبارتند از:
مدیریت و بهرهبرداری از کلان دادهها چالشهای خاص خود را دارد که در این بخش به برخی از آنها میپردازیم:
برای پردازش و تحلیل کلان دادهها از ابزارها و تکنولوژیهای خاصی استفاده میشود. برخی از این ابزارها شامل Apache Hadoop، Apache Spark و NoSQL Databases هستند که هر یک قابلیتها و ویژگیهای خاص خود را دارند و میتوانند به سازمانها در بهرهبرداری حداکثری از دادهها کمک کنند.
کلان دادهها فرصتی بینظیر برای ایجاد ارزشهای جدید در کسبوکارها و بهبود فرآیندها ارائه میدهند. با بهرهگیری از تکنولوژیهای نوین و تخصص در تحلیل دادهها، سازمانها میتوانند در مسیر رشد و توسعه پایدار حرکت کنند.
Robert Ilijason
Adam Bellemare
Liam E. Gumley
Vadlamani Ravi (editor),Aswani Kumar Cherukuri (editor)
David L. Poole,Alan K. Mackworth
Narasimha Sadineni and Anuyogam Venkataraman
Tony Hey,Stewart Tansley,Kristin Tolle
Johnson B.S.
Jules J. Berman
Douglas B. Laney
Frank J. Ohlhorst
Alex Gorelik
Liliana Perez,Eun-Kyeong Kim,Raja Sengupta (eds.)
Bill Chambers, Matei Zaharia