0

دانلود کتاب سفر اکتشافی در دنیای پایگاه‌های داده: بررسی پایگاه‌های داده برداری، سری زمانی، گرافی، ستونی (OLAP) و مکانی-جغرافیایی در محیط واقعی

  • عنوان کتاب: The Database Safari Exploring Vector, Time‐Series, Graph, ColumnarOLAP, and Geospatial Databases in the Wild
  • نویسنده: Gabor Koos
  • حوزه: پایگاه داده برداری
  • تعداد صفحه: 424
  • زبان اصلی: انگلیسی
  • نوع فایل: pdf
  • حجم فایل: 3.34 مگابایت

در طول دو دهه گذشته، چشم‌انداز داده‌ها به طرز چشمگیری تغییر کرده است. رکوردهای تجاری سنتی و داده‌های تراکنشی با انفجاری از فرمت‌های جدید همراه شده‌اند. این فرمت‌ها شامل معیارها و لاگ‌های سیستم‌های نظارتی و دستگاه‌های اینترنت اشیا (مانند InfluxDB، Prometheus)، جاسازی‌ها و بردارهای با ابعاد بالا که موتورهای یادگیری ماشین و توصیه‌گر مدرن را تقویت می‌کنند (مانند Milvus یا Pinecone)، نمودارهای اجتماعی که میلیاردها رابطه بین کاربران، محصولات یا رویدادها را ثبت می‌کنند (مانند Neo4j)، جریان‌های رویداد که نشان‌دهنده _lowهای پیوسته تراکنش‌ها و تعاملات هستند (Kafka، AWS Kinesis) و داده‌های مکانی از دستگاه‌های GPS، نقشه‌ها و برنامه‌های کاربردی آگاه از مکان (مانند PostGIS) هستند. و این لیست ادامه دارد. این تنوع انواع داده‌ها چالش‌های جدیدی را برای مهندسان ایجاد کرده است. حجم‌ها بی‌سابقه هستند، الگوهای دسترسی بسیار متنوع هستند و حجم کار بسیار متفاوت است. برخی به نوشتن با تأخیر کم در مقیاس گسترده نیاز دارند، برخی دیگر به پرس‌وجوهای پیچیده روابط در رکوردهای به هم پیوسته نیاز دارند و برخی دیگر به تجمیع سریع در میلیاردها نقطه متکی هستند. برای دهه‌ها، پایگاه‌های داده رابطه‌ای، راه‌حل پیش‌فرض برای ذخیره‌سازی و پرس‌وجوی داده‌ها بودند. با افزایش مقیاس و تنوع برنامه‌ها، سیستم‌های NoSQL – شامل انباره‌های اسناد، موتورهای کلید-مقدار و پایگاه‌های داده ستونی گسترده – ظهور کردند که مقیاس‌پذیری افقی و طرح‌های انعطاف‌پذیر را ارائه می‌دهند. در حالی که این سیستم‌های همه منظوره، بارهای کاری زیادی را به طور مؤثر مدیریت می‌کنند، ممکن است در مواقعی که به مدل‌های عملکرد یا پرس‌وجوی خاص دامنه نیاز است، کم بیاورند. پایگاه‌های داده تخصصی این شکاف را پر می‌کنند. هر کدام برای نوع خاصی از داده‌ها و حجم کار طراحی شده‌اند، به جای جایگزینی، سیستم‌های همه منظوره را تکمیل می‌کنند و انتخاب‌های آگاهانه‌ای در ذخیره‌سازی، نمایه‌سازی، فشرده‌سازی و اجرای پرس‌وجو برای بهینه‌سازی دامنه خود انجام می‌دهند. این کتاب مروری سطح بالا بر این سیستم‌ها ارائه می‌دهد و قابلیت‌ها و موارد استفاده واقعی آنها را برجسته می‌کند تا بتوانید دلیل وجود آنها و زمان مناسب بودن آنها برای سیستم خود را درک کنید.

Over the past two decades, the landscape of data has dramatically changed. Traditional business records and transactional data have been joined by an explosion of new formats. These include metrics and logs from monitoring systems and IoT devices (e.g., InfluxDB, Prometheus), embeddings and high-dimensional vectors powering modern machine learning and recommendation engines (like Milvus or Pinecone), social graphs capturing billions of relationships between users, products, or events (e.g., Neo4j), event streams representing continuous _lows of transactions and interactions (Kafka, AWS Kinesis), and geospatial data from GPS devices, maps, and location-aware applications (e.g., PostGIS). And the list goes on. This diversity of data types has created new challenges for engineers. Volumes are unprecedented, access patterns are highly varied, and workloads differ widely. Some require low-latency writes at massive scale, others demand complex relationship queries across interconnected records, and still others rely on fast aggregations over billions of points. For decades, relational databases were the default solution for storing and querying data. As applications grew in scale and diversity, NoSQL systems—including document stores, key-value engines, and wide-column databases—emerged, offering horizontal scalability and flexible schemas. While these general-purpose systems handle many workloads effectively, they may fall short when domain-specific performance or query models are required. Specialized databases _ill this gap. Each is designed for a particular type of data and workload, complementing rather than replacing general-purpose systems, and making deliberate choices in storage, indexing, compression, and query execution to optimize for its domain. This book provides a high-level overview of these systems, highlighting their capabilities and real world use cases so you can understand why they exist and when they might be the right tool for your system.

این کتاب را میتوانید از لینک زیر بصورت رایگان دانلود کنید:

Download: The Database Safari Exploring Vector, Time‐Series, Graph, ColumnarOLAP, and Geospatial Databases in the Wild

نظرات کاربران

  •  چنانچه دیدگاه شما توهین آمیز باشد تایید نخواهد شد.
  •  چنانچه دیدگاه شما جنبه تبلیغاتی داشته باشد تایید نخواهد شد.

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

بیشتر بخوانید