Σύντομη περιγραφή
Το μάθημα «Συστήματα Διαχείρισης Μεγάλων Δεδομένων» καλύπτει προχωρημένες έννοιες βάσεων δεδομένων και big data, από ευρετηρίαση (και χωρικές δομές) και βελτιστοποίηση επερωτήσεων, μέχρι δοσοληψίες, έλεγχο συνδρομικότητας και ανάκαμψη. Παράλληλα, παρουσιάζει κατανεμημένες/παράλληλες βάσεις, NoSQL/NewSQL προσεγγίσεις (π.χ. HBase, Cassandra, MongoDB) και εργαλεία του οικοσυστήματος Hadoop/Spark, με στόχο να “δένει” η θεωρία με το πώς στήνονται και αξιολογούνται πραγματικά συστήματα μεγάλης κλίμακας.
Tip – Τι χρειάζεται προσοχή
- Query processing & transactions: να είναι ξεκάθαρο πώς επηρεάζουν την απόδοση/ορθότητα η βελτιστοποίηση ερωτημάτων, ο συντονισμός δοσοληψιών και οι μηχανισμοί ανάκαμψης.
- Distributed/NoSQL επιλογές: να ξεχωρίζει πότε ταιριάζει κάθε μοντέλο (σχεσιακό vs NoSQL/NewSQL) και τι “θυσιάζεται” ή κερδίζεται σε συνέπεια, κλιμάκωση και πολυπλοκότητα.
Γιατί να επιλέξεις αυτό το μάθημα;
- Πρακτική εικόνα για σχεδίαση συστημάτων big data: επιλογή αρχιτεκτονικής, αποθήκευση/ευρετηρίαση, και επεξεργασία δεδομένων σε κλίμακα με εργαλεία όπως Hadoop/Spark.
- Ικανότητα να αξιολογείται απόδοση & αξιοπιστία σε πραγματικά σενάρια (φόρτος, ροές δεδομένων, αποτυχίες), με κριτήρια που χρησιμοποιούνται και σε παραγωγικά περιβάλλοντα.