Schulungsübersicht
Einführung in Apache Iceberg
- Überblick über Apache Iceberg
- Wiederholung grundlegender Konzepte
Tiefer Einblick in die Iceberg-Architektur
- Detaillierte Analyse des Iceberg-Tabellenformats
- Ausführlicher Architekturüberblick, einschließlich Metadaten und Dateistruktur
- Funktionsweise von Schema- und Partition-Evolution
Erweiterte Installation und Konfiguration
- Konfiguration von Iceberg für optimale Leistung in unterschiedlichen Umgebungen
- Integration mit verschiedenen Datenverarbeitungs-Engines
- Erweitertes Setup: Sicherheit, Verschlüsselung und Zugriffskontrollen
- Einrichtung von Iceberg in einer verteilten Umgebung
Fortgeschrittene Operationen und Wartung
- Verwaltung großer Iceberg-Tabellen
- Implementierung und Management komplexer Schemaänderungen
- Handhabung von Partition-Evolution und versteckter Partitionierung
- Fortgeschrittene CRUD-Operationen mit Schema- und Partitionänderungen
Abfrageoptimierungstechniken
- Techniken zur Reduzierung der Abfragelatency
- Partition Pruning und File Pruning
- Metadaten-Caching und Optimierungsstrategien
- Implementierung und Test von Abfrageoptimierungstechniken
Performance-Tuning für große Datensätze
- Optimierung der Leistung für großskalige Datensätze
- Nutzung von Icebergs integrierten Funktionen zum Performance-Tuning
- Fallstudien zum Performance-Tuning in realen Szenarien
- Leistungsanpassung für großskalige Datensätze
Fortgeschrittene Datenmigration und Integration
- Migration komplexer Datenstrukturen von anderen Systemen
- Integration von Iceberg mit Echtzeit-Datenströmen
- Migration komplexer Datensätze und Integration von Echtzeit-Datenströmen
Zuverlässigkeit und Konsistenz
- Sicherstellung der Datenkonsistenz und -integrität in verteilten Umgebungen
- Implementierung und Management von Transaktionsgarantien
- Behandlung von Ausfällen und Wiederherstellungsmechanismen
- Implementierung von Zuverlässigkeits- und Konsistenzmerkmalen
Erweiterte Funktionen und Anpassung
- Benutzerdefinierte Catalog-Implementierungen
- Erweiterung von Iceberg mit benutzerdefinierten Funktionen
- Implementierung eines benutzerdefinierten Catalogs und Erweiterung der Iceberg-Funktionalitäten
Daten-Governance und Compliance
- Implementierung von Daten-Governance-Richtlinien
- Einhaltung gesetzlicher Datenschutzbestimmungen
- Verwaltung von Audit-Trails und Data Lineage
- Implementierung von Governance- und Compliance-Funktionen
Zusammenfassung und nächste Schritte
Voraussetzungen
- Vertrautheit mit den Kernkonzepten, grundlegenden Operationen und dem Iceberg-Tabellenmanagement
Zielgruppe
- Data Engineers
- Data Architects
- Data Analysts
- Softwareentwickler
Erfahrungsberichte (2)
Eine Reise durch die Spark-Welt: ein sehr intensiver Kurs. DSL, Spark SQL, Partitionierung versus Bucketing für mich.
Georgiana Elisabeta
Kurs - Apache Spark Fundamentals
Maschinelle Übersetzung
Praktische Übungen. Die Kursdauer sollte eigentlich fünf Tage betragen, aber die drei Tage halfen dabei, viele Fragen zu klären, die ich bei der Arbeit mit NiFi bereits hatte.
James - BHG Financial
Kurs - Apache NiFi for Administrators
Maschinelle Übersetzung