Apache Flink 2 Schulung: SQL und DataStream API
Apache Software Foundation

Apache Flink 2 Schulung: SQL und DataStream API

Entwickle zustandsbehaftete Kafka-Pipelines, teste Recovery per Checkpoint und schreibe Streams nach Iceberg oder Paimon.

Die wichtigsten Themen

Event Time und Watermarks beherrschen

Flink SQL für Kafka-Streams einsetzen

Zustand mit DataStream API verwalten

Exactly Once mit Checkpoints absichern

Flink auf Kubernetes bereitstellen

Iceberg oder Paimon anbinden

Überblick Die Apache Flink 2 Schulung führt einen Kafka-Ereignisstrom durch eine zustandsbehaftete Pipeline bis zu Apache Iceberg oder Apache Paimon. Du versiehst Ereignisse mit Zeitstempeln und konfigurierst Watermarks für...

Die Apache Flink 2 Schulung führt einen Kafka-Ereignisstrom durch eine zustandsbehaftete Pipeline bis zu Apache Iceberg oder Apache Paimon. Du versiehst Ereignisse mit Zeitstempeln und konfigurierst Watermarks für verspätet eintreffende Daten. Tumbling, Sliding und Session Windows gruppieren die Ereignisse nach Event Time. Flink SQL verarbeitet dynamische Tabellen, Joins und Aggregationen. Mit der DataStream API implementierst du eigene Zustandslogik mit Timern und Process Functions in Java.

Du simulierst einen Jobabbruch und stellst den Zustand aus einem Checkpoint wieder her. Anschließend prüfst du die Exactly-once-Verarbeitung vom Kafka-Offset bis zum Tabellen-Commit. Du startest den Job im Application Mode auf Kubernetes und untersuchst Backpressure mit Flink-Metriken und Logs. Alle Übungen verwenden dieselbe Pipeline mit Kafka als Quelle und einem persistenten Lakehouse-Ziel. cmt stellt die Übungsgeräte und die benötigte Software bereit. Die Gruppe umfasst höchstens acht Personen. Für dein Team passt cmt das Inhouse-Training an eure technische Umgebung an.

Die Themen JobGraph und Ausführungsplan in Flink 2 · Aufgaben von JobManager und TaskManager · Parallelität und verkettete Operatoren · Backpressure entlang des Datenflusses · Zeitstempel für die Event-Time-Semantik...

Flink-2-Architektur und Laufzeit

  • JobGraph und Ausführungsplan in Flink 2
  • Aufgaben von JobManager und TaskManager
  • Parallelität und verkettete Operatoren
  • Backpressure entlang des Datenflusses

Ereigniszeit und Zeitfenster

  • Zeitstempel für die Event-Time-Semantik
  • Watermark-Strategien für verspätete Ereignisse
  • Tumbling Windows für feste Intervalle
  • Sliding Windows für überlappende Intervalle
  • Session Windows für Aktivitätsphasen

Flink SQL und dynamische Tabellen

  • Kafka-Tabellen über SQL DDL
  • Zeitattribute für dynamische Tabellen
  • Window TVFs für zeitbasierte Aggregationen
  • Zeitbezogene Joins zwischen dynamischen Tabellen

Table API und Datenmodelle

  • Abfragepipelines mit der Table API
  • Changelog-Modi für dynamische Tabellen
  • Schema-Definition mit Flink-Datentypen

Zustand mit der DataStream API

  • Keyed State für partitionierte Schlüsselströme
  • Broadcast State für verteilte Regeln
  • Timer in zustandsbehafteten Process Functions
  • Operator-UIDs für die Savepoint-Zuordnung

Fehlertoleranz und Wiederherstellung

  • Checkpoints für automatische Wiederanläufe
  • Savepoints für geplante Jobänderungen
  • Checkpoint Barriers im Ereignisstrom
  • Exactly-once-Verarbeitung bis zur Senke
  • Wiederanlauf nach simulierten Jobabbrüchen
  • Rescaling mit wiederhergestelltem Zustand

Kafka und Lakehouse-Speicher

  • Kafka-Quellen mit verwalteten Offsets
  • Kafka-Senken mit Transaktionsgarantien
  • Kataloge für Apache Iceberg oder Paimon
  • Tabellen-Commits bei kontinuierlichen Schreibvorgängen

Bereitstellung und Fehleranalyse

  • Application Mode auf Kubernetes
  • Ressourcen für JobManager und TaskManager
  • Persistenter Speicher für Checkpoints
  • Flink-Metriken zur Analyse von Backpressure
  • Konfiguration von Restart-Strategien
  • Logauswertung nach fehlgeschlagenen Neustarts
Zielgruppe
  • Data Engineers für Streaming-Pipelines
  • Backend- und Java-Entwickler für Ereignisverarbeitung
  • Platform Engineers für Flink auf Kubernetes
  • Architekten für Lakehouse-Datenflüsse
Das lernst du
  • Streaming-Pipelines mit Kafka, Flink 2 und einem persistenten Ziel entwickeln
  • Verspätete Ereignisse so verarbeiten, dass Zeitfenster reproduzierbare Ergebnisse liefern
  • Flink SQL, Table API und DataStream API nach dem benötigten Abstraktionsgrad auswählen
  • Zustand mit Keyed State, Timern und Broadcast State modellieren
  • Recovery aus Checkpoints testen und bestätigte Ergebnisse nach einem Neustart erhalten
  • Flink auf Kubernetes bereitstellen und Verzögerungen anhand von Metriken lokalisieren
So arbeiten wir

Kurze Fachimpulse wechseln mit Live-Demos und Übungen an einer durchgängigen Kafka-Flink-Pipeline. Code-Reviews in Zweiergruppen prüfen SQL-Abfragen und DataStream-Code. Vorbereitete Fehlerszenarien machen Checkpoint-Recovery, Backpressure und Monitoring beobachtbar. Ein Abschlussworkshop verbindet Kubernetes-Deployment mit Iceberg oder Paimon.

Empfohlene Vorkenntnisse
  • Praktische Kenntnisse in Java und SQL
  • Grundlagen in Kafka, Linux und Containern
  • Für Kubernetes empfiehlt sich der Kubernetes Grundkurs
Dein Fahrplan
  • Flink 2 Laufzeit mit JobManager und TaskManager
  • Kafka-Streams, Parallelität und Operator Chains
  • Event Time, Zeitstempel und Watermarks
  • Zeitfenster und verspätete Ereignisse
Organisatorisches

Lernformate

Unsere Seminare bieten dir maximale Flexibilität: Du kannst zwischen Live-Online und Vor Ort in unseren modernen Schulungszentren im D-A-CH Raum wählen. Beide Formate garantieren dir die gleiche hohe Qualität und interaktive Lernerfahrung.

Schulungsarten

Wir bieten dir verschiedene Schulungsarten: Offene Seminare, Firmenseminare für Teams und Inhouse-Schulungen direkt bei dir vor Ort. So findest du genau das Format, das zu deinen Bedürfnissen passt.

Uhrzeiten

09:00-16:00 Uhr

Aktuelle Software

In unseren offenen Kursen arbeiten wir mit der aktuellsten Software-Version. So lernst du direkt mit den Tools und Features, die du auch in deinem Arbeitsalltag verwendest - praxisnah und zukunftsorientiert. Bei Inhouse- und Firmenschulungen bestimmt ihr die Version.

Deine Vorteile

Zufriedenheitsgarantie

Wir sind von unserer Qualität überzeugt. Sollte ein Training einmal nicht deinen Erwartungen entsprechen, bieten wir dir an, den Kurs kostenlos zu wiederholen oder ein anderes Training zu besuchen. Ohne Risiko, ohne Diskussion.

Inklusivleistungen

Deine Teilnahme beinhaltet: Schulungsmaterial, Zertifikat, Verpflegung (bei Präsenzveranstaltungen) und persönliche Betreuung durch unsere Trainer und unser Orga-Team. Alles aus einer Hand - keine versteckten Kosten.

Lernen von Experten

Unsere Trainer sind zertifizierte und erfahrene Profis mit jahrelanger Berufserfahrung. Sie vermitteln dir in den Kursen nicht nur theoretisches Wissen, sondern teilen ihre Erfahrungen aus realen Projekten und helfen dir, das Gelernte direkt in deiner täglichen Arbeit anzuwenden. Das ist kein Werbeversprechen, sondern unser Anspruch. Am besten siehst du das in unseren Bewertungen, z.B. auch bei Google.

Keine Vorkasse

Du zahlst erst nach dem Seminar. Keine Vorkasse, keine Vorauszahlung - so kannst du sicher sein, dass du nur für das bezahlst, was du auch wirklich erhalten hast. Die Rechnung erhältst du erst nach Kursbeginn.

Max. 8 Teilnehmende

Wir setzen auf kleine Gruppen, damit du die Aufmerksamkeit bekommst, die du verdienst. So haben wir mehr Zeit für deine individuellen Fragen und können gezielt auf deine Bedürfnisse eingehen.

Termine & Buchung

Leider haben wir aktuell keine Termine geplant. Es wird wahrscheinlich bei uns etwas schief gelaufen sein - bitte kontaktiere uns und wir finden den passenden Termin.

Nicht der passende Termin dabei?

Wir finden eine Lösung: anderer Termin, mehrere Teilnehmer, Inhouse-Schulung oder individuelle Beratung.

Anfrage stellen
Inhouse & Firmenseminare

Lieber gleich das ganze Team schulen?

Diese Schulung gibt es auch exklusiv für dein Unternehmen, bei euch vor Ort, an unseren Standorten oder Live-Online. Inhalte und Termine nach Maß.

Beliebteste Wahl

Inhouse-Schulung

Wir kommen zu euch: diese Schulung maßgeschneidert in euren Räumen, für Unternehmen und Behörden.

  • Inhalte exakt auf euch zugeschnitten
  • Termine nach euren Bedürfnissen
  • Günstiger ab mehreren Teilnehmern
  • Vertraute Umgebung, kein Reiseaufwand
Inhouse-Schulung anfragen

Firmen-Seminar

Exklusiv für dein Team an einem unserer Standorte oder Live-Online, individuell angepasst.

  • Geschlossene Gruppe aus eurem Haus
  • Individuelle Terminplanung
  • An unseren Standorten oder Live-Online
  • Angepasste Inhalte
Firmen-Seminar anfragen

Fragen und Antworten zu Apache Flink 2 Schulung: SQL und DataStream API

Was ist Apache Flink und wofür wird es eingesetzt?

Apache Flink ist ein verteiltes Framework für zustandsbehaftete Verarbeitung kontinuierlicher Datenströme. Es verarbeitet Ereignisse anhand von Event Time, hält Anwendungszustand über Operatoren hinweg und stellt ihn nach Fehlern aus Checkpoints wieder her. Typische Anwendungen sind laufende Aggregationen, Ereigniskorrelation und Streaming-ETL.

Was unterscheidet Flink SQL, Table API und DataStream API?

Flink SQL beschreibt relationale Verarbeitung über dynamische Tabellen. Die Table API bildet vergleichbare Operationen programmatisch ab. Die DataStream API gibt dir Zugriff auf Ereignisse, eigenen Zustand, Timer und Process Functions für anwendungsspezifische Streaming-Logik.

Wie erreicht Apache Flink Exactly Once?

Exactly Once entsteht durch konsistente Checkpoints der Operatorzustände und Quellpositionen sowie durch eine Senke mit koordiniertem Commit. Für eine Ende-zu-Ende-Garantie müssen Quelle und Senke das jeweilige Wiederanlaufverfahren unterstützen. Im Training testest du dieses Verhalten mit Kafka und einer persistenten Senke.

Behandelt die Schulung Apache Flink 2?

Die Übungen und Architekturthemen orientieren sich an Apache Flink 2. Versionsabhängige Connectoren für Kafka, Iceberg oder Paimon werden in einer abgestimmten Trainingsumgebung eingesetzt, damit API und Connector-Versionen zusammenpassen.

Welche Vorkenntnisse brauche ich für das Flink Training?

Du solltest Java und SQL praktisch anwenden können und die Grundlagen von Kafka kennen. Erfahrung mit Linux und Containern erleichtert die Übungen. Kubernetes-Grundkenntnisse unterstützen dich beim Deployment-Teil.

Muss ich ein Notebook oder Softwarelizenzen mitbringen?

cmt stellt die benötigten Geräte, virtuellen Umgebungen und Softwarekomponenten bereit. Du kannst dadurch direkt mit Kafka, Flink und Kubernetes arbeiten, ohne eine eigene Trainingsumgebung vorzubereiten.

Ist die Apache Flink Schulung als Inhouse-Training verfügbar?

cmt bietet die Schulung als Inhouse-Training und Firmenseminar an. Inhalte, Connectoren und Übungen lassen sich auf Anfrage an euren Technik-Stack sowie an anonymisierte Datenflüsse aus eurem Unternehmen anpassen.

Gibt es Angebote für mehrere Mitarbeiter?

Für mehrere Mitarbeiter erstellt cmt auf Anfrage ein passendes Angebot. Übermittle dazu die Teamgröße, das gewünschte Format und den geplanten Standort an cmt.

Weitere häufig gestellte Fragen und Antworten findest du in den FAQs .

Unser Qualitätsversprechen: Wissen, das in der Praxis funktioniert

Aus der Praxis für die Praxis

Schluss mit theoretischem Ballast. Wir trainieren dich für reale IT-Herausforderungen, nicht für Multiple-Choice-Tests. Unsere Trainer vermitteln dir genau das Wissen, das am nächsten Montagmorgen im Job wirklich funktioniert.

Individuell statt "Schema F"

Deine Fragen passen nicht ins Standard-Skript? Bei uns schon. Wir verzichten auf starre Lehrpläne und geben deinen konkreten Projekt-Fragen Raum. Unsere Trainer passen die Inhalte flexibel an das an, was dich und dein Team aktuell weiterbringt.

Maximale Freiheit: Remote oder vor Ort

Lerne so, wie es in deinen Alltag passt - ohne Reise-Stress und Zeitverlust. Egal ob remote, hybrid oder präsent vor Ort: Wir garantieren dir ein nahtloses und effektives Lernerlebnis, egal von wo du dich zuschaltest.

Mit Zufriedenheitsgarantie

Wir sind von unserer Qualität überzeugt - und wollen, dass du es auch bist. Sollte ein Training einmal nicht deinen Erwartungen entsprechen, bieten wir dir an, den Kurs kostenlos zu wiederholen oder ein anderes Training zu besuchen. Ohne Risiko, ohne Diskussion.

NOCH FRAGEN?

Rufe mich an oder schreibe mir eine E-Mail.

Michaela Berger

Michaela Berger

Über 20.000 Unternehmen und Behörden vertrauen auf uns

Alle Referenzen
Siemens Logo
Telekom Logo
Rheinmetall Logo
Infineon Logo
MAN Logo
Fraunhofer Logo
ADAC Logo
Munich Re Logo
Deutsche Bahn Logo