{
 "id": "tool:delta-lake",
 "name": "Delta Lake",
 "typ": "tool",
 "slug": "delta-lake",
 "stand": "2026-09-07",
 "build": "20260907-1949",
 "zitieren_als": "Daten-WG, <Dokumenttitel>, <mm:ss>, <url>",
 "url": "https://datenwgknowledgekitchen.com/wissensgraph/thema/delta-lake.html",
 "canonical": "https://datenwgknowledgekitchen.com/wissensgraph/thema/delta-lake.html",
 "markdown": "https://datenwgknowledgekitchen.com/wissensgraph/library/delta-lake.md",
 "json": "https://datenwgknowledgekitchen.com/wissensgraph/library/delta-lake.json",
 "dokumente_gesamt": 4,
 "kernaussagen_gesamt": 9,
 "mit_kernaussagen": 5,
 "aliase": [
  "Delta",
  "Parquet",
  "Delta Parquet"
 ],
 "einordnung": "Instant Shortcuts, die automatisch in das Delta-Format umwandeln, funktionierten zum Zeitpunkt der Aufnahme noch nicht für Parquet-Dateien. (Stand 2025-07) Ein selbstgeschriebenes Python-Skript exportiert SQL-Server-Tabellen als Delta-Parquet-Dateien direkt in den OneLake-Speicher, wo sie sofort als Tabelle über den SQL-Endpunkt verfügbar sind. (Stand 2025-07) Aktuell werden Quellsysteme häufig tabellenweise per CDC oder als Delta Lake direkt in den Data Lake geschrieben, was ohne Ordnungsstruktur schnell zu einem sogenannten Data Swamp wird. (Stand 2025-07)",
 "nachbarn": [
  {
   "id": "tool:microsoft-fabric",
   "name": "Microsoft Fabric",
   "kantentyp": "ko-vorkommen",
   "belastbarkeit": "Heuristik, gezählt",
   "gemeinsame_segmente": 35,
   "beleg": "",
   "datei": "microsoft-fabric.md"
  },
  {
   "id": "tool:onelake",
   "name": "OneLake",
   "kantentyp": "ko-vorkommen",
   "belastbarkeit": "Heuristik, gezählt",
   "gemeinsame_segmente": 31,
   "beleg": "",
   "datei": "onelake.md"
  },
  {
   "id": "tool:lakehouse",
   "name": "Lakehouse",
   "kantentyp": "ko-vorkommen",
   "belastbarkeit": "Heuristik, gezählt",
   "gemeinsame_segmente": 28,
   "beleg": "",
   "datei": "lakehouse.md"
  },
  {
   "id": "tool:sql",
   "name": "SQL",
   "kantentyp": "ko-vorkommen",
   "belastbarkeit": "Heuristik, gezählt",
   "gemeinsame_segmente": 26,
   "beleg": "",
   "datei": "sql.md"
  },
  {
   "id": "tool:direct-lake",
   "name": "Direct Lake",
   "kantentyp": "ko-vorkommen",
   "belastbarkeit": "Heuristik, gezählt",
   "gemeinsame_segmente": 21,
   "beleg": "",
   "datei": "direct-lake.md"
  },
  {
   "id": "tool:warehouse",
   "name": "Warehouse",
   "kantentyp": "ko-vorkommen",
   "belastbarkeit": "Heuristik, gezählt",
   "gemeinsame_segmente": 18,
   "beleg": "",
   "datei": "warehouse.md"
  },
  {
   "id": "tool:power-bi",
   "name": "Power BI",
   "kantentyp": "ko-vorkommen",
   "belastbarkeit": "Heuristik, gezählt",
   "gemeinsame_segmente": 15,
   "beleg": "",
   "datei": "power-bi.md"
  },
  {
   "id": "tool:notebook",
   "name": "Notebook",
   "kantentyp": "ko-vorkommen",
   "belastbarkeit": "Heuristik, gezählt",
   "gemeinsame_segmente": 14,
   "beleg": "",
   "datei": "notebook.md"
  },
  {
   "id": "tool:dataflow",
   "name": "Dataflow",
   "kantentyp": "ko-vorkommen",
   "belastbarkeit": "Heuristik, gezählt",
   "gemeinsame_segmente": 13,
   "beleg": "",
   "datei": "dataflow.md"
  },
  {
   "id": "topic:refresh",
   "name": "Refresh",
   "kantentyp": "ko-vorkommen",
   "belastbarkeit": "Heuristik, gezählt",
   "gemeinsame_segmente": 13,
   "beleg": "",
   "datei": "refresh.md"
  },
  {
   "id": "tool:data-pipeline",
   "name": "Data Pipeline",
   "kantentyp": "ko-vorkommen",
   "belastbarkeit": "Heuristik, gezählt",
   "gemeinsame_segmente": 13,
   "beleg": "",
   "datei": "data-pipeline.md"
  },
  {
   "id": "topic:performance",
   "name": "Performance",
   "kantentyp": "ko-vorkommen",
   "belastbarkeit": "Heuristik, gezählt",
   "gemeinsame_segmente": 12,
   "beleg": "",
   "datei": "performance.md"
  },
  {
   "id": "tool:spark",
   "name": "Spark",
   "kantentyp": "ko-vorkommen",
   "belastbarkeit": "Heuristik, gezählt",
   "gemeinsame_segmente": 12,
   "beleg": "",
   "datei": "spark.md"
  },
  {
   "id": "tool:directquery",
   "name": "DirectQuery",
   "kantentyp": "ko-vorkommen",
   "belastbarkeit": "Heuristik, gezählt",
   "gemeinsame_segmente": 12,
   "beleg": "",
   "datei": "directquery.md"
  },
  {
   "id": "tool:fabric-capacity",
   "name": "Fabric Capacity",
   "kantentyp": "ko-vorkommen",
   "belastbarkeit": "Heuristik, gezählt",
   "gemeinsame_segmente": 11,
   "beleg": "",
   "datei": "fabric-capacity.md"
  }
 ],
 "kernaussagen": [
  {
   "typ": "Fakt",
   "dokument": "Daten-WG Thinkers Talk nr.65",
   "dokument_id": "yt:Fqt4gP1xB5w",
   "sekunde": 275,
   "zeit": "04:35",
   "url": "https://www.youtube.com/watch?v=Fqt4gP1xB5w&t=275s",
   "aussage": "Instant Shortcuts, die automatisch in das Delta-Format umwandeln, funktionierten zum Zeitpunkt der Aufnahme noch nicht für Parquet-Dateien."
  },
  {
   "typ": "Warnung",
   "dokument": "Daten-WG Thinkers Talk nr.65",
   "dokument_id": "yt:Fqt4gP1xB5w",
   "sekunde": 296,
   "zeit": "04:56",
   "url": "https://www.youtube.com/watch?v=Fqt4gP1xB5w&t=296s",
   "aussage": "Die wenige Tage zuvor angekündigte automatische CSV-zu-Delta-Umwandlung im Shortcut ist als Preview-Feature noch instabil und bricht bei Delta-inkompatiblen Spaltennamen ohne aussagekräftige Fehlermeldung ab."
  },
  {
   "typ": "Fakt",
   "dokument": "Mythos Data Vault und richtig große Modelle",
   "dokument_id": "yt:rrCi0lnGrCg",
   "sekunde": 1031,
   "zeit": "17:11",
   "url": "https://www.youtube.com/watch?v=rrCi0lnGrCg&t=1031s",
   "aussage": "Aktuell werden Quellsysteme häufig tabellenweise per CDC oder als Delta Lake direkt in den Data Lake geschrieben, was ohne Ordnungsstruktur schnell zu einem sogenannten Data Swamp wird."
  },
  {
   "typ": "Fakt",
   "dokument": "Daten-WG Thinkers Talk nr.65",
   "dokument_id": "yt:Fqt4gP1xB5w",
   "sekunde": 1442,
   "zeit": "24:02",
   "url": "https://www.youtube.com/watch?v=Fqt4gP1xB5w&t=1442s",
   "aussage": "Ein selbstgeschriebenes Python-Skript exportiert SQL-Server-Tabellen als Delta-Parquet-Dateien direkt in den OneLake-Speicher, wo sie sofort als Tabelle über den SQL-Endpunkt verfügbar sind."
  },
  {
   "typ": "Warnung",
   "dokument": "Daten-WG Deep Dive Financial Reporting",
   "dokument_id": "yt:TYmKrreMO3I",
   "sekunde": 1745,
   "zeit": "29:05",
   "url": "https://www.youtube.com/watch?v=TYmKrreMO3I&t=1745s",
   "aussage": "Business-Central-Spaltennamen mit Sonderzeichen lassen sich nicht direkt in Parquet-Dateien laden, weil Parquet dafür keine kompatiblen Spaltennamen zulässt."
  },
  {
   "typ": "Fakt",
   "dokument": "Fabric & Power BI Quarterly · 2025 Q4",
   "dokument_id": "yt:9TsHkV8sIRo",
   "sekunde": 1260,
   "zeit": "21:00",
   "url": "https://www.youtube.com/watch?v=9TsHkV8sIRo&t=1260s",
   "aussage": "Shortcut Transformations wandeln CSV-, JSON- oder Parquet-Dateien direkt im Shortcut in Delta-Tabellen um, ohne separate ETL-Strecke."
  },
  {
   "typ": "Fakt",
   "dokument": "Fabric & Power BI Quarterly · 2025 Q4",
   "dokument_id": "yt:9TsHkV8sIRo",
   "sekunde": 1564,
   "zeit": "26:04",
   "url": "https://www.youtube.com/watch?v=9TsHkV8sIRo&t=1564s",
   "aussage": "Die OneLake Table API erlaubt den nativen Zugriff auf Delta- oder Iceberg-Tabellen und ermöglicht die bidirektionale Nutzung mit Snowflake."
  },
  {
   "typ": "Fakt",
   "dokument": "Fabric & Power BI Quarterly · 2025 Q3",
   "dokument_id": "yt:lZvpCBMKASM",
   "sekunde": 2545,
   "zeit": "42:25",
   "url": "https://www.youtube.com/watch?v=lZvpCBMKASM&t=2545s",
   "aussage": "Mit der Shortcut-Transformation wird eine per Shortcut verlinkte CSV-Datei automatisch in eine Delta-Tabelle umgewandelt, ohne dass dafuer ein Notebook laufen muss."
  },
  {
   "typ": "Warnung",
   "dokument": "Fabric & Power BI Quarterly · 2025 Q3",
   "dokument_id": "yt:lZvpCBMKASM",
   "sekunde": 2652,
   "zeit": "44:12",
   "url": "https://www.youtube.com/watch?v=lZvpCBMKASM&t=2652s",
   "aussage": "Das Delta-Format hat strengere Restriktionen bei erlaubten Zeichen in Tabellennamen als CSV, was bei der Shortcut-Transformation zu Verwirrung durch Fehlermeldungen fuehren kann."
  }
 ],
 "dokumente": [
  {
   "id": "page:fabric_einsteiger_guide_v1",
   "titel": "Microsoft Fabric — Einsteiger-Guide",
   "datum": "2026-08-31",
   "abdeckung": "nur-text",
   "anteil": 0.341,
   "url": "https://datenwgknowledgekitchen.com/fabric_einsteiger_guide_v1.html",
   "sprungmarken": [
    {
     "label": "Abschnitt",
     "url": "https://datenwgknowledgekitchen.com/fabric_einsteiger_guide_v1.html#:~:text=02%20%C2%B7%20Architektur%20%26%20%2Azentrale%20Komponenten%2A",
     "sekunde": null
    },
    {
     "label": "Abschnitt",
     "url": "https://datenwgknowledgekitchen.com/fabric_einsteiger_guide_v1.html#:~:text=03%20%C2%B7%20Semantische%20Modelle%20%26%20%2ADirect%20Lake%2A",
     "sekunde": null
    },
    {
     "label": "Abschnitt",
     "url": "https://datenwgknowledgekitchen.com/fabric_einsteiger_guide_v1.html#:~:text=Die%20Fabric-Antwort",
     "sekunde": null
    }
   ]
  },
  {
   "id": "yt:Fqt4gP1xB5w",
   "titel": "Daten-WG Thinkers Talk nr.65",
   "datum": "2025-07-01",
   "abdeckung": "kernaussagen+zeitstempel",
   "anteil": 0.163,
   "url": "https://www.youtube.com/watch?v=Fqt4gP1xB5w",
   "sprungmarken": [
    {
     "label": "11:32",
     "url": "https://www.youtube.com/watch?v=Fqt4gP1xB5w&t=692s",
     "sekunde": 692
    },
    {
     "label": "23:04",
     "url": "https://www.youtube.com/watch?v=Fqt4gP1xB5w&t=1384s",
     "sekunde": 1384
    },
    {
     "label": "24:40",
     "url": "https://www.youtube.com/watch?v=Fqt4gP1xB5w&t=1480s",
     "sekunde": 1480
    }
   ]
  },
  {
   "id": "yt:rrCi0lnGrCg",
   "titel": "Mythos Data Vault und richtig große Modelle",
   "datum": "2025-07-01",
   "abdeckung": "kernaussagen+zeitstempel",
   "anteil": 0.045,
   "url": "https://www.youtube.com/watch?v=rrCi0lnGrCg",
   "sprungmarken": [
    {
     "label": "16:10",
     "url": "https://www.youtube.com/watch?v=rrCi0lnGrCg&t=970s",
     "sekunde": 970
    }
   ]
  },
  {
   "id": "page:power_bi_einsteiger_guide_v4",
   "titel": "Power BI von A bis Z — Einsteiger-Guide (End-to-End)",
   "datum": "2026-08-31",
   "abdeckung": "nur-text",
   "anteil": 0.026,
   "url": "https://datenwgknowledgekitchen.com/power_bi_einsteiger_guide_v4.html",
   "sprungmarken": [
    {
     "label": "Abschnitt",
     "url": "https://datenwgknowledgekitchen.com/power_bi_einsteiger_guide_v4.html#:~:text=Microsoft%20Fabric%20%26%20OneLake",
     "sekunde": null
    },
    {
     "label": "Abschnitt",
     "url": "https://datenwgknowledgekitchen.com/power_bi_einsteiger_guide_v4.html#:~:text=Fabric-Bausteine",
     "sekunde": null
    },
    {
     "label": "Abschnitt",
     "url": "https://datenwgknowledgekitchen.com/power_bi_einsteiger_guide_v4.html#:~:text=Datei-Quellen%20%C2%B7%20CSV%20%C2%B7%20Excel%20%C2%B7%20JSON%20%C2%B7%20Parquet",
     "sekunde": null
    }
   ]
  }
 ],
 "hinweise": [
  "Kernaussagen und Beziehungen sind maschinell erzeugt und nicht redigiert. Heuristische Kanten zählen Erwähnungen, keine Bedeutung. Bei Widersprüchen gilt das Video."
 ],
 "wiki_url": "https://datenwgknowledgekitchen.com/wissensgraph/#n=tool%3Adelta-lake",
 "graph_url": "https://datenwgknowledgekitchen.com/wissensgraph/graph.html#n=tool%3Adelta-lake&f=tool%3Adelta-lake"
}
