aktualisiert am 21. Juli 2026

Marketingdaten mehrerer Marken: woran Pipelines scheitern

Warum markenübergreifende Marketingauswertungen scheitern: Identitäten, Kanaldefinitionen, Zeitzonen, Doppelzählung — und wer die Wahrheit besitzen darf.

Parallele Bahnen, die am Zusammenfluss nicht ineinanderlaufen.
Dieses Bild ist KI-generiert.

Eine Pipeline, die Kampagnen-, CRM- und Kanaldaten mehrerer Marken in eine Tabelle gießt, gilt oft als gelöst, sobald die ersten Zahlen erscheinen. Genau dort beginnt das Problem: Die Zahl ist da, aber niemand kann sie nachrechnen. Zwei Marken zählen denselben Vorgang unterschiedlich, zwei Systeme halten sich für dieselbe Person zuständig, und der Berichtszeitraum hängt von der Zeitzone des Exports ab.

Das Scheitern ist selten ein fehlender Konnektor. Es ist die Annahme, dass sich ungleichartige Wahrheiten addieren lassen, wenn man sie nur oft genug umbenennt. In einem Automobilkonzern, der Kampagnendaten aus fünf Marken zusammenführen wollte, funktionierte jede Markenlandschaft für sich. Die Sammelaktion darüber — Exporte anfordern, Tabellen zusammenkopieren, Begriffe von Hand angleichen — lieferte ein Ergebnis, das Wochen alt war, bevor es jemand las. Eine Summe über verschieden definierte Kontakte ist keine Kennzahl. Sie ist eine Behauptung.

Identitäten, die sich nicht treffen

Jede Marke bringt ihre eigene Kundendatenbank mit. Eine Person, die zwei Marken desselben Konzerns kennt, existiert dort als zwei Datensätze: andere Kundennummer, anderer Cookie-Raum, andere Einwilligung, anderes Feld für die E-Mail. Die Pipeline sieht zwei Identitäten, weil sie zwei Schlüssel sieht. Eine markenübergreifende Reichweite, die das nicht auflöst, zählt denselben Menschen zweimal — oder verwirft ihn, weil die Schlüssel nicht zusammenpassen.

Noch enger wird es innerhalb einer Marke. Kampagnensystem, CRM und Webanalyse führen jeweils einen eigenen Identitätsraum. Der eine Schlüssel lebt nur, solange der Browser das Cookie hält. Der andere entsteht erst nach einem Formular. Der dritte hängt an einem Händler- oder Vertragskonto. Eine Strecke, die diese Räume ohne Regel zusammenführt, erzeugt entweder Geisterkunden oder verliert die Fälle, in denen die Zuordnung unsicher ist. Beides sieht in der Auswertung gleich glatt aus.

Die Versuchung ist, einen Datensatz zu erzwingen, der gewinnt. Das verschiebt den Fehler nur. Wer ohne schriftliche Regel entscheidet, welcher Schlüssel Vorrang hat, bindet die Wahrheit an die Reihenfolge der Läufe. Ein späterer Abgleich überschreibt dann nicht einen Tippfehler, sondern die letzte Version einer ungeklärten Zuständigkeit.

Eine belastbare Strecke hält fest, aus welchem System der Schlüssel stammt, mit welcher Sicherheit er einer Person zugeordnet wurde, und welche Fälle unzugeordnet bleiben. Sichtbare Unschärfe ist brauchbarer als eine eindeutige Zahl, die niemand prüfen kann. In der genannten Fallstudie war genau das die Voraussetzung dafür, dass die Auswertungsschicht etwas Belastbares liefern konnte.

Kanaldefinitionen, die denselben Namen tragen

Dieselben Wörter bedeuten zwischen Marken Verschiedenes. Was die eine als „Kontakt“ zählt, ist bei der anderen erst nach einer Bestätigung ein Kontakt. Ein „Klick“ kann ein erfasster HTTP-Aufruf sein, ein bestätigter Seitenaufruf beim Werbetreibenden oder eine Interaktion innerhalb der Anzeige, die nirgendwohin weiterleitet. Wer diese drei Größen unter einem Spaltennamen addiert, hat nicht verdichtet. Er hat die Definition zerstört.

Die Branche hat das Problem nicht erst gestern entdeckt. Die Click Measurement Guidelines von IAB und Media Rating Council trennen ausdrücklich den Klick, der den Nutzer vom Verlag zum Werbetreibenden führt, vom In-Unit-Klick, der in der Anzeige bleibt. Sie beschreiben außerdem einen Lebenszyklus — ausgelöst, gemessen, empfangen, aufgelöst — und verlangen, ungültige und maschinelle Aktivität aus der kaufmännischen Zählung zu entfernen. Zwei Marken, die „Klick“ sagen und an verschiedenen Stellen dieses Zyklus messen, berichten nicht dieselbe Leistung.

Bei Impressionen ist die Lage nicht besser. Die Desktop-Display-Impression-Measurement-Guidelines von IAB und MRC lassen eine Impression erst zählen, wenn ein Zähler eine Anfrage für ein Tracking-Asset vom Client entgegennimmt und der Anzeigeninhalt geladen ist und mindestens zu rendern beginnt. Daneben existiert die Kategorie der „Tracked Ads“: Messung ausgelöst, Anzeige aber noch nicht gerendert. Beide Größen sind zulässig — aber nur mit offener Bezeichnung. Eine Pipeline, die beide als Impression übernimmt, weil die Quellspalte so heißt, mischt zwei Währungen.

Kanal ist außerdem kein Feld, das sich aus dem Dateinamen ergibt. „Social“, „Display“ und „Retail Media“ sind in den Quellsystemen oft Marketingetiketten, keine technischen Identifikatoren. Dieselbe Platzierung wandert zwischen Marken in verschiedene Töpfe, sobald jemand das Kampagnenobjekt umbenennt. Ohne ein Verzeichnis, das festlegt, welches Feld welchen Systems welchen Kanal bedeutet — und was passiert, wenn ein System die Größe gar nicht kennt —, bleibt die Kanalauswertung eine nachträgliche Interpretation.

Zeitzonen, die den Berichtszeitraum verschieben

Ein Konzern, der weltweit wirbt, hat selten eine Uhr. Kampagnenfenster folgen der Ortszeit der Zielgruppe, Exporte der Uhr des Adservers, CRM-Ereignisse der Zeitzone der Datenbank, und der wöchentliche Bericht der Erwartung, dass „Montag bis Sonntag“ überall derselbe Abschnitt ist. Eine Pipeline, die Datumswerte ohne Versatz einliest, verschiebt den Rand des Berichts, ohne dass jemand einen Fehler sieht.

RFC 3339 verlangt für Zeitstempel im Internet ausdrücklich eine angegebene Beziehung zu UTC. Ein Wert ohne Versatz ist in diesem Profil kein Zeitstempel, sondern eine lokale Wanduhr. Das W3C-Arbeitspapier zu Zeit und Zeitzonen trennt genau das: incremental time liegt auf der Zeitachse, floating time ist ein Kalenderwert ohne Moment. Sommerzeitregeln ändern den Versatz nach politischer Entscheidung, nicht nach technischem Kalender. Zwei Marken, die denselben Kampagnentag in unterschiedlicher Ortszeit schneiden, erzeugen an den Rändern Doppelzählung oder Lücken — beides unsichtbar, solange niemand die Rohwerte mit Versatz vergleicht.

Der praktische Fehler sitzt meist vor der Umformung. Ein Export liefert 2026-03-29 00:00:00 ohne Zone. Eine Datenbank legt den Wert als UTC aus, eine andere als Europe/Berlin. In der Nacht der Sommerzeitumstellung verschiebt sich der Tag; der Monatsbericht einer Marke endet früher als der der anderen. Die Differenz erscheint als Kanaleffekt.

Deshalb gehören Ereigniszeiten in der Rohschicht mit Herkunft und Versatz abgelegt, nicht erst in der Auswertung „korrigiert“. Eine nachträgliche Umrechnung ohne den ursprünglichen Zoneneintrag ist keine Korrektur. Sie ist eine neue Behauptung über einen Moment, den man nicht mehr kennt.

Doppelzählung, die niemand mehr sieht

Doppelzählung entsteht nicht nur durch zwei Identitäten für eine Person. Sie entsteht, sobald dieselbe Leistung auf mehr als einem Weg in die Auswertung läuft.

Eine Impression, die der Publisher, der Adserver und ein unabhängiges Messpixel jeweils zählen, ist in den Rohdaten dreimal wahr und in der Summe falsch. Die MRC-Richtlinien empfehlen deshalb, jeden gemessenen Aufruf für den Browser eindeutig zu machen — etwa durch zufällige Zeichenketten gegen Cache-Treffer. Das löst die Wiederholung eines Zählers. Es löst nicht die Wiederholung mehrerer Zähler für dasselbe Ereignis. Ohne eine Regel, welcher Zähler für welche Kennzahl zuständig ist, addiert die Pipeline parallele Wahrheiten.

Dasselbe gilt für Klicks. IAB und MRC unterscheiden gemessene, empfangene und aufgelöste Klicks und verlangen, dass die gültige Zählung die gemessene nicht übersteigt. Eine Marke berichtet den Redirect, eine andere den bestätigten Seitenaufruf, eine dritte beide, weil zwei Exporte ungeprüft vereinigt wurden. Die Differenz sieht aus wie Untererfassung der einen oder Übererfassung der anderen. Sie ist ein ungelöster Zählpunkt.

Dazu kommen Wiederholungen der Strecke selbst. Ein abgebrochener Lauf, der ohne Idempotenz erneut startet, legt dieselben Ereignisse ein zweites Mal ab. Ein manuell nachgelieferter Export landet neben dem automatischen. Eine Person, die über zwei Marken angesprochen wird, erscheint in der Konzernreichweite doppelt — oder, bei falscher Zusammenführung, nur einmal. Beide Fehler haben dieselbe Oberfläche: eine Zahl, die sich nicht aus den Quellen rekonstruieren lässt.

Die Abwehr ist unspektakulär. Jeder Wert der Auswertungsschicht braucht einen Verweis auf seine Quelle und auf die Regel, die ihn erzeugt hat. Wo sich ein Ereignis nicht eindeutig zuordnen lässt, gehört es in eine eigene Kategorie, nicht in die glatte Summe. Wer Unschärfe versteckt, züchtet Vertrauen in eine Zahl, die beim ersten Nachrechnen zerfällt.

Wer die Wahrheit besitzt

Unter den fünf Scheiterpunkten ist dieser der am wenigsten technische und der folgenreichste. Eine Pipeline kann Identitäten mappen, Kanäle normieren und Zeiten auf UTC legen — und trotzdem scheitern, wenn niemand festlegt, welches System im Zweifel gewinnt.

Besitz der Wahrheit ist keine Metapher. Es ist die Zuständigkeit für eine Definition: welches Feld welche Kennzahl speist, wer eine Abweichung entscheiden darf, und welches System bei Widerspruch Vorrang hat. In gewachsenen Konzernlandschaften hält sich jede Marke für zuständig, und jedes Werkzeug innerhalb der Marke ebenfalls. Die Auswertungsschicht erbt alle Ansprüche und löst keinen.

Genau deshalb stand in der Fallstudie die Ablösung der Quellsysteme nicht zur Debatte. Sie wäre auch nicht durchsetzbar gewesen. Die Aufgabe war eine Schicht, auf die sich alle berufen können — mit nachvollziehbarer Herkunft je Wert, ohne dass eine Marke ihre Werkzeuge aufgibt. Das setzt voraus, dass die Wahrheit nicht im letzten erfolgreichen Lauf wohnt, sondern in einem Verzeichnis, das älter ist als die erste Umformung.

Dieses Verzeichnis ist keine Dokumentation im Nachhinein. Es ist die fachliche Grundlage der Strecke: Kennzahl, Bedeutung, Quellfeld, Umgang mit fehlenden Werten. Wo ein System die Größe nicht kennt, steht das als Fall, nicht als Null. Wo zwei Systeme widersprechen, steht die Vorrangregel, nicht der Mittelwert. Ohne diesen Besitz bleibt jede Korrektur an der Pipeline eine lokale Meinung.

Was vor der Pipeline geklärt sein muss

Technik folgt der Klärung, nicht umgekehrt. Die brauchbare Reihenfolge ist deshalb langweilig und selten die, die beauftragt wird.

Zuerst die Begriffe. Für jede Kennzahl, die markenübergreifend erscheinen soll: Was sie bedeutet, aus welchem Feld welchen Systems sie stammt, und wie mit den Fällen umgegangen wird, in denen ein System sie nicht kennt. Identitäten, Kanäle und Zeiträume gehören in dasselbe Verzeichnis. Was dort nicht steht, darf in der Auswertungsschicht nicht stillschweigend entstehen.

Dann die Rohschicht. Aufnahmestrecken je Quellsystem legen die Daten unverändert ab, bevor irgendetwas umgeformt wird. Erst diese Trennung macht eine spätere Korrektur rückwirkend nachvollziehbar: Die Rohdaten liegen noch da, die Umformung lässt sich erneut ausführen. Eine Pipeline, die nur das Ergebnis speichert, kann ihre eigene Geschichte nicht prüfen.

Dann die Abbildung. Begriffe werden auf das Verzeichnis gelegt, nicht auf die Spaltennamen der Quelle. Jeder Wert trägt einen Verweis auf seine Herkunft. Unzuordenbare Fälle werden ausgewiesen. Die Summe darf kleiner sein als das Gefühl der Auftraggeber. Sie darf nicht größer sein als das, was sich belegen lässt.

In der genannten Fallstudie hat genau diese Begriffsklärung länger gedauert als der Bau der Strecken. Sie war die Voraussetzung dafür, dass die Strecken etwas Belastbares liefern konnten. Die markenübergreifende Auswertung entsteht dort ohne manuelle Zwischenschritte. Die Diskussion in den Abstimmungsrunden verschob sich von der Frage, ob die Zahlen stimmen, auf die Frage, was aus ihnen folgt.

Wer heute eine gewachsene Marketinglandschaft mehrerer Marken zusammenführen will, findet die Scheiterpunkte nicht zuerst im Code. Er findet sie in den Identitätsräumen, in den Kanalwörtern, in den Uhren, in den parallelen Zählern und in der ungeklärten Zuständigkeit für die Wahrheit. Ob diese Brüche in der bestehenden Landschaft überhaupt sichtbar sind, klärt ein System-Audit: nicht als neues Dashboard, sondern als Befund, welches System sich für dieselbe Information zuständig hält und welches im Zweifel gewinnt.


Quellen

Fragen

Häufige Fragen.

Hilft ein teureres Auswertungswerkzeug gegen diese Fehler?

Nein. Die Pipeline scheitert an ungeklärten Begriffen, nicht an fehlender Rechenleistung. Identitäten, Kanäle und Zeiträume müssen vor dem Bau feststehen. Ein neues Tool verdoppelt sonst nur die Zahlen, die schon nicht zusammenpassen.

Wer sollte die Wahrheit über eine Kampagne besitzen?

Eine benannte Stelle — nicht jedes System für denselben Vorgang. Ohne führende Quelle zählt jede Marke, jedes Tool und jede Zeitzone denselben Kontakt anders. Die Besitzfrage ist eine Organisationsentscheidung, keine technische.

Wo fängt man an, wenn die Pipeline schon läuft und niemand den Zahlen traut?

Bei den Definitionen, nicht beim nächsten Dashboard. Zuerst klären, was eine Identität, ein Kanal und ein Berichtszeitraum sind. Erst danach lohnt sich der Blick in die Strecke — oft im Rahmen eines System-Audits, wenn mehrere Marken und Quellen beteiligt sind.

Nächster Schritt

Passt das auf Ihre Lage?

30 Minuten, kostenlos und unverbindlich.
Kein Pitch — wir sagen auch, wenn Sie etwas nicht brauchen.

Kontakt aufnehmen