F*ckups: Von Fehlern, Fails und fragilen Systemen 3D Cover
Kirkus Reviews verdict: GET IT

F*ckups: Von Fehlern, Fails und fragilen Systemen

Dieser Band konzentriert sich auf die Fundamente der digitalen Welt, die Teile, auf die sich alle verlassen, die niemand sieht und die kaum jemand wirklich versteht. Sie sind abstrakt, unsichtbar und leicht zu ignorieren. Bis zu dem Moment, in dem sie versagen.

Die Technologie hinter diesen Vorfällen mag für Außenstehende undurchsichtig sein, ihre Konsequenzen sind es nicht. Deshalb wurden die Fälle in diesem Band nicht nur ausgewählt, um zu erklären, was kaputtging, sondern um das Scheitern in der realen Welt zu verankern: verlorenes Geld, lahmgelegte Systeme, zerstörte Infrastruktur und die Art von Störungen, die aus den falschen Gründen Schlagzeilen machen.

Es wird Zeit, mit dem Mythos aufzuräumen, dass die IT nur im Keller existiert. Eine überraschende Anzahl der schlimmsten Störungen des 21. Jahrhunderts hatte in irgendeiner Form mit Computern zu tun, und zwar nicht, weil sie gehackt wurden, sondern wegen der Art, wie sie entworfen, vernetzt, getaktet und mit Vertrauen ausgestattet wurden.

Um zu verstehen, wie Dinge scheitern, müssen wir zunächst verstehen, wie Systeme darunter wirklich funktionieren: wie sie Informationen verarbeiten, kommunizieren und sich erinnern, und wie kleine Annahmen sich leise in großflächige Fehlschläge verwandeln.

Falls sich das anfangs wie schwarze Magie anhört, keine Sorge. Die Konzepte werden schrittweise eingeführt und anhand anschaulicher Metaphern erklärt: zugänglich, gelegentlich unterhaltsam (hoffentlich) und präzise genug, um dabei echtes Verständnis aufzubauen. Es wird kein Vorwissen vorausgesetzt.

Von dort verschiebt sich der Fokus zu Sicherheit, Wiederherstellung und Stabilität: Systeme vor böswilligen Akteuren zu schützen, sich auf den Wiederaufbau vorzubereiten, wenn Prävention versagt, und Systeme zu entwerfen, die nicht sofort zusammenbrechen, wenn etwas schiefgeht.

Und ja, in jedem dieser Bereiche gibt es unzählige Wege, sich selbst ins Knie zu schießen. Dieser Band deckt genug davon ab, um das Muster deutlich zu machen.

Auf einen Blick

  • 96 reale Fehlschläge — alle dokumentiert, keiner hypothetisch.
  • 28 Erklärungen, die komplexe Systeme in menschliche Sprache übersetzen.
  • Eine Handvoll weniger dokumentierter Kriegsgeschichten aus der eigenen Zeit des Autors in den Schützengräben.
  • Jeder Fall erklärt, was passiert ist und was dabei kaputtging, ohne in Details zu ertrinken.
  • Ton wie beim Bier mit Kollegen, ohne dabei etwas zu verharmlosen.
  • Respekt, wo er hingehört, mit bewusstem Tonwechsel bei echten Tragödien.
  • Faktencheck und Quellenarbeit auf akademischem Niveau (500+ Quellenverweise).
  • Erzählung aufgebaut aus konkreten Ereignissen, nicht abstrakter Theorie.
  • Konzipiert, um auch ohne technisches Vorwissen lesbar zu sein.

Inhaltsverzeichnis

Kapitel 0: Die Anatomie einer Post-Mortem-Analyse

Kapitel 1: Digitale Fundamente des Scheiterns

Bevor Brücken einstürzen oder Fabriken explodieren, beginnt das Scheitern im Code.
Dieses Kapitel betrachtet die reinste Form moderner Zusammenbrüche: Logik, Mathematik, Zeit und Skalierung, die sich leise gegen ihre Schöpfer wenden. Bugs, kaputte Uhren und exponentielles Wachstum zeigen, wie digitale Systeme genau so scheitern, wie man es ihnen beigebracht hat — ohne Rücksicht darauf, was Menschen eigentlich gemeint haben.

  • Wenn Zahlen lügen
  • Die Zeit ist kaputt
  • Das Gedächtnisproblem: Zu viel Müll, zu wenig Platz
  • Das Rennen, das niemand gewinnt
  • Skalierung und exponentielle Schmerzen

Kapitel 2: Das Internet ist ein Kartenhaus

Wenn Computer schon alleine scheitern können, scheitern sie gemeinsam noch viel kreativer.
Dieses Kapitel betrachtet die fragile Choreografie, die Maschinen zur Kommunikation befähigt: Routing, Namensauflösung, Vertrauen und Lastverteilung. Protokolle versprechen Ordnung, aber kleine Missverständnisse kaskadieren schnell zu globalen Ausfällen. Das Internet funktioniert größtenteils dank Optimismus, Panzertape und der Annahme aller Beteiligten, dass jemand anderes die Kontrolle hat — bis es das ganz öffentlich nicht mehr tut.

  • BGP – Wie das Internet sich selbst findet
  • DNS – Wie Namen Zahlen ersetzen
  • SSL/TLS – Wie das Internet lernte, sich selbst zu vertrauen
  • Wie wir lernten, die Last zu teilen
  • Wenn die Cloud regnet

Kapitel 3: Wenn Daten zurückschlagen – Warum Speicherausfälle am meisten schmerzen

Rechenleistung lässt sich neu starten. Netzwerke können es erneut versuchen. Daten wachsen nicht nach.
Dieses Kapitel konzentriert sich auf das Scheitern des digitalen Gedächtnisses: Korruption, Löschung, stillen Verfall und die beruhigende Illusion, dass ein Backup existiert. Speicherausfälle explodieren selten — sie löschen. Leise, endgültig, und meist ohne die Höflichkeit eines klaren Fehlermoments.

  • Daten – Tod durch natürliche Ursachen
  • Die Rache des Buchhalters
  • Datenbank-Patzer
  • Verloren bei der Migration
  • Schrödingers Backup – Da und nicht da, bis man es braucht

Kapitel 4: Die Illusion der Sicherheit – Wenn die Cloud zurückbeißt

Dieses Kapitel betrachtet Fehlschläge, die wir uns selbst einbrocken: übertriebenes Vertrauen in Cloud-Plattformen, missverstandene Verantwortung und die Verwechslung von Komfort mit Sicherheit. Falsch konfigurierter Speicher, außer Kontrolle geratene Kosten und Sicherheitswerkzeuge, die sich gegen ihre eigenen Besitzer wenden, zeigen, wie leicht Automatisierung und Abstraktion ein falsches Gefühl von Kontrolle erzeugen — bis die Rechnung kommt, die Daten durchsickern, oder die Schutzmaßnahmen zur Bedrohung werden.

  • Wenn Speicher zu Werbetafeln werden
  • Wenn »Skalierung« die Rechnung skaliert
  • Wenn Sicherheitswerkzeuge zur Bedrohung werden

Kapitel 5: Die Illusion der Widerstandsfähigkeit – Katastrophenschutz und andere optimistische Pläne

Dieses Kapitel untersucht, was passiert, wenn Systeme trotz Vorbereitung versagen. Redundanz, Failover und Wiederherstellungspläne versprechen Sicherheit — brechen aber oft im perfekten Gleichklang mit dem Hauptsystem zusammen. Diese Abschnitte beleuchten Resilienz-Theater, übertriebenes Vertrauen in ungetestete Schutzmaßnahmen, und den Moment, in dem das Scheitern die digitale Welt verlässt und die Einsätze von Downtime zu realen Konsequenzen erhöht.

  • Redundanz ist nicht Resilienz
  • Resilienz-Theater – Sicherheit üben, während alles brennt
  • Wenn Ausfälle tödlich werden

    Hinweis:
    Dieser Abschnitt untersucht Fehlschläge jenseits von Software und Infrastruktur — Katastrophen, deren Konsequenzen in Menschenleben gemessen werden. Der übliche Ton weicht hier aus Respekt vor den beschriebenen Ereignissen einer zurückhaltenden, sachlichen Darstellung.

Materialien zu Band 1

Lohnt sich die Lektüre?

Verdict: GET IT
Korga fasst die berühmten, berüchtigten und vergessenen Ereignisse zusammen, die zu Datenlecks und Verlusten in Milliardenhöhe geführt haben (...) Eine geistreiche Chronik spektakulärer Fehlschläge.
Mit hintersinnigem Witz und geballtem Wissen hilft Adam Korga seinen Leser:innen, sich lachend durch die Zusammenbrüche der digitalen Welt zu arbeiten.
Independent Book Review
Volltext lesen (auf Englisch)

"Ich kann dieses Buch jedem empfehlen, der sich dafür interessiert, warum Dinge manchmal scheitern. Es zwingt uns zum Nachdenken und zeigt, was wir tun sollten, um dieselben Fehler zu vermeiden, die andere schon gemacht haben. Ich kann die weiteren Bände kaum erwarten!"

Senior Data Engineervia Goodreads

"Indem es sich auf versteckte Systeme konzentriert — etwa wie Zeit erfasst wird oder wie die Cloud eigentlich funktioniert — nutzt es reale Vorfälle, um komplexe technische Fehlschläge in Alltagssprache zu erklären. Man muss kein Computerexperte sein, um es zu genießen, denn das Buch verzichtet auf Heldengeschichten und zeigt die einfache Wahrheit: Große Ausfälle passieren meist wegen kleiner, ganz normaler menschlicher Annahmen."

Senior Devevelopervia Goodreads

"Dieses Buch finde ich sehr interessant, weil es aufschlüsselt, wie Dinge in großen Systemen schiefgehen und was wir aus diesen vergangenen Fehlschlägen lernen können. Es vereinfacht die Ereignisse zudem ausreichend, ohne den Inhalt zu verlieren, sodass auch Leser:innen ohne viel technisches Wissen die Ereignisse verstehen können, die zu den Fehlschlägen führten."

Platform Engineervia Goodreads

Heute mit dem Lesen beginnen

Wähle dein bevorzugtes Format. Alle digitalen Versionen sind DRM-frei.

Rückgabe- und Erstattungsbedingungen richten sich nach den Regelungen des Verlags.