Ressourcen · 18

Machen Sie API-Integrationen ausfallsicher

Ordnen Sie Abhängigkeiten zu, beschränken Sie Wiederholungsversuche und halten Sie wichtige Fahrten bei externen Fehlern nutzbar.

Aktualisiert · 2 min

Serverracks in einem Rechenzentrum Illustration · fiktive Szene

Wozu dieser Leitfaden beiträgt

  • APIs mit Geschäftsreisen verbinden
  • Gebundene Anrufe und Wiederholungsversuche
  • Beeinträchtigten Betrieb planen
  • Erholung messen

Kurzcheck

  • Welche Fahrten hängen von den einzelnen Anbietern ab?
  • Hat jeder Anruf einen Timeout?
  • Könnte ein Wiederholungsversuch einen Vorgang duplizieren?
  • Was sieht der Benutzer im Fehlerfall?
  • Wer genehmigt die Rückkehr zum Normalbetrieb?

Schritt-für-Schritt-Anleitung

  1. 1

    Kartenaufrufe

    Verbinden Sie jede Integration mit ausgetauschten Daten, Verträgen, Eigentümern und Reiseschritten. Identifizieren Sie synchrone Aufrufe, die den Benutzer blockieren.

    Liefergegenstand: Priorisierte Abhängigkeitskarte.

  2. 2

    Zeitbudgets festlegen

    Definieren Sie ein Timeout für jeden Anruf und ein Gesamtbudget pro Fahrt. Verhindern Sie, dass Serviceketten die Wartezeiten vervielfachen.

    Lieferbar: Timeout- und Schwellenwertmatrix.

  3. 3

    Begrenzte Wiederholungsversuche

    Wiederholen Sie nur Vorgänge, die sicher wiederholt werden können. Testen Sie Idempotenz, begrenzen Sie Versuche und verteilen Sie sie mit geeignetem Backoff.

    Lieferbar: getestete Wiederholungsrichtlinie.

  4. 4

    Beeinträchtigten Betrieb planen

    Entscheiden Sie, was nutzbar bleibt, welche Daten in die Warteschlange gestellt werden dürfen und welche eindeutige Meldung bei einem Ausfall erscheint.

    Lieferbar: Fallback-Verhalten pro Fahrt.

  5. 5

    Vorfälle simulieren

    Führen Sie Latenz, ungültige Antworten und Ausfälle in einer kontrollierten Umgebung ein. Prüfen Sie Auslastung, Daten, Schnittstelle und Wiederherstellung.

    Lieferbar: Ergebnisse der Fehlerprüfung.

  6. 6

    Ergebnisse ansehen

    Verfolgen Sie Fehler, Latenz, Warteschlangen und tatsächlich verlorene Geschäftsaktionen. Weisen Sie Verantwortliche für Eskalation und Lieferantenkoordination zu.

    Lieferinhalt: Dashboard und Wiederherstellungsverfahren.

Managementindikatoren

IndikatorWas es misstErste Aktion
Kartierte FahrtenWesentliche Fahrten mit bekannten AbhängigkeitenBesitzer unbekannten Anrufen zuweisen
ZeitbudgetAnrufe innerhalb der ReisefristÜberprüfen Sie verkettete Wartezeiten
Sichere WiederholungsversucheWiederholte Operationen ohne NebenwirkungenIdempotenz hinzufügen oder Wiederholungsversuche entfernen
Getestete DegradationAusfallszenarien mit beobachtetem BenutzerergebnisKontinuität und Kommunikation verbessern

Häufige Fallstricke

  • Unbegrenzter Wiederholungsversuch gegen einen überlasteten Dienst
  • Wiederholen eines nicht idempotenten Schreibvorgangs
  • Verstecken eines Ausfalls hinter unbeschrifteten veralteten Daten
  • Nur die Rücklaufquote der Anbieter wird gemessen

Häufig gestellte Fragen

Sollte jede Anfrage erneut versucht werden?

Nein. Wiederholungsversuche helfen bei ausgewählten vorübergehenden Fehlern und müssen die Gesamtfrist, Idempotenz und Anbieterlast berücksichtigen.

Reicht ein Schutzschalter aus?

Es schützt einige Anrufe, definiert jedoch nicht die Benutzererfahrung oder die Wiederherstellung von Arbeiten in der Warteschlange.

Was sollte zuerst gemessen werden?

Auswirkungen auf wesentliche Fahrten: Dauer, verlorene oder verzögerte Aktionen und Wiederherstellungsqualität.

Offizielle Referenzen

Die Referenzen unterstützen die Methode. Passen Sie die Prüfungen an Ihren Kontext an; sie stellen keine Zertifizierung dar. Originalreferenztitel und Quelldokumente können in einer anderen Sprache verfasst sein.