Risorse · 18

Rendere le integrazioni API resilienti alle interruzioni.

Mappare le dipendenze, i tentativi vincolati e mantenere i percorsi essenziali utilizzabili durante i guasti esterni.

Aggiornato · 2 min

Rack di server in un centro dati Illustrazione · scena fittizia

Obiettivi di questa guida

  • Collegare le API ai percorsi aziendali
  • Gestire chiamate e tentativi di ripristino
  • Pianificare il funzionamento in condizioni di degrado
  • Misurare il ripristino

Verifica rapida

  • Quali percorsi dipendono da ciascun fornitore?
  • Ogni chiamata ha un timeout?
  • Un tentativo di ripristino potrebbe duplicare un'operazione?
  • Cosa vede l'utente in caso di errore?
  • Chi approva il ripristino del servizio normale?

Metodo passo passo

  1. 1

    Mappare le chiamate

    Collegare ogni integrazione ai dati scambiati, ai contratti, ai responsabili e alle fasi del percorso. Identificare le chiamate sincrone che bloccano l'utente.

    Risultato: mappa delle dipendenze prioritaria.

  2. 2

    Impostare i budget di tempo

    Definire un timeout per ogni chiamata e un budget totale per percorso. Impedire che le catene di servizi moltiplichino i tempi di attesa.

    Risultato: matrice di timeout e soglie.

  3. 3

    Tentativi limitati

    Riprova solo le operazioni che possono essere ripetute in sicurezza. Verifica l'idempotenza, limita i tentativi e distribuiscili con un backoff adeguato.

    Risultato: policy di ritentativi testata.

  4. 4

    Pianificare il funzionamento in condizioni di degrado

    Decidi cosa rimane utilizzabile, quali dati possono essere accodati e quale messaggio chiaro viene visualizzato durante un'interruzione.

    Risultato: comportamento di fallback per ogni percorso.

  5. 5

    Simulazione di incidenti

    Introduci latenza, risposte non valide e interruzioni in un ambiente controllato. Verifica carico, dati, interfaccia e ripristino.

    Risultato: risultati dei test di errore.

  6. 6

    Monitoraggio dei risultati

    Monitora errori, latenza, code e azioni aziendali effettivamente perse. Assegna i responsabili per l'escalation e il coordinamento con i fornitori.

    Risultato: dashboard e procedura di ripristino.

Indicatori di gestione

IndicatoreCosa misuraPrima azione
Percorsi mappatiPercorsi essenziali con dipendenze noteAssegnazione di proprietari a chiamate sconosciute
Budget temporaleChiamate entro la scadenza del percorsoRevisione delle attese concatenate
Tentativi sicuriOperazioni ripetute senza effetti collateraliAggiunta di idempotenza o rimozione dei tentativi
Degradazione testataScenari di interruzione con risultato utente osservatoMiglioramento della continuità e della comunicazione

Errori comuni

  • Tentativi illimitati in caso di servizio sovraccarico
  • Ripetizione di una scrittura non idempotente
  • Nascondere un'interruzione dietro dati obsoleti non etichettati
  • Misurazione del solo tasso di risposta del provider

Domande frequenti

Ogni richiesta deve essere ritentata?

No. I tentativi aiutano a gestire guasti transitori selezionati e devono rispettare la scadenza generale, l'idempotenza e il carico del provider.

Un interruttore automatico è sufficiente?

Protegge alcune chiamate, ma non definisce l'esperienza utente né il ripristino del lavoro in coda.

Cosa misurare per primo?

Effetti sui percorsi essenziali: durata, azioni perse o ritardate e qualità del ripristino.

Riferimenti ufficiali

I riferimenti supportano il metodo. Adattare i controlli al proprio contesto; non costituiscono una certificazione. I titoli dei riferimenti originali e i documenti di origine potrebbero essere in un'altra lingua.