By submitting, you consent to our use of your data. Privacy Policy.
Kategorie
Geschäftsführung
Erstellt von
Beam.ai
Starten Sie eine Fly.io-Maschine sofort in ihrer Region neu, sobald ein Health Check fehlschlägt, und eskalieren Sie wiederholte Fehler an den Bereitschaftsdienst.
Maschinen-Integritätsprüfungen
Fly.io meldet, ob eine laufende Maschine ihre konfigurierte Integritätsprüfung (Health Check) besteht. Ein Beam AI Agent liest diesen Status kontinuierlich aus, wendet die Kontoregel an, ab wie vielen fehlgeschlagenen Prüfungen ein tatsächlicher Ausfall vorliegt, und startet die betroffene Maschine neu oder benachrichtigt den Bereitschaftsdienst, sobald der Schwellenwert überschritten wird. Dies fängt eine blockierte Maschine ab, bevor sie einen größeren Ausfall verursacht, den ein Kunde bemerkt. Maschinen, die sich nach einem Neustart nicht erholen oder die nach einem Muster ausfallen, das nicht durch die Regel abgedeckt ist, werden zur direkten Diagnose an einen Entwickler weitergeleitet.
Multi-Regionen-Deployment
Fly.io betreibt die Maschinen einer App über Regionen hinweg, die ein Team im Hinblick auf Latenz oder Redundanz auswählt. Ein Beam AI Agent liest die Liste der freigegebenen Regionen des Kontos sowie die aktuelle Verteilung der Maschinen aus und stellt eine Maschine in einer Region bereit oder entfernt sie, um sie an diese Liste anzupassen, wann immer sich die Situation durch Nachfrage oder einen Ausfall ändert. Dadurch bleibt die Präsenz einer App an die Richtlinien angepasst, ohne dass ein Entwickler diese manuell anpassen muss. Anfragen zur Erstellung einer Region außerhalb der freigegebenen Liste oder unerwartete regionale Kostenspitzen werden zur Entscheidung an einen Entwickler weitergeleitet.
Richtlinien für automatische Neustarts
Fly.io kann eine Maschine basierend auf einer von einem Entwickler definierten Richtlinie automatisch neu starten, beispielsweise bei einem Absturz oder nach Zeitplan. Ein Beam AI Agent liest die genehmigte Neustart-Richtlinie des Kontos, wendet sie konsistent auf alle Maschinen einer App an und benachrichtigt das Team, wenn ein Neustart außerhalb der erwarteten Wartungszeiten erfolgt. Dadurch bleibt das Neustart-Verhalten vorhersagbar, anstatt es den unkontrollierten Absturzkreisläufen einer Maschine zu überlassen. Wiederholte Neustarts innerhalb eines kurzen Zeitfensters, die in der Regel auf ein tiefer liegendes Problem hindeuten, werden an einen Entwickler eskaliert, anstatt unendlich oft wiederholt zu werden.







