Autor: Phillipp (Seite 13 von 20)

Hardware-Fehler auf Webspace-System

Wir haben in den letzten Tagen wie bereits berichtet einige Fehler und Abstürze des neuen Webspace-Servers festgestellt.

Mittlerweile haben wir den Fehler weiter eingrenzen können: in dem Server stecken 16 Module mit je 8 Gigabyte RAM. Davon ist mindestens eins defekt und muss ausgetauscht werden.

Wird der defekte RAM vom System verwendet, stürzt das System einfach ab und startet neu. Auch die automatische Fehlerkorrektur (dieser teure Server-RAM hat so was) ist gegen das Problem machtlos („uncorrectable DRAM ECC error“). Glück im Unglück: das Problem ist zumindest auf den RAM auf einer Gruppe von 8 Bänken beschränkt, es muss also nur die Hälfte des RAMs getestet und getauscht werden.

Aktuell läuft das System, stürzt aber unregelmäßig ab. Zwischenzeitlich haben wir nur wenig Einflussmöglichkeiten auf die Abstürze und können nur schnellstmöglich alle Systeme wieder starten. Gleichzeitig werden wir eine Lösung finden, um schnell den defekten RAM zu tauschen.

Test von Verbesserungen

Um die Webspaces weiter zu verbessern haben wir heute eine Optimierung an den Systemen vorgenommen:

Bisher wurden Zugriffe von einem DSL-Anschluss alle dem selben Server zugeordnet, welcher dann über Netzwerk die erforderlichen Dateien zur Abarbeitung des Zugriffs geholt und verarbeitet hat. Dabei konnte es passieren, dass die Anfragen mehrerer Surfer, welche alle komplexe Webseiten angefordert haben, auf einem einzigen Server ausgeführt wurden – obwohl die anderen Server vollkommen unausgelastet waren.

Dies war erforderlich, da ansonsten die Sitzungsdaten, die so genannte Session, auf einem anderen Server nicht verfügbar gewesen ist. So wäre bei dem Wechsel eines Servers –  den der Benutzer nicht bemerkt, da er die selbe Webseite aufruft – auch z.B. ein Warenkob im Online-Shop verloren gegangen.

Wir speichern diese Daten nun nicht mehr direkt auf dem Server, der den Zugriff bearbeitet, sondern auf einem zentralen Server, der alle Sitzungen verwaltet und entsprechend dimensioniert ist. Daher können die Zugriffe nun wesentlich flexibler auf die unbelasteten Server verteilt werde. Wir versprechen uns dadurch eine verbesserte Auslastung der Kapazitäten, was sich besonders in Stoßzeiten auswirken dürfte und kleine Ausfälle oder kurrzzeitig langsamere Webseiten abfedert.

Sollten wider Erwarten Probleme auftreten: bitte melden!

Ausfall vom 12.10.2011 (Morgens)

Heute morgen ist einer unserer Virtualisierungs-Hosts aus bisher unbekannten Gründen abgestürzt. Nach einem Neustart war der Server wieder betriebsbereit, alle Services wurden dann im Laufe des Vormittags und des frühen Nachmittags geprüft und wieder aktiviert.

Wir entschuldigen uns für die Unannehmlichkeiten. Leider können wir die Fehlerursache momentan nicht weiter eingrenzen, behalten die Sache aber im Auge.

kvm-Monitor

Was für hier mitlesende KVM-User intressant sein könnte:

Wenn mit -monitor ein Monitor eingestellt wird, kann man auf diesem mit „netcat“ arbeiten:

nc -U /path/to/monitor

mit „help“ bekommt man dann auch eine Liste von möglichen Kommandos.

Verlängerung von Wartungsarbeiten

Heute gegen 11:00 haben wir Wartungsarbeiten an den Servern durchgeführt. Für den Einbau von zusätzlichen 24 GB RAM sollten die Server für einige Minuten heruntergefahren werden. Nach dem Hochfahren der Server war die Datenbank aufgrund eines MySQL-Crashs nicht mehr aktuell. Das Backup (nur wenige Minuten alt) wird gerade eingespielt, dabei wird noch eine kleine Änderung vorgenommen. In Kürze wird die Community wieder normal verfügbar sein.

Die Webspace sind davon nicht betroffen, jedoch wird für einige Postfächer zur Zeit keine Mail zugestellt, versendet und der Zugriff auf die Mailboxen ist nicht möglich. Diese Einschränkungen werden in wenigen Minuten auch aufgehoben sein.

Sicherheitsvorfall am 1.2.2010

Leider gelang es einem Angreifer am Montag, 1. Februar 2010 ab 15:30, einen Teilzugriff auf die Webspaces zu erlangen. Der Angreifer hatte Zugriff auf einige Webspaces und hat begonnen, Dateien welche mit „index“ oder „main“ beginnen, zu überschrieben.

Die überschriebenen Dateien sind von uns durch leere Dateien ersetzt worden.
Wir konnten den Angriff frühzeitig stoppen, sodass nur einige Webspaces betroffenen sind und nicht alle.
Falls du zu den betroffenen Benutzern gehörst, lade bitte deine Originaldateien wieder auf den Webspace hoch und deine Seite läuft wieder.

Ob du betroffen bist, kannst du einfach feststellen, indem du alle Dateien auf deinem Webspace kontrollierst, die mit „index“ oder „main“ im Dateiname beginnen.

Die Sicherheitslücke lag in einer Serversoftware, die nicht auf dem neuestem Stand war. Nicht nur wir, sondern auch andere Anbieter erleben in diesen Tagen solche Angriffe.

Wir bedauern dies sehr und haben zugleich die Lücke geschlossen.

Aus dem Fehler habe wir gelernt und einige neue Sicherheitsvorkehrungen eingeführt.
Solltest du noch Fragen haben, wende dich doch per Support-Ticket oder bei allgemeinen Fragen über unser Forum an uns.

Optimierungen der Webspaces

In den letzten Tagen haben wir nochmals einige Optimierungen vorgenommen, um mehr gleichzeitige Verbindungen verarbeiten zu können. Der Server erlaubt nun ein Maximum von 30 gleichzeitigen Verbindungen pro (Sub-)Domain, damit nicht ein Benutzer alle verfügbaren Verbindungen blockieren kann. Insgesamt werden nun maximal ca. 4.000 gleichzeitige Verbindungen möglich sein, darüber gibt der Server eine neutrale Überlastungsmeldung zurück. Gerade in den Abendstunden lag in den letzten Tagen die Zahl der Verbindungsversuche über der maximal möglichen, so dass die Ladezeiten etwas länger geworden sind.

Dieses Verhalten sollte nun wesentlich verbessert sein. Ein kleiner Kommentar, ob sich fühlbar etwas getan hat, wäre nett.

Sind 30 gleichzeitige Verbindungen nicht zu wenig?

Eine sehr gut besuchtes Forum hat im Durchschnitt etwa 5-10 gleichzeitige Verbindungen, also 5-10 reine Anfragen vom Besucher an den Server pro Sekunde.

Kann man seine eigene Fehlermeldung anzeigen lassen?

Das ist nicht möglich. Sollten zu viele Anfragen geschickt werden, was in der Regel nicht einem normalen Besucherverhalten entspricht, wird von lima-city eine neutrale Überlastungsmeldung angezeigt. Dies passiert, bevor überhaupt die Anfrage deinen Webspace erreicht. Somit kann der Webspace entlastet werden. Von dieser Maßnahme profitieren alle: Die Webspaces werden ein Stückchen schneller.

Heutiger DNS-Ausfall

Heute ist uns das gesamte DNS-Netz weggebrochen, nachdem die zentrale Datenbank für die DNS-Records (Einträge) nicht erreichbar war. Dabei ist mir dann aufgefallen, dass die Synchronisation der DNS-Server untereinander fehlerhaft ist. Da muss noch einmal etwas Neues konzipiert werden… Über den Zeitraum von ca. 10:30 bis 14:00 waren Namensauflösungen fast unmöglich, somit war praktisch kein Dienst erreichbar. Ich entschuldige mich an dieser Stelle für die entstandenen Unannehmlichkeiten.

« Ältere Beiträge Neuere Beiträge »

© 2026 lima-city Blog

Theme von Anders NorénHoch ↑