|
Size: 2424
Comment:
|
Size: 1906
Comment:
|
| Deletions are marked like this. | Additions are marked like this. |
| Line 4: | Line 4: |
| ~-[[[Was ist die FB3-Statusseite]]]-~<<BR>> ~-[[[Hinweise zur Benutzung für die Techniker]]]-~ | ~-[[Was ist die FB3-Statusseite]]-~<<BR>> ~-[[Hinweise zur Benutzung für die Techniker]]-~ |
| Line 11: | Line 11: |
| smtp-fb3 (der interne Submission-Server fuer Mail) nimmt keine Mail an. Des weiteren arbeiten mailhost und maildrop seit dem Reboot (s. "geplante Arbeiten") offenbar nicht richtig zusammen, so dass einkommende Mail zwar angenommen, aber nicht per POP3/IMAP verfuegbar gemacht wird.<<BR>> CarstenBormann, 2010-04-12 19:55 (Ausfall offenbar seit ~ 19:15) |
|
| Line 16: | Line 12: |
| Der Mailserver konnte wieder in Gang gesetzt werden. <<BR>> Ursache war vordergründig ein übergelaufenes Swap-Filesystem.<<BR>> Was dahinter steckt, werden wir hoffentlich morgen erfahren.<<BR>> JoergBrandt, 05.04.2010 16:30 |
Die Ausfälle der verschiedenen Dienste am 20.04. waren auf ein Netzwerkproblem zurückzuführen.<<BR>> Der zentrale FB3-Router lief aus unbekanntem Grund auf 99% Last. Nach dessen Reboot waren alle Dienste wieder verfügbar.<<BR>> |
| Line 22: | Line 16: |
| Aus den Logs läßt sich rekonstruieren, daß es ein Problem mit dem NFS-Mount eines Filesystems auf maildrop gab, was die lokale Mailauslieferung blockiert und letztlich das gesamte System zum Überlauf gebracht hat.<<BR>> Gleichzeitig aufgetretene Schwierigkeiten mit den IPV6-Hostadressen (Ursache unbekannt) können, müssen damit aber nicht in Zusammenhang stehen.<<BR>> JoergBrandt, 06.04.2010 |
Die Ursache konnte reproduzierbar auf eine defekte PC-Netzwerkkarte zurückgeführt werden.<<BR>> Kleine Ursache, große Wirkung!<<BR>> JoergBrandt, 21.04.2010 17:30 |
| Line 26: | Line 21: |
| Reboot der zentralen Server<<BR>> Die vom heutigen "Patch Day" übriggebliebenen zentalen Server mailhost und osiris werden morgen rebootet.<<BR>> JoergBrandt, 12.04.2010 19:35 |
Am Mittwoch den 21.04. werden ab 18:00 Uhr nach und nach die Cisco-Komponenten im MZH rebootet, um die zuvor eingespielten Software-Updates zu aktivieren.<<BR>> Dadurch wird es zeitweilig zu Netzausfaellen kommen.<<BR>> ChristianManal, 15.04.2010 |
| Line 39: | Line 36: |
Was ist die FB3-Statusseite
Hinweise zur Benutzung für die Techniker
Ticketing-System der FB3-Technik
Aktuelle Ausfälle
Behobene Ausfälle
Die Ausfälle der verschiedenen Dienste am 20.04. waren auf ein Netzwerkproblem zurückzuführen.
Der zentrale FB3-Router lief aus unbekanntem Grund auf 99% Last. Nach dessen Reboot waren alle Dienste wieder verfügbar.
Nachtrag:
Die Ursache konnte reproduzierbar auf eine defekte PC-Netzwerkkarte zurückgeführt werden.
Kleine Ursache, große Wirkung!
JoergBrandt, 21.04.2010 17:30
Geplante Arbeiten
Am Mittwoch den 21.04. werden ab 18:00 Uhr nach und nach die Cisco-Komponenten im MZH rebootet, um die zuvor eingespielten Software-Updates zu aktivieren.
Dadurch wird es zeitweilig zu Netzausfaellen kommen.
ChristianManal, 15.04.2010
Abgeschlossene Arbeiten
Wo dies möglich ist, wurde auf den zentralen Servern des FB3 der Zugang für normale Nutzer weitgehend eingeschränkt, um die dort laufenden Dienste zu schützen.
Davon ausgenommen ist die Solaris-Zone "login".
Bis auf weiteres stehen auch die leistungsfähigen Server "amun" und "aton" noch zur Verfügung.
Welche Rechner allgemein zugänglich sind, ist über das login-Flag ("Normal users can login") der Hostdatenbank dokumentiert.
JoergBrandt, 12.03.2010
Geplante Arbeiten in den Arbeitsgruppen
Status der Systeme
Statusübersicht über die wichtigsten Dienste
Status der LDAP-Server