Gigabyte MJ11-EC1 NAS Server

@Burnz84 Hab ich das richtig verstanden, du nutzt die beiden ON-BOARD Netzwerkports?
 
Wenn Du diese Anzeige nicht sehen willst, registriere Dich und/oder logge Dich ein.
Kleines wiederkehrendes Problem. Ich habe auf der Kiste OMV laufen mit paar Docker und ansonsten dient er fürs Streaming. Das System läuft stabil und macht was es soll. Nach einer gewissen Zeit ist die Kiste aber nicht mehr per Webinterface, Ping oder SSH zu erreichen. Der BMC ist erreichbar. Es läuft alles über die gleiche LAN-Buchse. Also Netzwerk+BMC. Mein Workaround: Ich logge mich auf dem BMC ein, starte die Kiste neu und alles läuft wieder x Tage oder Wochen. Ich bin mir jetzt nicht sicher ob es das Problem auf den 61 Seiten schon mal gab. Vielleicht hat ja aber jemand eine Idee/Lösung.

BG

Burnz
Hatte das gleiche Problem und hab nach langer langer debug Zeit einen Hardware defekt festgestellt. Der Controller auf dem Board hat irgendeinen Knacks gehabt. Hab das Board damit wunderschön umtauschen müssen.
 
Bei mir ist ein Netzwerk Port kaputt

Ich bin derzeit am Handy, wenn ich zuhause bin kann ich mal in meine Notizen gucken und die einzelne prüf Befehle hier posten.

auf jedenfall die energie Einstellungen des onboard Controllers deaktivieren, den TX Verkehr überprüfen auf errors und ob sich der Nic aufgehängt hat.

Lösung: Netzwerkkarte I350 bestellt und fertig
 
Ihr dürft die Onboards Ports nicht verwenden, auch wenn sie nach Energieeinstellung zu funktionieren scheinen. Die sind von Werk aus kaputt.
 
@Burnz84 Hab ich das richtig verstanden, du nutzt die beiden ON-BOARD Netzwerkports?
Ja. Das mach ich. Alleine schon wegen Verbrauch. Wenn ich noch Karte einstecke, bin ich bei über 30W denke ich. Das wollte ich eigentlich vermeiden.
 
Falls es um die AER Fehler geht: Auf meinen beiden Boards und Proxmox VE 9 / Kernel 7.0.14-11-pve traten permanent Correctable PCIe-AER-Fehler am PCIe-Pfad eines Intel I210 auf:
PCIe Bus Error: severity=Correctable, type=Data Link Layer
[ 7] BadDLLP
[ 6] BadTLP

Dann mit den bekannten Kernel Parametern getestet:
iommu=pt -> AER-Fehler, IOMMU-Gruppen OK
iommu=pt pcie_port_pm=off -> AER-Fehler, IOMMU-Gruppen OK
iommu=pt pci=nommconf -> keine AER-Fehler, IOMMU-Gruppen schlecht
iommu=pt pcie_aspm=off -> keine AER-Fehler, IOMMU-Gruppen OK

mit GRUB_CMDLINE_LINUX_DEFAULT="quiet iommu=pt pcie_aspm=off" keine AER Fehler mehr. die NICS laufen ohne Probleme.

dmesg -T | grep -Ei 'AER|PCIe Bus Error|BadDLLP|BadTLP' zeigt nix mehr an.

Dass LnkCtl bereits ASPM Disabled anzeigt, bedeutet offenbar nicht, dass pcie_aspm=off wirkungslos sein muss. Der Parameter beeinflusst auch, wie Linux während der PCIe-Initialisierung mit ASPM umgeht. In meinem Fall war der Unterschied reproduzierbar.
 
Also ich hatte gleich am Anfang in TrueNAS ASPM komplett abgeschaltet (nicht nur die Meldung deaktiviert, wie oft empfohlen wurde) und nie Probleme gehabt.

Nutze zwar für das meiste SFP28, aber Web Interface und tablet / notebook greifen über die internen lans zu und ich hatten nie Probleme.
 
@Paddy600 Hab zwei der Boards getestet, ASPM off hat bei mir nicht geholfen. Daher gehe ich davon aus, dass die onboard NICs kaputt sind. Die BMC wohl ausgeschlossen. Man muss natürlich auch erst Traffic generieren bevor man die Kernel-Fehler aufgepoppt bekommt. Irgendwann ist die Maschine komplett offline.
 
Hardwareluxx setzt keine externen Werbe- und Tracking-Cookies ein. Auf unserer Webseite finden Sie nur noch Cookies nach berechtigtem Interesse (Art. 6 Abs. 1 Satz 1 lit. f DSGVO) oder eigene funktionelle Cookies. Durch die Nutzung unserer Webseite erklären Sie sich damit einverstanden, dass wir diese Cookies setzen. Mehr Informationen und Möglichkeiten zur Einstellung unserer Cookies finden Sie in unserer Datenschutzerklärung.


Zurück
Oben Unten refresh