使用理想的故障排除步驟修復 Linux 伺服器問題

如果它是 您自己的 Linux 伺服器 如果它沒有滿載運行或沒有按預期運行,則可能存在潛在問題,需要在伺服器受到嚴重影響之前盡快解決。

因此,請按照這五個簡單實用的步驟來排除 Linux 伺服器故障並最大限度地減少停機時間。

1.檢查硬件

讓我們來了解最基本的內容: 檢查硬體這表示您要去實際的電腦檢查是否有任何鬆動的電纜或是否發生斷電。

相反,輸入以下命令:

$ sudo ethtool eth0

如果你得到答案 نعم ,您就知道您的連接埠已連接到網路。

若要檢查伺服器的 BIOS/UEFI 輸出報告,請使用下列命令:

$ sudo dmidecode — type memory

如果響應看起來正常,那麼這也不是問題所在。如果您懷疑是記憶體問題,請執行以下命令:

$ sudo modprobe edac_core

如果執行上述命令後沒有結果,請輸入以下內容:

$ sudo grep “[0–9]” /sys/devices/system/etc/mc/mc*/csrow*/ch*_ce_count

它提供記憶體控制器行列表以及錯誤數量。結合記憶體通道、零件號碼和插槽的 dmidecode 數據,您可以快速且準確地找到故障記憶體晶片。

2. 確定確切的問題

假設你的伺服器宕機了,只有一個辦法可以解決。在開始使用工具之前,必須先確定問題所在。例如,如果使用者在使用伺服器應用程式時遇到問題,你需要確保問題不在客戶端。

其次,在問題調查過程中,您應該嘗試縮小問題根源的範圍。這可能是伺服器本身的問題,也可能是伺服器應用程式的問題。例如,伺服器運行正常,但伺服器應用程式可能會出現一些錯誤。

若要檢查應用程式是否運作順利,請輸入以下內容:

$ sudo ps -ef | grep apache2 $ sudo netstat -plunt | grep apache2

如果伺服器沒有回應,您可以使用以下命令啟動 Apache 伺服器:

$ sudo service apache2 start

簡而言之,在採取行動之前,先弄清楚問題到底是什麼。這將有助於縮小問題範圍,並幫助你找到相應的解決方案。

3. 使用 Top 公式

準備 置頂 這是 Linux 最理想的偵錯模式之一,它可以載入平均值、交換並列出使用系統資源的進程。

但初次使用時,你可能會感到困惑。以下是 Top 功能簡介。

第一行:

  • 時間
  • 電腦開機多久了?
  • 阿拉伯聯合大公國
  • 平均負載(過去 1 分鐘、過去 5 分鐘和過去 15 分鐘的系統載入時間)

第二行:

  • 任務總數
  • 目前任務數
  • 空閒狀態的任務數
  • 停止的任務數
  • 任務失敗次數

第 3 行:

  • 用戶的 CPU 使用率百分比
  • 系統 CPU 使用率百分比
  • 低優先權進程的 CPU 使用率百分比
  • 空閒行程的 CPU 使用率百分比
  • 等待輸入/輸出的 CPU 使用率百分比
  • 硬體中斷的 CPU 使用率百分比
  • 應用程式中斷的 CPU 使用率百分比
  • 按時間竊取百分比表示的 CPU 使用率
  • 系統總記憶體
  • 可用記憶體
  • 已用記憶體
  • 緩存

第 4 行:

  • 總可用掉期
  • 總免費掉期
  • 已使用的總交換空間
  • 可用記憶體

接下來是每個正在運行的應用程式的一行。這些應用程式包括:

  • 貨幣ID。
  • 用戶。
  • 偏愛。
  • 水平不錯。
  • 進程使用的虛擬記憶體。
  • 進程使用的駐留記憶體。
  • 可共享記憶體。
  • 進程使用的 CPU 百分比。
  • 進程使用的記憶體百分比。
  • 進程運行時間。
  • 命令。

要找出哪個進程消耗的記憶體最多,首先透過鍵入 M 對進程進行排序。

若要檢查哪些進程佔用了最多的 CPU 電量,請按 P。

若要過濾特定選項,請按 O,這將顯示以下命令:

新增過濾器 #1(忽略大小寫)為:[!]FLD?VAL

此外,您還可以根據特定流程進行過濾,例如:

指令=apache

這將過濾並僅顯示 Apache 進程。

4. 追蹤儲存空間

儘管可用的儲存容量是無限的,但伺服器空間可能會耗盡,從而導致許多問題。在這種情況下,使用命令 df (磁碟檔案系統)提取可用/已使用磁碟空間的完整摘要。

您可以透過以下三種方式使用它:

$ sudo df -h $ sudo df -i $ sudo df -hT

另一件有用的事情是使用 %實用程式 ,這有助於識別設備的壓力程度。任何超過 60% 的利用率都表示儲存效能不佳。任何接近 100% 的利用率都意味著驅動器已接近飽和。

5.檢查問題日誌

這些錄音給你提供了很多有用的信息 在/ var /日誌 ,服務的子目錄。對於那些不熟悉的人來說,Linux 伺服器日誌可能是這個星球上最可怕的地方。

情況不應該如此,尤其是考慮到日誌是根據其功能進行劃分的。一個日誌記錄系統/應用程式中發生的情況,而另一個日誌記錄系統/應用程式的錯誤訊息。考慮到其儲存的資訊量,日誌通常都是龐大的檔案。

日誌資料檔案是加密的,最好知道如何操作它們。

如果您不確定,請使用 dmesg的 ,顯示所有內核訊息。公式顯示 尾巴 預設為前 10 條訊息。

$ dmesg | 尾巴

合併命令時 尾巴 使用關鍵字 -f 它將繼續監視系統日誌檔案並在系統日誌中列印下一個事件。

$dmesg | tail -f /var/log/syslog

這將繼續掃描錄音並顯示潛在問題。

有效地排除 Linux 伺服器故障

Linux 伺服器故障排除乍看之下可能令人望而生畏,但為了掌握竅門,你需要了解一些事項。如果這五個步驟無法幫助你辨識和追蹤問題,或許值得尋求其他人的幫助。

不過,大多數情況下,上述某個故障排除步驟應該可以幫助您解決遇到的問題。檢查 如何保護Linux家庭伺服器.

轉到頂部按鈕