[轉]NMON伺服器監控、指標說明

來源:互聯網
上載者:User

標籤:

一、NMON中的各項參數指標:

SYS_SUMM:顯示當前伺服器的總體效能情況

Total System I/OStatistics:
Avg tps during an interval:顯示採集間隔內磁碟平均I/O次數,該值等於Sheet DISK_SUMM中IO/sec列的平均值。
 Max tps during an interval:顯示採集間隔內磁碟最大I/O次數,該值等於Sheet DISK_SUMM中IO/sec列的最大值。
 Max tps interval time:顯示磁碟最大I/O所在時間點。
Total number of Mbytes read:顯示採集間隔內磁碟讀的總MB數,可能是nmon的bug,該值並不準確,並且使用LVM劃分的虛擬磁碟可能會存在重複統計。
Total number of Mbytes written:顯示採集間隔內磁碟寫的總MB數,該值並不準確,理由同上。
Read/Write Ratio:顯示Total number of Mbytes read/ Total number of Mbytes written的值。 即時讀寫比率
IO/sec:僅顯示磁碟IO/sec的圖,不包括Network的I/O。   每秒鐘輸出到物理磁碟的傳輸次數

如:

CPU:
Users%:顯示採集間隔內所有CPU在User Mode下的Time佔比(Avg、Max)。
Sys%:顯示採集間隔內所有CPU在System Mode下的Time佔比(Avg、Max)。
Wait%:顯示採集間隔內所有CPU處於空閑且等待I/O完成的時間比例(Wait%是CPU空閑狀態的一種,當CPU處於空閑狀態而又有進程處於D狀態(不可中斷睡眠)時,系統會統計這時的時間,並計算到Wait%裡),Wait%不是一個時間值,而是時間的比例,因此在同樣I/O Wait時間下,伺服器CPU越多,Wait%越低,它體現了I/O操作與計算操作之間的比例。對I/O密集型的應用來說一般Wait%較高,且Sheet PROC中Blocked也較高,這時需關注是什麼導致了過多的進程等待。
 Idle%:顯示採集間隔內所有CPU處於空閑Time的佔比(Avg、Max)。
CPU%:顯示採集間隔內所有CPU的user%+system%。
2.        AAA
顯示當前伺服器基本資料,如作業系統版本,當前LPAR名,採集時間和次數等如


3.        StrayLines
顯示本次nmon分析檔案中未產生的採集值。
4.        BBBP
由於本Sheet內容較多,見(部分):

(一)
如,顯示當前伺服器的基礎資源資訊,當前伺服器作業系統是cent os版本。


MemTotal:顯示當前伺服器實體記憶體大小,本伺服器有8063180 KB≈7874 MB左右。
MemFree:顯示當前伺服器的空閑記憶體大小,本伺服器有5052336 KB≈4934 MB左右。
Buffers:顯示當前伺服器Buffer(在記憶體中要寫到磁碟上的)緩衝的大小,本伺服器有459108 KB≈448 MB左右,注意,這裡的數值僅是採集初期的靜態值,具體Buffer的變化還需要看Sheet MEM。
 Cached:顯示當前伺服器Cache緩衝的大小(從磁碟讀取到記憶體的),本伺服器有1032572 KB≈1008 MB左右。,這裡的數值僅是採集初期的靜態值,具體Buffer的變化還需要看Sheet MEM。

SwapCached:顯示當前伺服器Swap空間已緩衝的大小,本伺服器尚未使用到Swap空間。
SwapTotal:顯示當前伺服器Swap空間大小,本伺服器有8385532 KB≈8189 MB左右。
SwapFree:顯示當前伺服器Swap空閑空間大小,本伺服器Swap空間都空閑。

由於執行nmon時所屬系統組許可權不同,因此BBBP裡磁碟的資訊可能會缺失,如一是root許可權執行nmon組建檔案後顯示的磁碟資訊,可以看到每個磁碟的大小及磁碟下的分區用途。 
5.        CPU_ALL
顯示當前伺服器所有CPU在採集時間段內的利用率,按時間及User%、System%、Wait%顯示。

當前伺服器共有4顆CPU(Core)8核心。
一般情況下CPU利用率裡User%應佔70%左右,Sys%應佔30%左右,如果Sys%或Wait%佔比等於或超過了User%則應該關注是什麼引起了過多的系統消耗,可能是大量的Disk或Network I/O。
如,這個項目隨著並發的增加,應用進程對CPU的消耗都增加在Wait%上,經排查是由於NFS讀寫遇到瓶頸導致:


6.        CPU_SUMM
顯示當前伺服器所有CPU的利用率,當前伺服器共有4個CPU(Core),每個CPU負載有所不同。

7.        DISK_SUMM
按採集時間顯示所有磁碟和分區的Read/Write的速率(KB/s)和所有磁碟和分區的I/O率。某一採集時間點的IO/sec等於Sheet DISKXFER中該時間點上所有磁碟和分區的IO/sec之和。因此,這一時間點上的I/O值是重複的!另外,本Sheet中的I/O不包括NFS裡的I/O。





如的WAvg按nmon Guide中的說法是為了去掉採集值中的零值以便貼近真實平均值,但WAvg的公式(對計算資料行中所有值取平方後加合,再除以列中所有值之和)卻不是單純的去掉零值,這裡可以理解為WAvg比Avg更貼近資源消耗的均值,因此以後所有資源Sheet中都推薦關注WAvg。
IBM Redpaper《Linux Performance and Tuning Guidelines》中介紹Linux的I/O子系統架構如下:

nmon(包括iostat)對系統I/O的指標截取大部分來自/proc/diskstats,而這些值來自block layer層,LVM裡的Logical Volume會“visible as a standard block device”,因此真實的磁碟,LVM的邏輯卷,分區等在這裡都會顯示,在nmon計算總值時會被重複統計。
Disk Read/Write KB是同一採集時間點下Sheet DISKREAD、DISKWRITE裡該行(所有磁碟和分區)數值之和,必然包括了重複值,例如某一時刻sda磁碟共write 1000 KB,其中sda1分區write 700 KB,sda3分區write 300 KB,這一時刻Disk Write應是1000 KB,但這裡卻會重複統計分區數值,導致顯示為Disk Write 2000 KB。Disk I/O也存在同樣的問題!
還需注意一點,部分nmon組建檔案裡圖中標題指標為kb(小寫)/s,但實際統計的卻是KB(大寫)/s。

 

 

http://blog.csdn.net/he_jian1/article/details/41039709/

[轉]NMON伺服器監控、指標說明

聯繫我們

該頁面正文內容均來源於網絡整理,並不代表阿里雲官方的觀點,該頁面所提到的產品和服務也與阿里云無關,如果該頁面內容對您造成了困擾,歡迎寫郵件給我們,收到郵件我們將在5個工作日內處理。

如果您發現本社區中有涉嫌抄襲的內容,歡迎發送郵件至: info-contact@alibabacloud.com 進行舉報並提供相關證據,工作人員會在 5 個工作天內聯絡您,一經查實,本站將立刻刪除涉嫌侵權內容。

A Free Trial That Lets You Build Big!

Start building with 50+ products and up to 12 months usage for Elastic Compute Service

  • Sales Support

    1 on 1 presale consultation

  • After-Sales Support

    24/7 Technical Support 6 Free Tickets per Quarter Faster Response

  • Alibaba Cloud offers highly flexible support services tailored to meet your exact needs.