R語言中描述統計量的多種方法summary()、describe()、str()等_r語言

來源:互聯網
上載者:User

1. summary()函數可以擷取描述性統計量

可以提供最小值、最大值、四分位元和數值型變數的均值,以及因子向量和邏輯型向量的頻數統計

2. misc包中的describe()函數

可返回變數和觀測的數量、缺失值和唯一值的數目、平均值、分位元,以及五個最大的值和五個最小的值

3.psych包中的describe()函數

psych包也擁有一個名為describe()的函數,它可以計算非缺失值的數量、平均數、標準差、中位元、截尾均值、絕對中位差、最小值、最大值、範圍、偏度、峰度和平均值的標準誤

4.pastecs包中的stat.desc()的函數

可以計算種類繁多的描述性統計量。使用格式為:stat.desc(x,basic=TRUE,desc=TRUE,norm=FALSE,p=0.95)
其中的x是一個資料框或時間序列。若basic=TRUE(預設值),則計算其中所有值、空值、缺失值的數量,以及最小值、最大值、範圍,還有總和。若desc=TRUE(同樣也是預設值),則計算中位元、平均數、平均數的標準誤、平均數信賴度為95%的信賴區間、方差、標準差以及變異係數。最後,若norm=TRUE(不是預設的),則返回常態分佈統計量,包括偏度和峰度(以及它們的統計顯著程度)和Shapiro–Wilk正態檢驗結果

5.str()函數

以簡潔的方式顯示對象的資料結構及內容,可以查看資料框中每個變數的屬性

6. attributes()函數

可以提取對象除長度和模式以外的各種屬性


##以上是為整體的資料計算描述性統計量,下面關注各組的描述性統計資訊

7.aggregate()函數

僅允許在每次調用中使用平均數、標準差這樣的單傳回值函數,它無法一次返回若干個統計量

8.by()函數

格式為:by(data,INDICES,FUN),其中data是一個資料框或矩陣,INDICES是一個因子或因子組成的列表,定義了分組,FUN是任意函數。

9.doBy包中的summaryBy()函數

10.psych包中的describe.by()函數


#總結待補充


聯繫我們

該頁面正文內容均來源於網絡整理,並不代表阿里雲官方的觀點,該頁面所提到的產品和服務也與阿里云無關,如果該頁面內容對您造成了困擾,歡迎寫郵件給我們,收到郵件我們將在5個工作日內處理。

如果您發現本社區中有涉嫌抄襲的內容,歡迎發送郵件至: info-contact@alibabacloud.com 進行舉報並提供相關證據,工作人員會在 5 個工作天內聯絡您,一經查實,本站將立刻刪除涉嫌侵權內容。

A Free Trial That Lets You Build Big!

Start building with 50+ products and up to 12 months usage for Elastic Compute Service

  • Sales Support

    1 on 1 presale consultation

  • After-Sales Support

    24/7 Technical Support 6 Free Tickets per Quarter Faster Response

  • Alibaba Cloud offers highly flexible support services tailored to meet your exact needs.