統(tǒng)計(jì)學(xué)原理第3章統(tǒng)計(jì)整理_第1頁(yè)
統(tǒng)計(jì)學(xué)原理第3章統(tǒng)計(jì)整理_第2頁(yè)
統(tǒng)計(jì)學(xué)原理第3章統(tǒng)計(jì)整理_第3頁(yè)
統(tǒng)計(jì)學(xué)原理第3章統(tǒng)計(jì)整理_第4頁(yè)
統(tǒng)計(jì)學(xué)原理第3章統(tǒng)計(jì)整理_第5頁(yè)
已閱讀5頁(yè),還剩58頁(yè)未讀, 繼續(xù)免費(fèi)閱讀

下載本文檔

版權(quán)說(shuō)明:本文檔由用戶提供并上傳,收益歸屬內(nèi)容提供方,若內(nèi)容存在侵權(quán),請(qǐng)進(jìn)行舉報(bào)或認(rèn)領(lǐng)

文檔簡(jiǎn)介

統(tǒng)計(jì)學(xué)原理李德智副教授/博士東南大學(xué)土木工程學(xué)院建設(shè)與房地產(chǎn)系163第3章統(tǒng)計(jì)整理統(tǒng)計(jì)工作的過(guò)程統(tǒng)計(jì)整理統(tǒng)計(jì)分析實(shí)際問(wèn)題統(tǒng)計(jì)設(shè)計(jì)統(tǒng)計(jì)調(diào)查統(tǒng)計(jì)預(yù)測(cè)統(tǒng)計(jì)決策第2章統(tǒng)計(jì)調(diào)查思考題某市場(chǎng)調(diào)查共發(fā)放問(wèn)卷2000份,其中每份問(wèn)卷包含15題、每題4個(gè)選項(xiàng),請(qǐng)問(wèn)如何整理?需要利用計(jì)算機(jī)嗎?如果需要,請(qǐng)問(wèn)如將統(tǒng)計(jì)數(shù)據(jù)輸入計(jì)算機(jī)?某課程共有96人參加考試,其成績(jī)分布為:8人優(yōu)秀、40人良好、35人中等、9人及格、4人不及格。請(qǐng)問(wèn)用什么圖表可以較好地表示該成績(jī)分布?第3章統(tǒng)計(jì)整理3.1統(tǒng)計(jì)整理的涵義3.2數(shù)據(jù)的預(yù)處理3.3分類數(shù)據(jù)的整理與顯示3.4順序數(shù)據(jù)的整理與顯示3.5數(shù)值型數(shù)據(jù)的整理與顯示3.6統(tǒng)計(jì)表3.1統(tǒng)計(jì)整理的涵義一、統(tǒng)計(jì)整理的概念二、統(tǒng)計(jì)整理的內(nèi)容使統(tǒng)計(jì)數(shù)據(jù)由個(gè)體特征過(guò)渡到總體特征的工作過(guò)程1000+1250++750=5億元

5億/50=1000萬(wàn)元/家例如:通過(guò)調(diào)查得某班平均成績(jī)?yōu)?.5分/人(五分制)則百分制下其平均成績(jī):5:100=3.5:X,X=70分。統(tǒng)計(jì)整理的概念統(tǒng)計(jì)整理的統(tǒng)計(jì)數(shù)據(jù)包括一手?jǐn)?shù)據(jù)和二手?jǐn)?shù)據(jù)例如:某市50家建筑企業(yè)年利潤(rùn)額如下,求其平均值統(tǒng)計(jì)整理的內(nèi)容3.2數(shù)據(jù)的預(yù)處理數(shù)據(jù)的預(yù)處理數(shù)據(jù)錄入數(shù)據(jù)審核數(shù)據(jù)篩選數(shù)據(jù)排序完整性準(zhǔn)確性遞增排序遞減排序數(shù)據(jù)的預(yù)處理(舉例)8名同學(xué)四門(mén)課程成績(jī)分布姓名統(tǒng)計(jì)學(xué)成績(jī)數(shù)學(xué)成績(jī)英語(yǔ)成績(jī)經(jīng)濟(jì)學(xué)成績(jī)王翔91759594袁方75587690張松69688486趙穎75968183田雨54886778陳風(fēng)87769277宋媛83726671李華81608664數(shù)據(jù)的預(yù)處理(要求)將試卷上的成績(jī)錄入EXCEL;審核錄入數(shù)據(jù)的準(zhǔn)確性和完整性;篩選出四門(mén)課程成績(jī)沒(méi)有不及格者;將統(tǒng)計(jì)學(xué)成績(jī)遞增排序。思考:如何對(duì)調(diào)查問(wèn)卷中的數(shù)據(jù)進(jìn)行預(yù)處理呢?3.3分類數(shù)據(jù)的整理與顯示一、基本問(wèn)題二、分類數(shù)據(jù)的整理三、分類數(shù)據(jù)的圖示

基本問(wèn)題不同類型數(shù)據(jù)所采取的整理與顯示方法不同。對(duì)分類數(shù)據(jù)和順序數(shù)據(jù)主要是做分類整理。對(duì)數(shù)值型數(shù)據(jù)主要是做分組整理。適用于低層次數(shù)據(jù)的整理和顯示方法也適用于高層次的數(shù)據(jù);而高層次數(shù)據(jù)的整理和顯示方法并不適用于低層次數(shù)據(jù)。思考:如何確定數(shù)據(jù)類型呢?分類數(shù)據(jù)的整理(舉例)1、您所居住的小區(qū)所處的行政區(qū)域是

區(qū)。分類數(shù)據(jù)的整理(基本過(guò)程)列出各類別;計(jì)算各類別的頻數(shù);制作頻數(shù)分布表;用圖形顯示數(shù)據(jù)。落在某一特定類別(或組)中的數(shù)據(jù)個(gè)數(shù)思考:EXCEL、SPSS能夠處理文字嗎?分類數(shù)據(jù)的整理(轉(zhuǎn)換并計(jì)數(shù))分類數(shù)據(jù)的圖示(條形圖、餅形圖)能在PPT上直接作嗎?TheAnsweris:

Yes!分類數(shù)據(jù)的圖示(條形圖、餅形圖)思考:還有別的方法嗎?3.4順序數(shù)據(jù)的整理與圖示一、順序數(shù)據(jù)的整理二、順序數(shù)據(jù)的圖示順序數(shù)據(jù)的整理(舉例)關(guān)于新《南京市物業(yè)管理辦法》實(shí)施情況的調(diào)查(一):

1、您知道今年2月份施行的新《南京市物業(yè)管理辦法》嗎?

A.

不知道B.

知道一些C.

知道9、您知道本小區(qū)的維修專項(xiàng)資金的使用情況嗎?

A.

不知道B.

知道一些C.

知道順序數(shù)據(jù)的整理(結(jié)果錄入)順序數(shù)據(jù)是從類別順序的開(kāi)始一方向其最后一方累加頻數(shù),而數(shù)值型數(shù)據(jù)是從小的一方向大的累加頻數(shù)。順序數(shù)據(jù)的整理(結(jié)果整理)順序數(shù)據(jù)的圖示(累計(jì)頻數(shù)圖)順序數(shù)據(jù)的圖示(累計(jì)頻數(shù)圖)順序數(shù)據(jù)的圖示(環(huán)形圖)在PPT里能做嗎?Justtry!3.5數(shù)值型數(shù)據(jù)的整理與顯示一、數(shù)值型數(shù)據(jù)的分組二、數(shù)值型數(shù)據(jù)的整理三、數(shù)值型數(shù)據(jù)的圖示數(shù)值型數(shù)據(jù)的分組分組方法單變量值分組組距分組等距分組異距分組單變量值分組將每一個(gè)變量值作為一組。適用于離散變量。適用于變量值較少的情況下。組距分組(舉例)組距分組(要點(diǎn))將全部變量值依次劃分為若干個(gè)區(qū)間,并將這一區(qū)間的變量值稱為一組適用于連續(xù)變量或變量值較多的情況下需要遵循“不重不漏”的原則如何做到呢?(1)不重:

1)連續(xù)變量:相鄰組限重疊,“上組限不在本組內(nèi)”

2)離散變量:另外可采用相鄰組限間隔的辦法(2)不漏:

1)認(rèn)真檢查;

2)在最大最小值與其它值相距甚遠(yuǎn)時(shí)采用開(kāi)口組組距分組(基本概念)組數(shù)(K):組的數(shù)目組限:分組的數(shù)量界限,包括上限(U)、下限(L)閉口組:上限和下限齊全的組開(kāi)口組:有上限而缺下限或者有下限而缺上限的組組距(i):各組上限與下限之差(i=U–L)組距分組(基本概念)全距(R):

R=Xmax

–Xmin=i

如:某班某門(mén)課的考試成績(jī)最高為98分,最低為45分 R=53分組中值:各組上限與下限的中點(diǎn)值推測(cè)本組平均水平 (1)在閉口組中:組中值=(U+L)/2

(2)在開(kāi)口組中:首組組中值=(U+L)/2=[U+(U-i)]/2=U-i/2=U-鄰組i/2末組組中值=(U+L)/2=[L+(L+i)]/2=L+i/2=L+鄰組i/2前提(假定):各組數(shù)據(jù)在本組內(nèi)均勻分布或組中值兩側(cè)呈對(duì)稱分布組距分組(基本步驟)確定組數(shù)K

。組數(shù)的確定應(yīng)以能夠顯示數(shù)據(jù)的分布特征和規(guī)律為目的。在實(shí)際分組時(shí),可采用斯特奇斯(Sturges

)經(jīng)驗(yàn)公式確定,亦可根據(jù)數(shù)據(jù)的多少和特點(diǎn)及分析的要求,參考這一標(biāo)準(zhǔn)靈活確定。確定組距i

。

(1)等距分組:i=R/K

(2)異距分組:對(duì)某些特定現(xiàn)象或?yàn)榱颂囟ㄑ芯磕康男枰?,可自行確定不等的組距。根據(jù)分組整理成頻數(shù)分布表頻數(shù)分布表(相鄰組組限間隔)頻數(shù)分布表(相鄰組組限重疊)頻數(shù)分布表(使用開(kāi)口組)異距分組它適用于某些特殊情況或特定需要。為消除各組次數(shù)受組距大小不同的影響,更確切地反映各組次數(shù)的實(shí)際分布,可計(jì)算次數(shù)密度或標(biāo)準(zhǔn)組距次數(shù)。次數(shù)密度就是單位組距內(nèi)分布的次數(shù)。標(biāo)準(zhǔn)組距次數(shù)是選定數(shù)列中某一合適的組距作為標(biāo)準(zhǔn)組距,用各組次數(shù)密度分別乘以標(biāo)準(zhǔn)組距得到的折合次數(shù)。數(shù)值型數(shù)據(jù)的圖示(一)分組數(shù)據(jù):直方圖和折線圖(二)未分組數(shù)據(jù):莖葉圖和箱形圖(三)時(shí)間序列數(shù)據(jù):線圖(四)多變量數(shù)據(jù):雷達(dá)圖

適用于低層次數(shù)據(jù)的整理和顯示方法也適用于高層次的數(shù)據(jù);而高層次數(shù)據(jù)的整理和顯示方法并不適用于低層次數(shù)據(jù)。條形圖、餅圖、環(huán)形圖、累積分布圖等都適用于顯示數(shù)值型數(shù)據(jù)其他圖示形式分組數(shù)據(jù)(直方圖)思考:直方圖與條形圖一樣嗎?為什么?分組數(shù)據(jù)(直方圖VS條形圖)條形圖是用條形的長(zhǎng)度表示各類別頻數(shù)的多少,其寬度是固定的。直方圖是用面積表示各組頻數(shù)的多少,矩形的高度表示每一組的頻數(shù)或頻率,寬度表示各組的組距,因此其高度與寬度均有意義。直方圖的各矩形通常是連續(xù)排列的,而條形圖是分開(kāi)排列。條形圖主要用于展示分類數(shù)據(jù),而直方圖則主要用于展示數(shù)值型數(shù)據(jù)分組數(shù)據(jù)(折線圖)折線圖也稱為頻數(shù)多邊形圖。它是在直方圖的基礎(chǔ)上,把直方圖頂部的中點(diǎn)(組中值)用直線連接起來(lái),再把原來(lái)的直方圖抹掉。折線圖的兩個(gè)終點(diǎn)要與橫軸相交,具體做法是:

1)第一個(gè)矩形的頂部中點(diǎn)通過(guò)豎邊中點(diǎn)(即該組頻數(shù)一半的位置)連接到橫軸,最后一個(gè)矩形頂部中點(diǎn)與其豎邊中點(diǎn)連接到橫軸;

2)折線圖下圍成的面積與直方圖的面積相等,兩者所表示的頻數(shù)分布是一致的。分組數(shù)據(jù)-折線圖(舉例)某電腦公司2002年前4個(gè)月銷量分布折線圖未分組數(shù)據(jù)(莖葉圖--舉例)未分組數(shù)據(jù)(莖葉圖--基本莖葉圖)未分組數(shù)據(jù)(莖葉圖--概念)由“莖”和“葉”兩部分組成,其圖形由數(shù)字組成。以該組數(shù)據(jù)的高位數(shù)值作樹(shù)莖,低位數(shù)字作樹(shù)葉。樹(shù)葉上只保留最后一位數(shù)字;對(duì)于n(20~300)個(gè)數(shù)據(jù),莖葉圖最大行數(shù)不超過(guò)5.

莖葉圖類似于橫置的直方圖,但又有區(qū)別:直方圖可觀察一組數(shù)據(jù)的分布狀況,但沒(méi)有給出具體的數(shù)值莖葉圖既能給出數(shù)據(jù)的分布,又能給出每一個(gè)原始數(shù)值,保留了原始數(shù)據(jù)的信息未分組數(shù)據(jù)(莖葉圖--擴(kuò)展莖葉圖)思考:能利用EXCEL繪制嗎?SPSS呢?未分組數(shù)據(jù)(箱形圖--舉例)未分組數(shù)據(jù)(單批數(shù)據(jù)箱形圖)利用SPSS繪制的“某電腦公司2002年前4個(gè)月銷售量的箱形圖”如何手繪或利用EXCEL繪制??未分組數(shù)據(jù)(箱形圖--概念)由一組數(shù)據(jù)的最大值、最小值、中位數(shù)和下四位數(shù)QL、上四位數(shù)QU5個(gè)特征值繪制而成的,它由一個(gè)箱子和兩條線段組成。繪制步驟: (1)首先找出一組數(shù)據(jù)的5個(gè)特征值; (2)連接兩個(gè)四分位數(shù)畫(huà)出箱子,再將兩個(gè)極值點(diǎn)與箱子相連接。箱形圖與數(shù)據(jù)分布的關(guān)系未分組數(shù)據(jù)(多批數(shù)據(jù)箱形圖)8門(mén)課程考試成績(jī)箱形圖11名同學(xué)8門(mén)課程考試成績(jī)箱形圖時(shí)間序列數(shù)據(jù)(線圖)

時(shí)間序列數(shù)據(jù):在不同時(shí)間點(diǎn)上獲取的數(shù)值型數(shù)據(jù)

線圖:在平面坐標(biāo)上用折線表現(xiàn)數(shù)量變化特征和規(guī)律的圖形1993-2000年城鄉(xiāng)居民人均可支配收入對(duì)比表時(shí)間數(shù)列(線圖--舉例)多變量數(shù)據(jù)(雷達(dá)圖--舉例)多變量數(shù)據(jù)(雷達(dá)圖--概念)它是一種用于顯示多變量的圖示方法。它在顯示或?qū)Ρ雀髯兞康臄?shù)值總和時(shí)十分有用。假定各變量的取值具有相同的正負(fù)號(hào),則總的絕對(duì)值與圖形所圍成的區(qū)域成正比。利用它可以研究多個(gè)樣本之間的相似程度。多變量數(shù)據(jù)(雷達(dá)圖--步驟)數(shù)據(jù)類型及圖示—小結(jié)3.6統(tǒng)計(jì)表一、統(tǒng)計(jì)表的構(gòu)成二、統(tǒng)計(jì)表的設(shè)計(jì)統(tǒng)計(jì)表的構(gòu)成1999-2000年城鎮(zhèn)居民家庭資料抽樣調(diào)查資料項(xiàng)目單位19992000調(diào)查戶數(shù)戶4004442220平均每戶家庭人口人3.143.13平均每人全部年收入元5888.776316.81平均每人消費(fèi)性支出元4615.914988.00資料來(lái)源:《中國(guó)統(tǒng)計(jì)年鑒2001》,北京,中國(guó)統(tǒng)計(jì)出版社,2001表頭行標(biāo)題數(shù)字資料列標(biāo)題附加統(tǒng)計(jì)表的設(shè)計(jì)基本要求:科學(xué)、實(shí)用、簡(jiǎn)煉、美觀;要合理安排統(tǒng)計(jì)表的結(jié)構(gòu),應(yīng)使統(tǒng)計(jì)表的橫豎長(zhǎng)度比例適當(dāng),避免出現(xiàn)過(guò)高或過(guò)長(zhǎng)的表格形式;表頭一般應(yīng)包括表號(hào)、總標(biāo)題和表中數(shù)據(jù)的單位等內(nèi)容。如果表中全部數(shù)據(jù)同一計(jì)量單位,可在表的右上角標(biāo)明;若各指標(biāo)的計(jì)量

溫馨提示

  • 1. 本站所有資源如無(wú)特殊說(shuō)明,都需要本地電腦安裝OFFICE2007和PDF閱讀器。圖紙軟件為CAD,CAXA,PROE,UG,SolidWorks等.壓縮文件請(qǐng)下載最新的WinRAR軟件解壓。
  • 2. 本站的文檔不包含任何第三方提供的附件圖紙等,如果需要附件,請(qǐng)聯(lián)系上傳者。文件的所有權(quán)益歸上傳用戶所有。
  • 3. 本站RAR壓縮包中若帶圖紙,網(wǎng)頁(yè)內(nèi)容里面會(huì)有圖紙預(yù)覽,若沒(méi)有圖紙預(yù)覽就沒(méi)有圖紙。
  • 4. 未經(jīng)權(quán)益所有人同意不得將文件中的內(nèi)容挪作商業(yè)或盈利用途。
  • 5. 人人文庫(kù)網(wǎng)僅提供信息存儲(chǔ)空間,僅對(duì)用戶上傳內(nèi)容的表現(xiàn)方式做保護(hù)處理,對(duì)用戶上傳分享的文檔內(nèi)容本身不做任何修改或編輯,并不能對(duì)任何下載內(nèi)容負(fù)責(zé)。
  • 6. 下載文件中如有侵權(quán)或不適當(dāng)內(nèi)容,請(qǐng)與我們聯(lián)系,我們立即糾正。
  • 7. 本站不保證下載資源的準(zhǔn)確性、安全性和完整性, 同時(shí)也不承擔(dān)用戶因使用這些下載資源對(duì)自己和他人造成任何形式的傷害或損失。

最新文檔

評(píng)論

0/150

提交評(píng)論