本书标签: 明星同人  乡村  学霸笔记   

第6623篇红婵学霸笔记 数学之光:全红婵儿的清华之路

红婵清华北大学霸笔记铺

数学之光:全红婵儿的清华之路

晚风掠过乡间中学的屋檐,窗外稻田沙沙作响,偌大教学楼只剩下角落一间教室还亮着一盏老旧台灯。全红婵合上随机抽样部分的笔记,指尖抚过人教版必修第二册课本,翻到9.2《用样本估计总体》。前面学会怎样抽取样本,而这一节,就要读懂样本数据背后藏着的信息。抽样是拿到数据,数字特征,则是解读数据。

桌面上摊开厚厚一摞笔记本,纸页边缘被反复翻阅磨得发毛。乡下没有繁多的教辅资料,红婵便把课本例题一字一句拆解,草稿纸上写满演算,一组组原始数据经过计算,转化成可以对比分析的统计量。正当她埋头梳理众数、中位数的定义,书桌之上缓缓漾开柔和银辉,时空智者卡尔·皮尔逊再度现身。他目光扫过纸上密密麻麻的数据,声音沉稳悠远,穿越百年时光缓缓落下。

“一堆散乱的数据本身没有意义,唯有提炼出数字特征,杂乱的记录才会变成可以读懂的真相。平均数看见整体水平,中位数看见中间层次,方差看见波动起伏,每一个统计量,都有它看待世界的角度。”

红婵拿起黑色水笔,把这段哲思工整抄写在笔记页眉。她心中深有感触,看待人和事也当如此,不能只凭单一标准评判,换一个角度,便会看见不一样的事实。

一、知识点精讲:总体集中趋势的估计

集中趋势,就是一组数据向某一个中心靠拢的倾向,主要包含众数、中位数、平均数、百分位数四大统计量。

1.众数

定义:一组数据当中,出现次数最多的数据。

红婵批注重点:一组数据可以有不止一个众数,也可以没有众数;众数一定来源于原始数据。

例:数据:2,3,3,5,6,6,8。3和6出现次数并列最多,这组数据拥有两个众数。

优点:简单直观;缺点:只关注高频出现数值,忽略大部分其余数据信息,容易片面。

2.中位数

定义:把全部数据从小到大排序。数据个数为奇数,取正中间那一个;数据个数为偶数,取中间两个数字的算术平均值。

核心前提:必须先排序,再求中位数,不排序直接取中间位置,一定会算错。

例①:5个数据:12,15,18,21,24,共奇数个,中位数就是18。

例②:6个数据:4,6,9,11,14,17,偶数个,中位数=\frac{9+11}{2}=10。

优点:不受极端偏大、偏小异常值的强烈影响;缺点:对两端数据变化不敏感,丢失很多信息。

3.平均数(算术平均数)

记为\bar{x},设有n个数据x_1,x_2…x_n。

\bar{x}=\frac{1}{n}(x_1+x_2+\dots+x_n)

平均数使用全部数据参与运算,对每一个数值变化都很敏感,极易受到极端异常值的干扰。

一组数据里如果混入一个特别大或者特别小的数,平均数会被严重拉扯,不能真实反映大多数人的水平。

卡尔·皮尔逊的提示落在纸页之间:

“平均数固然好用,但不可盲目迷信平均数。少数极端数值,就可以把整体平均值拉高或者压低,掩盖大多数真实状况。”

4.百分位数(课本新增重点考点)

第p百分位数含义:至少p%的数据小于或等于该数,同时至少(100‑p)\%的数据大于或等于该数。

计算完整步骤:

第一步,将全部原始数据从小到大排序;

第二步,计算i=n×p\%;

第三步:若i不是整数,向上取整,对应位置的数据即为第p百分位数;若i是整数,则取第i项与第i+1项数据的平均值。

重要对应:中位数就是第50百分位数。常见还有第25百分位数(下四分位数),第75百分位数(上四分位数)。

二、知识点精讲:总体离散程度的估计

集中趋势描述数据中心,而离散程度,刻画数据波动、分散的程度,核心为极差、方差、标准差。

1.极差

一组数据最大值减去最小值。

优点:计算简单;缺点:仅仅使用首尾两个数据,极易受极端值干扰,可靠性差,高中一般只做辅助参考。

2.样本方差

一组数据x_1,x_2…x_n,平均数\bar{x}

s^2=\frac1n\left[(x_1-\bar{x})^2+(x_2-\bar{x})^2+\dots+(x_n-\bar{x})^2\right]

方差衡量各个数据距离平均数的平均偏离程度。

- 方差越大:数据波动剧烈,稳定性差;

- 方差越小:数据彼此靠近,波动小,稳定性越好。

3.样本标准差

方差开算术平方根:s=\sqrt{s^2}

方差单位是原始数据单位的平方,标准差单位与原始数据单位保持一致,现实分析当中标准差使用更多。

红婵错题警示:方差计算,一定要先求平均数,再算每一项与平均数差的平方,最后求平均值,步骤不能颠倒。

4.分层随机抽样的平均数(加权平均数)

分层抽样之后,两层样本,第一层样本量m,平均数\bar{x};第二层样本量n,平均数\bar{y}。

总样本平均数:

\bar{a}=\frac{m\bar{x}+n\bar{y}}{m+n}

本质就是加权平均,权重等于每一层样本数量占总样本的占比。

红婵笔记提醒:千万不要直接\frac{\bar{x}+\bar{y}}{2}简单取两层平均数再平均,只有两层样本容量相等的时候才可以这么算,绝大多数题目不满足这个条件。

卡尔·皮尔逊留下哲思:

“分层的加权,是尊重每一部分样本的分量,大的层拥有更大话语权,简单平均,会扭曲真实的整体水平。”

三、经典题型分层精讲

题型一 基础数字特征计算

例题:抽取8名乡村学生的数学测验成绩:62,68,72,75,75,81,86,92。

求众数、中位数、平均数。

解:排序完成。

众数:75(出现两次,次数最多)。

一共8个数据偶数个,中位数=\frac{75+75}{2}=75。

平均数:

\bar{x}=\frac{62+68+72+75+75+81+86+92}{8}=76.375

题型二 方差、标准差应用题(稳定性对比)

甲乙两名同学五次测试成绩

甲:78,82,80,81,79

乙:74,85,88,76,77

先算平均数,甲乙平均数都等于80。

计算方差,甲的方差小,成绩波动更小,发挥更加稳定;乙成绩起伏大。

考试选拔,如果平均水平相同,优先选择方差更小发挥稳定的选手。

红婵随笔:生活之中处处可以用到方差,庄稼产量、机器零件加工,都要看数据稳不稳定。

题型三 分层抽样加权平均数大题

某学校高一,男生抽取60人,平均分76;女生抽取40人,平均分81。求全部100人的样本总平均分。

解:不能直接(76+81)÷2。

\bar{a}=\frac{60×76+40×81}{100}=\frac{4560+3240}{100}=78

题型四 百分位数计算

样本数据:13,14,17,19,22,25,28,31,35,共9个,求第70百分位数。

解:i=9×70\%=6.3,i不是整数,向上取整取第7项,结果等于28。

四、红婵错题本·考场易错清单

易错点1:求中位数、百分位数忘记排序,直接拿原始顺序数字计算,结果完全错误。

易错点2:混淆众数概念,误以为一组数据只能有一个众数,众数可以多个。

易错点3:分层抽样求总平均数,直接两层平均数相加除以二,忽略样本数量权重,这是高频丢分点。

易错点4:方差计算,忘记做平方运算,或者最后不去求平均。牢记先求均值,再求偏差平方,再求平均。

易错点5:分不清方差与标准差,读题看清题目问的是方差s^2,还是标准差s,二者不要写混。

易错点6:过度迷信平均数,忽略极端异常值对平均数的干扰。当数据里面存在极大极小异常数据,中位数往往更能代表大多数真实水平。

易错点7:百分位数计算,i是整数与非整数的处理规则记混,向上取整与取相邻两项平均值分清楚。

夜色沉沉,教室里只有台灯静静发光。红婵放下笔,活动酸胀的手腕。她望着笔记上一组组统计量,心中生出许多感悟。平均数、中位数、众数,没有绝对孰优孰劣,各有适用场景。放到人生之中也是同理,不能只用单一分数定义自己。一次考试分数只是一个样本,人生是一整套庞大的数据集合,一时高低不能概括全部的自己。

身处偏僻乡村,见过有限的人与事,如同拿到一小份样本。统计教会她,不能拿局部的样本去武断揣测整个世界。一页页演算笔记,是山野女孩一步步向上攀登的脚印。

卡尔·皮尔逊的微光缓缓消散,窗外蛙鸣依旧。红婵合上这一节笔记,统计这门学科,教会她的不只是计算,更是理性看待现实的思维。

红婵学习随笔

样本数字特征这一节计算量大,笔算的时候一定要细心,农村学校没有计算器,一步算错,整道题目全部出错。

做题先看清楚问题:求众数找出现最多;求中位数、百分位数,第一件事必须排序;分层平均数一定要记得加权,不要简单把两层平均数直接求平均。

方差衡量波动,方差越小越稳定。分清方差和标准差,审题看清楚要求哪一个。

平均数容易被极端数值拉扯,现实分析要懂得结合中位数、众数一起综合判断,不要只看单一指标。

学习就如同收集属于自己的数据,每一次刷题,每一次改错,都是新增的样本,日积月累,我们自身整体的水平才会稳步提升。

📱互动区:《红婵清华北大学霸笔记铺》

涵盖初高中各科笔记、真题、方法技巧、学习心得感悟及趣味故事等,在手机上随时可翻看,是你的行走课堂,专门为初高中学生打造《红婵清华北大学霸笔记铺》互动环节内容。

免费为收藏关注的同学设计笔记,把你的要求发在评论区,例如 给我设计一篇初中八年级英语上册第3单元的学习笔记。设计完成后编号放在红婵儿清华北大学霸笔记铺的专栏里,你可自行提取。另外你有好的设计笔记,请在评论区留言,我们在学霸笔记铺设专题专栏为你发布,欢迎你的参与!让我们共同打造最实用的学霸笔记库。

章末备注:文中公式和算式的代码(乱码)可用任一款ai软件(豆包)解锁,即将内容复制并粘贴至豆包对话框确认即可。