• 回答数

    6

  • 浏览数

    164

苦瓜老太婆
首页 > 论文问答 > 论文数据标准化处理工具怎么用

6个回答 默认排序
  • 默认排序
  • 按时间排序

45度向上傾斜

已采纳
用EXCEL对论文数据进行分析,不是不可以做。但是一定要把握几个原则,首先你得要走专业数据的标准,换句话说,假设你的某项指标的系数标准是5-8之间,你得要有标准,这样的话就可以进行分析!当然你得需要提供表格模板!让答辩者按照你的格式填写,你就可以用excel分析了!
163 评论

装璜专家

SPSS数据分析心得小结_数据分析心得分享学习数据分析之spss分析工具,可真的不是一般的功夫,真的要很认真和很细心才能做得好spss。下面我来和大家分享一下关于SPSS数据分析心得小结,希望大家从这数据分析心得分享中能得到一些启示和指导。心得1:拿到一份数据,或者在看到国内外某个学者的文章有想法而自己手里的数据刚好符合这个想法可以做时,在整理好数据后不要急于建模。一定要对数据做缺失值处理、异常值处理。在数据预处理的基础上再进一步建模,否则可能得到错误的结果。心得2:承接心得1,数据预处理怎么做。一是缺失值的处理。我个人有几个看法:一是数据样本量足够大,在删除缺失值样本的情况下不影响估计总体情况,可考虑删除缺失值;二是数据样本量本身不大的情况下,可从以下两点考虑:1是采用缺失值替换,SPSS中具体操作为“转换”菜单下的“替换缺失值”功能,里面有5种替换的方法。若数据样本量不大,同质性比较强,可考虑总体均值替换方法,如数据来自不同的总体(如我做农户调研不同村的数据),可考虑以一个小总体的均值作为替换(如我以一个村的均值替换缺失值)。2是根据原始问卷结合客观实际自行推断估计一个缺失值的样本值,或者以一个类似家庭的值补充缺失值。心得3:承接心得1,数据预处理第二点异常值的处理。我大概学了两门统计软件SPSS和Stata,SPSS用的时间久些,熟悉一下,Stata最近才学,不是太熟。关于这点我结合着来说。关于异常值的处理可分为两点,一是怎么判定一个值是异常值,二是怎么去处理。判定异常值的方法我个人认为常用的有两点:1是描述性统计分析,看均值、标准差和最大最小值。一般情况下,若标准差远远大于均值,可粗略判定数据存在异常值。2是通过做指标的箱图判定,箱图上加“*”的个案即为异常个案。发现了异常值,接下来说怎么处理的问题。大概有三种方法:一是正偏态分布数据取对数处理。我做农户微观实证研究,很多时候得到的数据(如收入)都有很大的异常值,数据呈正偏态分布,这种我一般是取对数处理数据。若原始数据中还有0,取对数ln(0)没意义,我就取ln(x+1)处理;二是样本量足够大删除异常值样本;三是从stata里学到的,对数据做结尾或者缩尾处理。这里的结尾处理其实就是同第二个方法,在样本量足够大的情况下删除首尾1%-5%的样本。缩尾指的是人为改变异常值大小。如有一组数据,均值为50,存在几个异常值,都是500多(我这么说有点夸张,大概是这个意思),缩尾处理就是将这几个500多的数据人为改为均值+3标准差左右数据大小,如改为100。总结而言,我个人认为做数据变换的方式比较好,数据变换后再做图或描述性统计看数据分布情况,再剔除个别极端异常值。心得4:如何做好回归分析。经过多次实战,以及看了N多视频,上了N多课,看了N多专业的书。我个人总结做回归的步奏如下:1是承接心得1-3,对数据进行预处理,替换缺失值和处理异常值;2是将单个自变量分别与因变量做散点图和做回归,判定其趋势,并做好记录(尤其是系数正负号,要特别记录);3是自变量和因变量一起做相关系数,看各个变量相关关系强弱,为下一步检验多重共线性做准备;4是自变量多重共线性诊断。若变量存在多重共线性,可采用主成分回归,即先将存在多重共线性的变量做主成分分析合并为1个变量,然后再将合并成的新变量和其余自变量一起纳入模型做回归;5是做残差图,看残差图分布是否均匀(一般在+-3个单位之间均匀分布就比较好);6是报告相应结果。心得5:看到论坛上有网友问为什么他(她)老师不建议采用后向步进法处理变量多重共线性。记得张文彤老师说过他有个同学做过一个研究,即采用后向步进法剔除变量的方式去做回归,得到的结果犯错的几率比较大。张老师也不建议用这个方法处理多重共线性。处理多重共线性比较好的方法是做主成分回归。心得6:有个朋友问我在报到回归结果时用未标准化的回归系数好,还是用标准化后的回归系数好。我个人觉得这个问题仁者见仁智者见智,要看想表达什么。具体而言,如果想表达在其它条件不变的情况下,自变量X每变化1个单位,因变量变化多少个单位,这种情况用未标准化回归系数就好;如果想比较各个自变量对因变量影响的相对大小,即判断相对而言,哪个变量对因变量影响更大。这时需要消除量纲的影响,看标准化后的回归系数。心得7:这是投稿一篇SSCI外审专家提出的意见。我做的是无序多分类logistic回归模型。因变量分了5类,有一类个数比较多,达到300多,有1-2类个案比较少,只有30左右。专家提到了要做稳健性检验。这个用stata软件编程加一个robust即可解决问题。不知道在SPSS里面怎么做。欢迎知道的朋友一起讨论下。我个人认为这是一个好问题的。不做稳健性检验模型可能受一些极端值的影响,结果不稳定。可能本来显著的变量剔除1-2个样本后就变得不显著了。所以做回归分析稳健性检验也比较重要。PS:如果有可能,我希望在后面的心得中附上实际操作的步奏图和解释的。看看有没有人需要这个。不然可能说的一些东西需要的人能看明白,但还是不清楚怎么做。希望和大家一起交流学习。以上是小编为大家分享的关于SPSS数据分析心得小结的相关内容,更多信息可以关注环球青藤分享更多干货

335 评论

会飞的猪lucky

SPSS统计分析软件是我最早接触的数据分析工具,我的博客将陆续介绍SPSS统计分析软件的相关内容,这类文章将统一按照在标题或者正文第一段出现 SPSS案例分析 + 编号 的形式组织,便于读者朋友们快速查询、收集,今天是第一篇,即 SPSS案例分析1,后文将不再说明。--------------------------------------------------------------->进行多元统计分析时,我们往往要收集不同量纲的数据,比如销售总额(万元),利润率(百分数)。这表现为变量在数量级和计量单位上的差别,从而使得各个变量之间不具有综合性,而多元分析方法大多对变量要特殊的要求,比如符合正态分布或者变量之间具有可比性。这时就必须采用某种方法对各变量数值进行标准化处理,或者叫无量纲化处理,解决各数值不具综合性的问题。spss提供了很方便的数据标准化方法,这里只介绍Z标准化方法。即每一变量值与其平均值之差除以该变量的标准差。无量纲化后各变量的平均值为0,标准差为1,从而消除量纲和数量级的影响。该方法是目前多变量综合分析中使用最多的一种方法。在原始数据呈正态分布的情况下,利用该方法进行数据无量纲处理是较合理的。spss的实现步骤:图例【1】分析——描述统计——描述【2】弹出“描述统计”对话框,首先将准备标准化的变量移入变量组中,此时,最重要的一步就是勾选“将标准化得分另存为变量”,最后点击确定。【3】返回SPSS的“数据视图”,在原始变量的最后多了一列Z开头的新变量,这个变量就是标准化后的变量了。基于此字段可以做其他分析。

237 评论

一janice一

用透视表分析一般的数据就可以了啊。步骤:插入——数据透视表——选定需要分析的数据,即可生成透视表。然后根据自己需要的数据进行布局,在树枝一栏中可以选择统计方式,比如求和、求平均、最大值、最小值等等。另外,如果因为专业原因需要进行更专业的数据分析,可以参考楼上的数据分析软件进行分析即可。以上问题来源于天猫博望专营服务店团队,希望可以帮到您。

158 评论

小怪兽的小胖兽

1:excel虽然内置有数据分析模块,但是毕竟不是专业的数据统计分析软件,功能上受限很多。2:当然我们平时的大部分数据分析工作,无论是课程、毕业论文需要的,大家可能更习惯于使用专业的Eviews、SPSS、Stata、Minitab,甚至计量和统计科班的大神们都在用SAS、MATLAB或者R语言、Python语言。3:今天给大家推荐的两款excel数据分析插件内存小,内置于excel工具栏随点随用,仅仅包含常用功能,界面简洁。4:第一款6SQ统计是国内一家叫做六西格玛网的公司开发的,主要用于品质管理,不过常用的统计功能和数据分析模块都具备。一共有两个版本:开发版(收费)和个人版(免费),经过试用,两个版本功能差别不大。

340 评论

白树dodo

在EXCEL中消除量纲,没有现成的函数,要组合作用,步骤如下:第一步:求出各变量(指标)的算术平均值(数学期望)xi和标准差si ; 第二步:进行标准化处理: xij¢=(xij-xi)/si 其中:xij¢为标准化后的变量值;xij为实际变量值。 第三步:将逆指标前的正负号对调。 标准化后的变量值围绕0上下波动,大于0说明高于平均水平,小于0说明低于平均水平

109 评论

相关问答