数据挖掘和统计分析

时间:2022-08-23 08:10:46 

很多人问数据挖掘和统计分析的不同之处是什么?相同之处是什么?这样的问题,其实数据挖掘和统计分析的基础都是数学理论。

数据挖掘是直接从庞大的数据中挖掘,而统计分析则是从庞大的数据(总体)中,用随机抽样的方法抽取一部分数据(样本)。通过分析样本数据来推测总体特性(平均、比例、标准偏差等)的统计方法,被称为推测统计学。另外,统计学中还有记述统计学,它足一种能够正确记述并把握获得的数据特性的方法。甚至可以说,记述统计学+其他=数据挖掘。

数据挖掘的目的是从数据中挖掘有效信息。为了实现这个目,可以使用神经网络、购物篮分析以及“多变量分析”的数量化理论、判别分析、回归分析、逻辑回归分析、聚类分析、主成分分析、因子分析、对应分析(双尺度祛)、典型相关分析、联合分析等方法。多变量分析是将相互关联的多变量的数据特征或趋势,用统计学方法进行分析的方法的总称。多变量分析是数据挖掘的重要方法之一,包括各种统计分析方法(如下图):

如果单纯考虑数量化理论或者回归分析等统计分析方法就会发现,虽然分析过程具有很强的数学性,然而操作却只不过是“计算”而已。为了实现数据挖掘的目的,把统计学方法单独或者组合使用,是非常有效的数据分析方法。例如,回归分析在“预测”和“因子分析”时十分有效。另外,极力推荐把聚类分析和判别分析组合之后挖掘数据。

在人类基因组领域中,先通过聚类分析,例如,将总体分成5组,再按照外在基准对5组小集合进行判别分析。经过两个阶段的分析后,再进行判别预测和因子分析。就能分别得出5组小集合的特征。同样地,对交叉表数据实施对应分析(双尺度祛)后再进行聚类分析,最后做模型分类。

标签:分析,数据,数据挖掘,方法,Excel教程
0
投稿

猜你喜欢

  • 用Web版式视图将Excel2007表格转为Word2007

    2023-12-10 10:59:54
  • Excel人民币货币符号怎么打及更改默认货币格式

    2022-05-30 00:45:03
  • Excel表格怎样批量输入求和公式?

    2023-04-08 12:27:42
  • iOS14测试版效能怎么样?看测试结果

    2023-11-29 03:48:27
  • excel怎么设置图表格式? excel中chart tools的使用方法

    2023-11-06 04:40:01
  • 如何在excle表格中设置或清除工作表上的打印区域

    2022-09-02 14:13:31
  • 如何在excel中使用翻译功能?

    2023-10-18 12:32:43
  • Excel教程如何绘制盈利分析图

    2023-08-24 02:46:36
  • word如何设置边框和底纹

    2022-09-12 17:52:45
  • d盘无法格式化被占用要怎么办?d盘无法格式化解决教程?

    2023-09-14 22:15:46
  • excel 制作折线图,怎样设置XY轴?

    2022-04-01 01:24:04
  • word怎么将指定格式应用到特指的文本?

    2022-10-23 08:09:21
  • ​word文档怎么设置缩进和间距

    2022-04-22 06:40:29
  • word中公式与文字不在同一水平线怎么办

    2023-03-07 07:42:13
  • word 字体阴影怎么设置?word 设置字体阴影实例教程

    2022-05-08 17:46:24
  • 如何用word打出乐谱的低音.高音

    2023-11-28 18:11:53
  • 如何批量更改word中字母和数字格式为Time New Roman

    2023-12-08 01:38:33
  • 教你如何在Word中批量制作简单的员工生日贺卡

    2022-01-22 05:10:35
  • wps怎么在形状上添加文字

    2023-05-25 10:39:29
  • Excel获取非空单元格

    2023-10-24 17:26:46
  • asp之家 电脑教程 m.aspxhome.com