设为首页收藏本站

学PPT网

 找回密码
 注册

QQ登录

只需一步,快速开始

扫一扫,访问微社区

搜索
查看: 4389|回复: 179

[综合•文摘分享] 什么是数据挖掘?

  [复制链接]
发表于 2011-8-15 15:47:35 | 显示全部楼层 |阅读模式
分析报告给你后见之明 (hindsight);统计分析给你先机 (foresight);数据挖掘给你洞察力 (insight)
举个例子说:
无标题_副本.bmp


你看到孙悟空跟二郎神打仗,然后写了个分析报告,说孙悟空在柔韧性上优势明显,二郎神在力气上出类拔萃,所以刚开始不相上下;结果两个人跑到竹林里,在竹子上面打,孙悟空的优势发挥出来,所以孙悟空赢了。这叫分析报告。

    孙悟空要跟二郎神打架了,有个赌徒找你预测。你做了个统计,发现两人斗争4567次,其中孙悟空赢3456次。另外,孙悟空斗牛魔王,胜率是89%,二郎神斗牛魔王胜率是71%。你得出趋势是孙悟空赢。因为你假设了这次胜利跟历史的关系,根据经验作了一个假设。这叫统计分析。

你什么都没做,让计算机自己做关联分析,自动找到了出身、教育、经验、单身四个因素。得出结论是孙悟空赢。计算机通过分析发现贫苦出身的孩子一般比皇亲国戚功夫练得刻苦;打架经验丰富的人因为擅长利用环境而机会更多;在都遇得到明师的情况下,贫苦出身的孩子功夫可能会高些;单身的人功夫总比同样环境非单身的高。孙悟空遇到的名师不亚于二郎神,而打架经验绝对丰富,并且单身,所以这次打头,孙悟空赢。这叫数据挖掘。

    数据挖掘跟OLAP的区别在于它没有假设,让计算机找出这种背后的关系,而这种关系可能是你所想得到的,也可能是所想不到的。比如数据挖掘找出的结果发现在2亿条打斗记录中,姓孙的跟姓杨的打,总是姓孙的胜利,孙悟空姓孙,所以,悟空胜利。

    用在现实中,我们举个例子来说,做OLAP分析,我们找找哪些人总是不及时向电信运营商缴钱,一般会分析收入低的人往往会缴费不及时。通过分析,发现不及时缴钱的穷人占71%。而数据挖掘则不同,它自己去分析原因。原因可能是,家住在五环以外的人,不及时缴钱。这些结论对推进工作有很深的价值,比如在五环外作市场调研,发现需要建立更多的合作渠道以方便缴费。这是数据挖掘的价值。

发表于 2011-10-23 02:49:33 | 显示全部楼层
晕死也不加点分  
发表于 2011-10-23 02:49:33 | 显示全部楼层
帮你顶,人还是厚道点好
发表于 2011-11-21 17:25:45 | 显示全部楼层
感謝樓主  
发表于 2011-11-21 17:25:45 | 显示全部楼层
我来看看!谢谢  
发表于 2011-12-16 01:56:41 | 显示全部楼层
说的真有道理啊!
发表于 2011-12-20 04:17:41 | 显示全部楼层
今天心情不是很好,一切都不顺
发表于 2011-12-20 04:17:41 | 显示全部楼层
初来乍到,请多多关照。。。  
发表于 2012-1-24 02:59:13 | 显示全部楼层
天啊.  
发表于 2012-1-24 18:57:21 | 显示全部楼层
非常感谢~~~~~~~~~~~












2012最新电影  www.modao.net

Archiver|手机版|小黑屋|『学PPT网』- 分享成果,分享PPT. ( 粤ICP备19153743号  

GMT+8, 2020-10-29 15:01 , Processed in 1.139620 second(s), 26 queries .

Powered by Discuz! X3.4 Licensed

© 2001-2017 Comsenz Inc.

快速回复 返回顶部 返回列表