最具影响力的数字化技术在线社区

168大数据

 找回密码
 立即注册

QQ登录

只需一步,快速开始

1 2 3 4 5
开启左侧

数据分析最常用工具介绍

[复制链接]
发表于 2014-12-18 09:33:39 | 显示全部楼层 |阅读模式

马上注册,结交更多数据大咖,获取更多知识干货,轻松玩转大数据

您需要 登录 才可以下载或查看,没有帐号?立即注册

x
数据存储
我们必须能够存储数据,对个人来讲至少应该掌握一种数据库技术,当然也不一定要熟练操作,但至少要能够理解数据的存储和数据的基本结构和数据类型,比如数据的安全性、唯一性、冗余性,表的关系,粒度,容量等,最好能够理解 SQL 查询语言的基本结构和读取等等!
·Access2003 、 Access07 等:这是最基本的个人数据库,经常用于个人或部分基本的数据存储;
·MySQL 数据库,这个对于部门级或者互联网的数据库应用是必要的,这个时候关键掌握数据库的库结构和 SQL 语言的数据查询能力;
·SQL Server 2005 或更高版本,对中小企业,一些大型企业也可以采用 SQL Server 数据库,其实这个时候本身除了数据存储,也包括了数据报表和数据分析了,甚至数据挖掘工具都在其中了;
·DB2 ,Oracle 数据库都是大型数据库了,主要是企业级,特别是大型企业或者对数据海量存储需求的就是必须的了,一般大型数据库公司都提供非常好的数据整合应用平台;
·BI 级,实际上这个不是数据库,而是建立在前面数据库基础上的,这个主要是数据库的企业应用级了,一般这个时候的数据库都叫数据仓库了, Data Warehouse,建立在 DW 级上的数据存储基本上都是商业智能平台,或许整合了各种数据分析,报表、分析和展现!

数据处理
数据挖掘与数据分析
这个层其实有很多分析工具,当然我们最常用的就是 Excel ,我经常用的就是统计分析和数据挖掘工具;
·Excel 软件,首先版本越高越好用这是肯定的;当然对 Excel 来讲很多人只是掌握了 5%Excel 功能, Excel 功能非常强大,甚至可以完成所有的统计分析工作!但是我也常说,有能力把 Excel 玩成统计工具不如专门学会统计软件;
·SPSS 软件:当前版本是 18 ,名字也改成了 PASW Statistics ;我从 3.0 开始 Dos 环境下编程分析,到现在版本的变迁也可以看出 SPSS 社会科学统计软件包的变化,从重视医学、化学等开始越来越重视商业分析,现在已经成为了预测分析软件。
·Clementine 软件:当前版本 13.0 ,数据挖掘工具,我从 6.0 开始用,到了 13版,已经越来越多的提高了更多有好的建模工具,现在改名叫 PASW Modeler 13 建模器了。而且与 SPSS 统计功能有了更多的整合,数据处理也更加灵活和好用。
·SAS 软件: SAS 相对 SPSS 其实功能更强大, SAS 是平台化的, EM 挖掘模块平台整合,相对来讲, SAS 比较难学些,但如果掌握了 SAS 会更有价值,比如离散选择模型,抽样问题,正交实验设计等还是 SAS 比较好用,另外, SAS 的学习材料比较多,也公开,会有收获的!
当然,我主要是采用 SPSS 和 Clementine ,有时候就是习惯,当然会了一种软件在学其他的也不是很困难!
·JMP 分析: SAS 的一个分析分支
·XLstat : Excel 的插件,可以完成大部分 SPSS 统计分析功能
·Ucinet 社会网分析软件: SNA 社会网络分析是非常流行和有价值的分析工具和方法,特别是从关系角度进行分析社会网络,关系分析非常重要,过去我们都是属性数据分析
大家如果有需要试用版,可以联系博易智讯,他们可以提供 SPSS 和 Clementine 软件版本的咨询。

数据可视化
当企业存储了数据后,首先要解决的报表,还不是分析问题,是要能够看到,看到报表,各种各样的报表!国内外有专门提供报表分析服务的企业和软件。
·Crystal Report 水晶报表, Bill 报表,这都是全球最流行的报表工具,非常规范的报表设计思想,早期商业智能其实大部分人的理解就是报表系统,不借助 IT 技术人员就可以获取企业各种信息 —— 报表。而且很多数据库内置的报表也是采用 CR 报表的开发版嵌入的!
·Tableau 软件,这个软件是近年来非常棒的一个软件,当然它已经不是单纯的数据报表软件了,而是更为可视化的数据分析软件,因为我经常用它来从数据库中进行报表和可视化分析,先暂列在报表层;
这个软件从 3.0 开始,现在已经有了 5.1 版本,两年的时间已经到了服务器和 Web方式了! 当然,如果企业有上万张报表,需要好好管理起来,还有安全性,并发请求等,就需要有 Server 版; 博易智讯公司专门提供 Crystal Report 和 Crystal Report Server 版销售和软件服务;
最近我一直在研究数据可视化技术,一方面是因为 Excel 大家有需求,另一方面就是我第一个购买了 Xcelsius ,也写了《 Excel 高级应用与数据分析》和《数据展现的艺术 ——Xcelsius 》。这个领域的软件,特别是一些小工具非常有价值!

·PowerPoint 软件:这个没得说了,大部分人都是用 PPT 写报告;
·Visio 、 SmartDraw 软件:这些都是非常好用的流程图、营销图表、地图等,而且从这里可以得到很多零件;
·Swiff Chart 软件:制作图表的软件,生成的是 Flash ;
·Color Wheel 软件:配色软件
·Yed 软件:网络关系图、流程图和图形分析软件,类似 SNA 分析,我经常用来设计流程图,还有就是分析优化关系图;
·Netdraw 软件:这是社会网络分析展现软件,主要是可视化网络关系图的,读取 Ucinet 软件;
·Mindmanager 软件:思维导图,非常好的软件,可以把非线性思维很快构建起来,并且项目组织管理、报告设计构想都可以应用,直接生成 PPT 等,当然这个软件功能非常强大,我的学生都用它来做笔记和会议记录;
·Xcelsius 软件: Dashboard 制作和数据可视化报表工具,可以直接读取数据库,在 Excel 里建模,互联网展现,最大特色还是可以在 PPT 中实现动态报表;这个是我最希望应用的一个软件工具,非常有价值!

最后,需要说明的是,我这样的分层分类并不是区分软件,只是想说明软件的应用,其实每个层次的软件都是相互融合的,追求:平台化,整合化,智能化,可视化,专业化,都是各有特色;价格也不同,有免费的,有上百万的;有单机版的,有服务器版的;有正版的,有盗版的!    有时候我们把数据库就用来进行报表分析,有时候报表就是分析,有时候分析就是展现;当然有时候展现就是分析,分析也是报表,报表就是数据存储了!

文章出处:L-我爱数据分析网博客


楼主热帖
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

关闭

站长推荐上一条 /1 下一条

关于我们|小黑屋|Archiver|168大数据 ( 京ICP备14035423号|申请友情链接

GMT+8, 2024-3-29 23:48

Powered by BI168大数据社区

© 2012-2014 168大数据

快速回复 返回顶部 返回列表