Excel可视化,如何展示一个完整的数据分析?
2020-12-28 14:13:05 阅读(748) 评论(0)
今日本文讲实操,教大家用Excel做一个简单的分析。一是让大家知道数据分析是一个什么样的过程;其次,熟练操作Excel(使用所学知识),包括公式、数据透视表等。在这里,我用Python在智联招聘中爬取了大约1800名BI工程师的工作信息,并用CSV文件保存了工作名称、公司名称、工资、城市、行业、学历要求、工作年限等关键信息。爬行过程不会重复,源数据附加给您,公共账户(数据分析不是一件事)回复“数据”可以获得操作版本:Excel2016,WIN10完整的数据分析需要经历以下步骤:数据获取-我用Python爬;明确分析目的——你得到什么信息,解决什么问题;观察数据-每个数据字段的含义,中英文解释;数据清洗-无效值、缺失值、重复值处理、数据结构是否一致等;分析过程-围绕目的进行分析;制作可视化-制作图表并制作可视化报告。第一,明确目的数据分析的禁忌是不知道分析的方向和目的,拿着一堆数据不知所措。第一,明确目的数据分析的禁忌是不知道分析的方向和目的,拿着一堆数据不知所措。数据用来解决什么问题?汇总统计制作成报表吗?是数据可视化,作为信息图吗?验证某种业务假设?KPI希望提高某一指标?要知道所有的数据分析都是以业务为核心目的,所以要找出业务问题的思考点。关于发现问题的切入点,之前的数据分析思维文章已经讲过了。永远不要试图在一堆数据中找到结论,目标在前面,数据在后面,即使数据是平均比较,也比没有方向好。每一次尝试都会引起进一步的思考,比如为什么这个值这么低,原因在哪里,差异波动的规律是什么...所以,在分析之前,我们不妨先看看我们爬的数据:假设我是BI工程师,我想知道:目前BI工程师的平均工资水平是多少,各地区对BI工程师的需求是多少,哪些地区岗位最多。BI工程师在不同年限的工资差异如何?三年后我的价格是多少?薪水较高的公司有哪些?有了这样的问题,我们的分析就有了方向,后续的过程就是把目标分解成实际的分析和展示。第二,要了解数据概况,首先要看数据。你想要的所有数据都不完整,可以分析哪些数据。主要是看数据字段,了解数据字段的含义:JobName——工作名称Company-公司名称Salary-工资City-城市Jobtype-工作领域Edulevel-学历要求WorkingExp-工作年限要求3.数据清洗,然后进行数据清洗。数据清理一般包括无效值、缺失值和重复值处理;数据是否有乱码和错位;数据口径问题,两张表的相关ID名是否一致;是否有统一的标准或命名,如公司名称的全写或缩写。数据转换是将数据规则为统一格式处理。因为这只是Excel级别的数据分析,而且只是一个简单的数据表,不会有太多复杂的操作。这里简单总结一下。1、缺失值数据会极大地影响分析结果。数据缺失的原因有很多,比如数据采集时,由于技术原因,爬虫并没有完全被捕获。但更多的工作原因是数据存储时没有完全收集,没有填写遗漏,这是数据规范数据治理的话题。一般来说,如果某个字段的数据缺失超过40%~50%,则没有分析意义,考虑删除或采取其他措施。只要在Excel中选择这个列来查看数据是否缺失。edulevel有缺失(1759/1800),但不多,不影响实际分析。2、脏数据处理发现,jobname列中有一些类似BIM工程师的岗位信息,应该是土木工程行业的工程师,爬的时候没有做过滤,包括“bim”“BIOS””BIW”等字段。在这里,我建立了辅助列,设置了判断条件,然后进行筛选和过滤,因为它包含了多个过滤。=IF(OR(COUNTIF“*”“A5”&{“bim”,”BIM”,”BIOS”,”BIW”}&"*"),1,"0"″)公式意味着,如果这些字段中的任何一个都是1,否则就是0。在这里,我们需要筛选结果为0的数据,总共筛选了600多个,数据还是很脏的。数据选项卡中的高级筛选功能也可以用于多重筛选。3、重复数据重复数据通常处理唯一的识别字段,如用户ID、订单ID和公司ID。这些字段代表了这一行中唯一的数据。严格来说,这里的表应该有公司ID字段和数据爬行的问题,所以我懒得再爬了,所以我会重复Company字段。这里有一个快速提示,使用Excel删除重复项功能,快速定位是否有重复数据。删除company列重复项:只剩下562个值。到目前为止,一些脏数据已经基本清理干净。最后,salary有一些“薪资面议”、“校招”的数据,这里也一起过滤掉了。Jobtype过滤掉了汽车、电子等行业,只留下了包括IT互联网行业在内的不到500条数据。4、Salary的工资用几K表示数据再处理,这是文本,不能直接用于计算。而且还是一个范围,后续要按照最高工资和最低工资分成两列。由于城市字段中存储的数据是“城市-区域”格式,如“上海-徐汇区”,为了便于分析每个城市的数据,最终增加了“城市”,截取了“-”前的真实城市数据。为了便于分类,区分原始数据,防止原始数据丢失,将以前处理过的数据复制并粘贴到另一个表中。①将salary分成最高工资和最低工资的工资处理方法有三种。一是直接分列,以“-”为拆分符,获取两列数据,然后用替换功能删除k字符串。得到结果。二是自动填充功能,填充内容自动计算填充所有列。三是利用文本搜索,重点关注这一点。写公式的想法是先找到第一个K的位置,然后-1,去除K。因此,公式是:=LEFT(C2,FIND(“K“,C2,1)-1)同样的想法,最高工资需要用find找到”-“位置,然后截取从”-“到最后第二位的字符串。=MID(C2,FIND(C2,1) 1,LEN(C2)-FIND(C2,1)-1)这里,在新增数据列,平均薪水,来近似代表实际的准确薪资。平均工资=(工资下限) 工资上限)/2,即可获得每个岗位的平均工资。②由于存储在城市字段中的数据是“城市-区域”格式,如“上海-徐汇区”,为了便于分析每个城市的数据,最终增加了“城市”,并在“-”之前拦截了真实的城市数据。=IF(COUNTIF(G2,*-*)=0,G2LEFT(G2,FIND(“-”,G2,1)-1)到目前为止,所有的数据都已经清洗加工完毕,食材都准备好了,下面就可以正式开始数据可视化食品下锅烹饪了。四、分析过程分析过程有很多游戏玩法,因为这里的主要数据是文本格式,数据非常简单,所以倾向于总结统计的计算。若数值型数据较多,则涉及统计、比例等概念。如果有时间数据,就会有趋势和变化的概念。使用数据透视表完成整体分析,首先使用数据透视表获得汇总统计。1、本文简要介绍了BI工程师需求概况分析,增加了增材的区分,增加了数据大小的识别度。(条件格式-色阶)北京、上海、广州、深圳的BI工程师岗位似乎远远超过其他城市,其次是成都、杭州、武汉的梯队。1~3年和3~5年经验差距相当。2、BI工程工资分析每个经验年龄的平均工资状况,差距梯度仍然很明显。目前市场上BI工程的工资主要在7~17K左右。23~26K,应该是5~10年左右经验的岗位。3、随着经验的增长和教育影响力的整体规模,BI工程师大专和本科的工资差异不是很大。经过3~5年的经验,本科课程略有优势。到5~10年,基本拉平,也就是说学历因素影响比例较弱,这个时候更注重经验。其他分析过程没有重复,主要是使用数据透视表和数据透视图进行多维(城市、教育、工作经验)分析,没有其他复杂的技能。关于数据透视图和数据透视表。选择要分析的数据列。2013年以上的Excel基本上智能地帮助您推荐图标并生成透视界面。只要您区分拖动的字段是否到达列,您就可以到达值或行。然后根据情况对多数据进行一定的筛选,因为数据清理不一定很彻底,所以在制作过程中忽略了一些字段的空缺值,回头过滤。最后,一个简单的数据分析基本结束了。由于数据简单,不涉及数据集成、表合并、专业数据统计回归等操作。整个数据分析过程中最耗时的数据清理约占70%。只要目的明确,可视化分析师就很简单。其次,也可以看出,Excel的分析更多的优点是数据的简单处理。通过随机过滤、查询和定位,可以了解数据的概况。然而,在可视化方面,很难选择行列值和制作复杂的图表。总结Excel可视化需要一些时间才能做好。因此,当我进行分析时,基本上就是用Excel看数据全貌,简单处理一下。BI仍将对分析、可视化等进行分析。以后,我会再出一个BI制作的教程。
推荐阅读
- 介绍5款制作游戏的软件
现代人们的生活水平不断提高,对娱乐生活的需求也越来越大,游戏在娱乐产业中的占比也越来越大。很多游戏公司进行了相对的开发调整来适应人们的需求。我给大家介绍5款制作游戏的软件,内容如下: 1.唤境 它是一款可以免费使用的制作游…查看详情
- 介绍几款好玩的软件,既能增长见识又能丰富学识
随着网络时代技术的进步,市面上出现了许多各种功能都app,今天就给大家介绍几款好玩的软件,既能增长见识又能丰富学识,还能把闲暇的时间利用起来,下面就听我给你们一一讲解。 1.过客 可以给陌生人写信,也可以收到陌生人写的信。…查看详情
- 推荐好用的ktv常用软件
很多年轻人下班的时候想要找一个放松自己身心的娱乐方式,都会选择去KTV唱歌。那么此时就必须要用到ktv常用软件,如果不知道怎么选择的话,可以看一下以下的KTV常用软件推荐。 1、kone点歌软件 kone点歌软件算是一个广…查看详情
- 手机桌面软件怎样布局呢?这5种方法可以了解一下
为了方便使用,在手机中通常会有十多款甚至上百款软件,但如果没有良好的布局,寻找的时候难免浪费时间。建议大家选择合适的手机桌面软件布局的方式,可以让软件图标更容易分辨,那么手机桌面软件怎样布局呢?下面几种方法一起来看看吧。 …查看详情
- win10怎么看网线速度
在现代社会中,无法想象一个没有网络的世界。网络是我们生活中重要的一环,它让我们与朋友、家人和世界保持联系,同时也是我们获取知识和信息的主要途径之一。然而,网络速度的快慢对我们的生活和工作产生了很大的影响,因此如何检查和管理网络速度是非常…查看详情
- 江南三大名楼是哪三个?
优质答案(1) 江南三大名楼指的是:江西南昌的滕王阁、湖北武汉的黄鹤楼,湖南岳阳的岳阳楼。作为中国古代中华民族传统建筑艺术独特风格和辉煌成就的杰出代表,象征着中华文明五千年积淀的文化、艺术和传统。亦被文人雅士所称颂。 黄鹤楼,巍峨耸…查看详情
- 自己开发微信小程序收费吗
微信小程序开发价格到底是多少钱? 微信小程序开发要多少钱,要看你的需求和开发方式方式一,“一键生成”的套模板小程序,价格比较低,一般几千元优点是:功能简单,容易操作,快发时间短,能够快速上线缺点是:功能一般无法修改,这种模板小程序是按…查看详情
- 不知道怎么申请域名?这里送你一份域名申请流程!
怎么申请域名?很多人想要注册域名,但碍于域名注册流程不是很懂,从而错失搭建自己网站的机会。很多企业都会有自己的官方网站来展示自己的公司形象,那么建立网站就需要用到域名,很多人会问怎么申请域名,下面小万就来给大家讲解一下域名的注册流程。图片来…查看详情
- 企业推广的主要目的是什么
企业推广的主要目的是通过各种营销手段和渠道来宣传、推广和销售其产品或服务,从而达到以下几个主要目的: 1.增加知名度:企业推广的首要目标是提高品牌的知名度。通过广告、市场活动、社交媒体等方式,企业能够让更多的人了解和认识自己的品牌,从而扩大…查看详情
- 版权登记需要哪些材料?因作品和实际情况不同,所需材料不同
因为互联网的发达,很多作品都会被反反复复的抄袭,为了避免自己的作品遇到这种种情况,很多人都选择通过版权登记的方式来对自己的作品进行保护,在进行版权登记之前,大家需要准备好相关的登记资料,那么版权登记需要哪些材料呢?图片来源于网络 版权登记需…查看详情
- 服务好不好,用户来评价 瑞云服务云智能评价助企业持续提升服务满意度
在互联网和信息化不断发展的今天,企业的可持续发展离不开精细化、智能化的企业运营。如何精准打造用户喜欢的产品,如何持续提升服务质量成为企业管理者们越来越关注的话题。而用户评价,则是获取用户意见的重要途径。 瑞云服务云“服务评价”功能,可以为企…查看详情
- 4款可以随时在线观看电影的软件推荐
如今人们的娱乐生活也丰富了,很多人会在下班后或者节假日去选择看一个电影来放松自己,但是有些电影票可能就比较贵,所以有些人就会选择在线电影软件,很多人不知道,下面是我给大家的介绍。 1.葫芦视频 是当贝与华视网聚合作开发的一款…查看详情
- 高价值电信短信营销 让客户买单!
许多电信短信营销不分时间段、不够尊重客户、随便编写生硬的短信广告就一股脑地进行大批量群发短信,这样的短信营销自然是要被客户反感厌弃的,但是这样短信群发营销方式正被大部分商家所应用着,这就造成了很多商家电信短信营销效果很差的情况。那么如何编写…查看详情
- 搞笑小说大全 幽默搞笑小说排行榜
每个人对于小说的类型都不相同,有的人喜欢看言情小说,有的人喜欢看搞笑小说,那么如果要看搞笑小说的话,是肯定要知道搞笑小说排行榜都有什么的,要从一些火热的小说中去选择,这样的话才不会觉得浪费时间,才不会觉得看着没有意思。 1、…查看详情
- 找工作平台哪个靠谱 2022找工作用什么平台
对于普通上班族,现在外出找工作,一般都选择线上招聘,因为线下的一些人才市场,求职人员比较杂,合适的岗位也有限,可能一天光排队都要大半天,再加上路上折腾,效率不高。 那么,线上找工作,目前找工作平台哪个靠谱,下面万商云集小编就为大家推荐…查看详情
猜你喜欢
最新文章
扫码二维码
立即领取《千元实战营销秘籍》
还可免费试用营销管理系统
*如有疑问,请随时拨打免费咨询热线:400-0033-166
服务时间:8:30-18:00
软件企业
认定号:川RQ-2018-0216
高新技术企业
认定号:GR201951001121
关注微信公众号
和10万中小企业共同成长
扫码下载APP
享全方位服务一触即达
Copyright © 2004-2022 万商云集(成都)科技股份有限公司 版权所有 蜀ICP备12001963号-2 川公网安备 51010402000322号
快速找产品
找一找哪款产品适合您?
咨询热线:400-0033-166
免费查找信息保护中请放心填写-
-
电话沟通
在线咨询
获取方案
下载APP
官方微信
扫码下载APP
全方位服务一触即达
关注万商云集
和10万中小企共成长
TOP
企业首选的数字选用平台