干货推荐｜数据可视化的五个步骤

Catherine • 2017-05-29 09:34 • 交互设计

数据被称作是最新的商业原材料「21世纪的石油」。商业领域、研究领域、技术发展领域使用的数据总量非常巨大，并持续增长。就Elsevier而言，每年从ScienceDirect下载的文章有7亿篇，Scopus上的机构档案有8万个、研究人员档案有 1 千 3 百万，Mendeley上的研究人员档案有 3 百万。对于用户来说，从这个数据海洋中抓到关键信息越来越难。

文章目录[隐藏]

第1步-明确问题
第2步-从基本的可视化着手
第3步-确定最能提供信息指标
第4步-选择正确的图表类型
第5步-将注意力引向关键信息
结论

许多先进的可视化方式(如：网络图、3D 建模、堆叠地图)被用于特定用途，例如 3D 医疗影像、模拟城市交通、救灾监督。但无论一个可视化项目有多复杂，可视化的目的是帮助读者识别所分析的数据中的一种模式或趋势，而不是仅仅给他们提供冗长的描述，诸如：“ 2000 年 A 的利润比 B 高出 2.9 % ，尽管 2001 年 A 的利润增长了 25 % ，但 2001 年利润比 B 低 3.5 % ”。出色的可视化项目应该总结信息，并把信息组织起来，让读者的注意力集中于关键点。

对于 Elsevier’s Analytical Services 的项目而言，我们一直在寻找提升数据分析和可视化的方式。例如，在我们对于研究表现的分析中有大量关于研究合作的数据;我们为 Science Europe 提供的报告(Comparative Benchmarking of European and US Research Collaboration and Researcher Mobility) 包含跨州合作以及国际合作的数据，这些数据不适合直接用二维表和X-Y图展示。

为了探索数据背后的故事，我们使用了网络关系图来识别国家间的合作，并了解每个合作关系的影响。

本文提供一份包含五个步骤的数据可视化指南，为想用表格、图形来传播观察结果、解读分析结果的人士提供帮助。要记住，建立好的可视化项目是一个反复迭代的过程。

第1步-明确问题

开始创建一个可视化项目时，第一步是明确要回答的问题，又或者试着回答下面的问题“这个可视化项目会怎样帮助读者?”

表 1–数据集中的三条记录

图1-槽糕的可视化项目并不澄清事实，而是引人困惑。此图中包含太多变量

清晰的问题可以有助于避免数据可视化的一个常见毛病：把不相干的事物放在一起比较。假设我们有这样一个数据集(见表 1 )，其中包含一个机构的作者总数、出版物总数、引用总数和它们特定一年的增长率。

图1是一个糟糕的可视化案例，所有的变量都被包含在一张表格中。在同一张图中绘制出不同类型的多个变量，通常不是个好主意。

注意力分散的读者会被诱导着去比较不相干的变量。

比如，观察出所有机构的作者总数都少于出版物总数，这没有任何意义，又或者发现 Athena University、Bravo University、Delta Institution 三个研究机构的出版物总数依次增长，也没有意义。拥挤的图表难以阅读、难以处理。在有多个 Y 轴时就是如此，哪个变量对应哪个轴通常不清晰。简而言之，槽糕的可视化项目并不澄清事实而是引人困惑。

第2步-从基本的可视化着手

确定可视化项目的目标后，下一步是建立一个基本的图形。它可能是饼图、线图、流程图、散点图、表面图、地图、网络图等等，取决于手头的数据是什么样子。在明确图表该传达的核心信息时，需要明确以下几件事：

我们试图绘制什么变量?
X 轴和轴代表什么?
数据点的大小有什么含义吗?
颜色有什么含义吗?
我们试图确定与时间有关趋势，还是变量之间的关系?

有些人使用不同类型的图表实现相同目标，但并不推荐这样做。不同类型的数据各自有其最适合的图表类型。

比如，线形图最适合表现与时间有关的趋势，亦或是两个变量的潜在关系。当数据集中的数据点过多时，使用散点图进行可视化会比较容易。

此外，直方图展示数据的分布。直方图的形状可能会根据不同组距改变，见图 2 。(在绘制直方图时，本质是在绘制柱状图来展示特定范围内有多少数据点。这个范围叫做组距。)

图2-当组距变化，直方图的形状也发生变化。

组距太窄会导致起伏过多，让读者只盯着树木却看不到整个森林。此外，你会发现，在完成下一个步骤以后，你可能会想要修改或更换图表类型。

第3步-确定最能提供信息指标

假设我们有另一个关于某研究机构出版物数量的数据库(见表 2 )。可视化过程中最关键的步骤是充分了解数据库以及每个变量的含义。从表格中可以看出，在 A 领域(Subject A)，此机构出版了 633 篇文章，占此机构全部文章的 39% ;相同时间内全球此领域共出版了 27738 篇文章，占全球总量的 44% 。注意，B 列中的百分比累计超过 100% ，因为有些文章被标记为属于多个领域。

在这个例子中，我们想了解此机构在各个领域发表了多少文章。出版数量是一个有用的指标，不仅如此，与下面这些指标对照会呈现出更多信息：

此领域的研究成果总量( B 列)
此领域的全球活跃程度

由此，我们可以确定一个相对活跃指标，1.0 代表全球平均活跃程度。高于 1.0 代表高于全球水平，低于 1.0 代表低于全球水平。用 B 列的数据除以 D 列，得到这个新的指标，见表 2 。

表2-用B列的数据除以D列，得到新的指标：相对活跃程度(E栏)。

第4步-选择正确的图表类型

现在我们可以用雷达图来比较相对活跃指数，并着重观察指数最高/最低的研究领域。例如，此机构在 G 领域的相对活跃指数最高( 1.8 )，但是，此领域的全球总量远远小于其他领域(见图 3 )。雷达图的另一个局限是，它暗示各轴之间存在关系，而在本案例中这关系并不存在(各领域并不相互关联)。

图3-相对活跃指数雷达图

数据的规范化(如本例中的相对活跃指数)是一个很常见也很有效的数据转换方法，但需要基于帮助读者得出正确结论的目的使用。如在此例中，仅仅发现目标机构对某个小领域非常重视没太大意义。

我们可以把出版量和活跃程度在同一个图表中展示，以理解各领域的活跃程度。使用图 4 的玫瑰图，各块的面积表示文章数量，半径长短表示相对活跃指数。注意在此例中，半径轴是二次的(而图 3 中是典型线性的)。图中可以看出，B 领域十分突出，拥有最大的数量(由面积表示)和最高的相对活跃程度(由半径长度表示)。

图4-玫瑰图。此图中各块面积表示文章数量，半径长短表示相对活跃指数(E列)。

第5步-将注意力引向关键信息

用肉眼衡量半径长度可能并不容易。由于在本例中，相对活跃指数的 1.0 代表此领域的全球活跃程度，我们可以通过给出 1.0 的参照值来引导读者，见图 5 。这样很容易看出哪些领域的半径超出参考线。

图5-带有相对活跃指数参考线的玫瑰图

我们还可以使用颜色帮助读者识别出版物最多的领域。如图例所示，一块的颜色深浅由出版物数量决定。为了便于识别，我们还可以把各领域名称作为标签(见图 6 )。

图6-玫瑰图中的颜色深浅代表出版物数量(颜色越亮，出版物越多)

结论

数据可视化的方法有很多。新的工具和图表类型不断出现，每种都试图创造出比之前更有吸引力、更有利于传播信息的图表。我们的建议是记住以下原则：可视化项目应该去总结关键信息并使之更清晰直白，而不应该令人困惑，或用大量的信息让读者的大脑超载。

原作者：Georgin Lau and Lei Pan

翻译：王鹏宇

via:Datartisan数据工匠

原文地址：http://www.36dsj.com/archives/39986

原创文章，作者：Catherine，如若转载，请注明出处：https://www.iamue.com/30542/

中阶产品经理干货数据可视化用户

Catherine

交互小技巧！浅聊四个主流的页面间跳转动效

上一篇 2017-05-29 08:28

从9个方面聊聊用户体验设计的发展

下一篇 2017-05-29 10:25

微信热点

Axure RP 8 入门手册 – 第1章（下）

第2节原型相关的文件类型芝芝：小楼老师，我不小心把软件关闭了，我编辑的文件在哪？小楼：你新建完文件没有保存吗？芝芝：我有生成HTML文件，但是好像不能用软件打开呀？小楼：看在颜值的份上，我给你讲讲吧！与Axure相关的文件有几种类型：分别是“.rp”文件、“.rplib”文件、“.rpprj”文件以及“HTML”文件。“.rp”文件：独立原型项目的源文件，这是最重要的文件，只有这个文件才能进行原型的编辑与输出。“.rpprj”文件：团队...

2018-03-31
微信热点

UI设计、交互、产品、都应该具有这十种思维模式！！

注：文章由集创堂联合创始人CEO纯色老师和设计帮联合出品！这篇文章从十个维度深入挖掘交互设计的思维模式，如果你是UI设计师、初级交互设计师、产品经理、那么这篇文章很值得你学习。笔者在和纯色老师探讨交互设计思维时，老师说“不管你是UI、交互、产品，在团队中都不能是孤立单一的技能，要用联系的观点去看设计，不能分裂来看”。老师说的很对，做UI设计到最后是离不开交互知识支撑的，同样交互、产品也应该具备对设计的审美，这样每一个角色再探讨产品时才...

2018-01-30
交互设计

Apple Watch界面设计规范之UI设计基础（2/2）

六、布局并排放置的按钮数量要控制好。当并排放置按钮时，使用图标来代替标题文案。一行不要放置3个以上，否则按钮的尺寸将会太小，很难被点到。完整利用左右两个边缘之间的全部空间。Apple Watch的边缘斜面会在…

2015-03-10
微信热点

智能窗帘：场景化智能应用让用户体验“懒”生活

科技总是带给我们惊喜。智能家居不再是一个研发层面的概念，在日常生活中已经越来越普及。智能窗帘是智能家居系统中常常被忽视，却又见微知著的家装部分。智能窗帘无需手动，一键掌控家居空间的透光度，智能防紫外线、隔音隔热和保温环保，给用户细致的关怀。智能窗帘的场景化智能应用，让用户体验懒惰带来的享受。冬天清晨，想打开窗帘让阳光温暖房间，却又懒得起身离开暖被窝，使用智能窗帘，应时自动打开，敞开度适宜，光线强弱刚刚好，惬意的在阳光中醒来。炎热夏日，离...

2018-02-25
交互设计

跟着电台动起来：如何设计跑步的垂直场景

没想到吧，你竟然可以通过企鹅FM来跑步？为什么在电台App要深度挖掘一个运动场景，交互设计师又是如何将痛点和需求转化为市场蓝海，在设计的过程中怎样将场景垂直的特色表现出来······关于这些，我有一些想法与大家分享。

2017-05-12
交互设计

客户体验，体验的是什么？

近年来，“客户体验”成了一个很常用的词，但就像“创新”和“设计”一样，你实际上很难给它找到一个众所公认的明确定义，尽管许多企业都将改进客户体验视为一项差异化的竞争优势。可是，如果我们连某种东西的定义都说不清楚，又如何谈得上对其加以改进呢？

2017-05-29
交互设计

五一福利大放送，再不收藏就没有了哦

老板阿西太抠，说了好久才同意五一送福利，今天小编就放血，给大家送点福利，机会不是天天有该出手时就出手。图标和字体想怎么用就怎么就，让设计不再孤单，要的就是这个范儿。字体下载地址：http://pan.baidu.co…

2015-05-01
交互设计

交互设计：给新人设计师的交互设计知识体系

一篇完整阐述系统交互设计知识体系的文章，希望能够对新人设计师建立的设计知识体系有帮助。

2017-05-14
交互设计

UX设计师不得不掌握的心理学技巧

不要让视觉效果过重以至于霸占了整个网页的重心
视频比起文本和图片更容易吸引用户的注意力
女性和孩子的形象更容易吸引用户的注意力
用户浏览页面的视觉轨迹是“F”型的

动机
能力
触发

2017-05-23
交互设计

提高移动应用体验的7个UX设计要点

APP为了提供服务与内容，信用已经成了一种主流方式。但是，在各种服务如雨后春笋般蓬勃发展的市场上，怎样让你的移动应用更有帮助更具关联性，让用户流连忘返就非常有必要了。这一次，我们介绍的是让你的用户获得非常棒的移动应用体验的7个UX设计要点，那么，一起来看看吧。

2017-05-10