Python中调用ggplot的三个 方法

来源:未知 浏览 118次 时间 2021-06-01 21:30

在大数据时代数据可视化是一个非常热门的话题。各个BI的厂商无不在数据可视化领域里投入大量的精力。Tableau凭借其强大的数据可视化的功能成为硅谷炙手可热的上市公司。Tableau的数据可视化的产品其理论基础其实是《The Grammar of Graphic》白银网站优化其理论基础其实是《The Grammar of Graphic》该书提出了对信息可视化的图表的语法抽象体系数据的探索和分析可以由图像的语法来驱动而非有固定的图表类型来驱动使得数据的探索过程变得友好而有趣。

然而对于The Grammar of Graphic的理论的实践界首网站优化使得数据的探索过程变得友好而有趣。

在Python中调用ggplot的三种方法

现在越来越多的人开始使用python来做数据分析IPython Notebook尤其令人喜爱它的实时交互把脚本语言的优势发挥到极致。那么怎样才能在IPython Notebook中使用ggplot呢?我这里跟大家分享三种不同的方式供大家选择。
RPy2

第一种方式是使用rpy2, rpy2是对rpy的改写和重新设计旨在提供Python用户在python中使用R的API。

在Python中调用ggplot的三种方法

下面就是一段运行ggplot的R程序使用rpy2在python中运行的例子:

from rpy2 import robjectsfrom rpy2.robjects import Formula, Environmentfrom rpy2.robjects.vectors import IntVector, FloatVectorfrom rpy2.robjects.lib import gridfrom rpy2.robjects.packages import importr, dataimport rpy2.robjects.lib.ggplot2 as ggplot2 # The R 'print' functionrprint = robjects.globalenv.get("print")stats = importr('stats')grdevices = importr('grDevices')base = importr('base')datasets = importr('datasets') mtcars = data(datasets).fetch('mtcars')['mtcars'] pp = ggplot2.ggplot(mtcars) + \ ggplot2.aes_string(x='wt', y='mpg', col='factor(cyl)') + \ ggplot2.geom_point() + \ ggplot2.geom_smooth(ggplot2.aes_string(group = 'cyl'), method = 'lm')pp.plot()

以上程序在IPython Notebook中运行会有缺陷会弹出一个新的窗口显示图而且该python进程会阻塞在那里。我们希望图表能内嵌在IPython Notebook的页面中为了解决该问题我们引入如下代码:

%matplotlib inline import uuidfrom rpy2.robjects.packages import importr from IPython.core.display import Image grdevices = importr('grDevices')def ggplot_notebook(gg, width = 800, height = 600): fn = '{uuid}.png'.format(uuid = uuid.uuid4()) grdevices.png(fn, width = width, height = height) gg.plot() grdevices.dev_off() return Image(filename=fn)

运行上述代码后我们把ggplot的调用pp.plot()改为调用ggplot_notebook(pp, height=300)就能成功嵌入显示ggplot的结果。

RMagic

另一种方式是使用rmagicrmagicy实际上依赖于rpy2。它的使用方式更像是直接在使用R

%load_ext rmagiclibrary(ggplot2)dat - data.frame(x = rnorm(10), y = rnorm(10), lab = sample(c('A', 'B'), 10, replace = TRUE))x - ggplot(dat, aes(x = x, y = y, color = lab)) + geom_point()print(x)

运行结果如下

ggplot for python

ggplot是一个python的库基本上是对R语言ggplot的功能移植到Python上。

运行安装脚本

pip install ggplot

安装成功后可以试一下这个例子

%matplotlib inlineimport pandas as pdfrom ggplot import *meat_lng = pd.melt(meat[['date', 'beef', 'pork', 'broilers']], id_vars='date')ggplot(aes(x='date', y='value', colour='variable'), data=meat_lng) + \ geom_point() + \ stat_smooth(color='red')

结果如下:

总结

本文提供了三种不同的方式在Python(IPython Notebook)中调用ggplot。

rpy2和Rmagic都是一种对R的桥接所以都需要安装R。不同之处在于rpy2提供Python接口而Rmagic更接近R。

ggplot Python库是ggplot的Python移植所以无需安装R部署起来更为简单但功能上也许和R的ggplot还有差距。

标签: ggplot使用import数据