在Python中调用ggplot的三种方法

作者:goldensun 时间:2023-08-23 00:40:58 

本文提供了三种不同的方式在Python(IPython Notebook)中调用ggplot。

在大数据时代,数据可视化是一个非常热门的话题。各个BI的厂商无不在数据可视化领域里投入大量的精力。Tableau凭借其强大的数据可视化的功能成为硅谷炙手可热的上市公司。Tableau的数据可视化的产品,其理论基础其实是《The Grammar of Graphic》,该书提出了对信息可视化的图表的语法抽象体系,数据的探索和分析可以由图像的语法来驱动,而非有固定的图表类型来驱动,使得数据的探索过程变得友好而有趣。

然而对于The Grammar of Graphic的理论的实践,并非Tableau独占,ggplot作为R语言上得一个图形库,其理论基础也是这本书。(注,笔者曾就职的某BI巨头,主要职责也是数据可视化,我们曾经和加拿大团队研发过类似的产品,基于HTML5和D3,可惜由于种种原因未能推向市场)

现在越来越多的人开始使用python来做数据分析,IPython Notebook尤其令人喜爱,它的实时交互把脚本语言的优势发挥到极致。那么怎样才能在IPython Notebook中使用ggplot呢?我这里跟大家分享三种不同的方式供大家选择。
RPy2

第一种方式是使用rpy2, rpy2是对rpy的改写和重新设计,旨在提供Python用户在python中使用R的API。

rpy2提供了对R语言的对象和方法的基本封装,当然也包括可视化的图库这一块。

下面就是一段运行ggplot的R程序使用rpy2在python中运行的例子:
 


from rpy2 import robjects
from rpy2.robjects import Formula, Environment
from rpy2.robjects.vectors import IntVector, FloatVector
from rpy2.robjects.lib import grid
from rpy2.robjects.packages import importr, data
import rpy2.robjects.lib.ggplot2 as ggplot2

# The R 'print' function
rprint = robjects.globalenv.get("print")
stats = importr('stats')
grdevices = importr('grDevices')
base = importr('base')
datasets = importr('datasets')

mtcars = data(datasets).fetch('mtcars')['mtcars']

pp = ggplot2.ggplot(mtcars) + \
  ggplot2.aes_string(x='wt', y='mpg', col='factor(cyl)') + \
  ggplot2.geom_point() + \
  ggplot2.geom_smooth(ggplot2.aes_string(group = 'cyl'),
            method = 'lm')
pp.plot()

以上程序在IPython Notebook中运行会有缺陷,会弹出一个新的窗口显示图,而且该python进程会阻塞在那里。我们希望图表能内嵌在IPython Notebook的页面中,为了解决该问题,我们引入如下代码:
 


%matplotlib inline

import uuid
from rpy2.robjects.packages import importr
from IPython.core.display import Image

grdevices = importr('grDevices')
def ggplot_notebook(gg, width = 800, height = 600):
 fn = '{uuid}.png'.format(uuid = uuid.uuid4())
 grdevices.png(fn, width = width, height = height)
 gg.plot()
 grdevices.dev_off()
 return Image(filename=fn)

运行上述代码后,我们把ggplot的调用pp.plot()改为调用ggplot_notebook(pp, height=300)就能成功嵌入显示ggplot的结果。

在Python中调用ggplot的三种方法

RMagic

另一种方式是使用rmagic,rmagicy实际上依赖于rpy2。它的使用方式更像是直接在使用R
 


%load_ext rmagic
library(ggplot2)
dat <- data.frame(x = rnorm(10), y = rnorm(10),
        lab = sample(c('A', 'B'), 10, replace = TRUE))
x <- ggplot(dat, aes(x = x, y = y, color = lab)) + geom_point()
print(x)

运行结果如下

在Python中调用ggplot的三种方法

ggplot for python

ggplot是一个python的库,基本上是对R语言ggplot的功能移植到Python上。

运行安装脚本


pip install ggplot

安装成功后,可以试一下这个例子
 


%matplotlib inline
import pandas as pd
from ggplot import *
meat_lng = pd.melt(meat[['date', 'beef', 'pork', 'broilers']], id_vars='date')
ggplot(aes(x='date', y='value', colour='variable'), data=meat_lng) + \
 geom_point() + \
 stat_smooth(color='red')

结果如下:

在Python中调用ggplot的三种方法

总结

本文提供了三种不同的方式在Python(IPython Notebook)中调用ggplot。

rpy2和Rmagic都是一种对R的桥接,所以都需要安装R。不同之处在于rpy2提供Python接口而Rmagic更接近R。

ggplot Python库是ggplot的Python移植,所以无需安装R,部署起来更为简单,但功能上也许和R的ggplot还有差距。

大家可以根据自己的需要做出选择。

标签:Python
0
投稿

猜你喜欢

  • PHP和NodeJs开发的应用如何共用Session

    2024-06-05 09:43:22
  • python 查看cpu的核数实现

    2023-01-02 21:09:31
  • PHP和JavaScrip分别获取关联数组的键值示例代码

    2023-06-16 05:30:51
  • HTML5的革新:结构之美

    2011-04-16 10:57:00
  • MySQL中如何正确存储IP地址

    2024-01-29 13:34:34
  • 详解Python中的GIL(全局解释器锁)详解及解决GIL的几种方案

    2021-02-01 03:36:05
  • 一文带你了解MySQL中的事务

    2024-01-19 00:21:16
  • ASP强制刷新和判断文件地址是否存在

    2007-09-16 17:11:00
  • 分享4个方便且好用的Python自动化脚本

    2023-05-31 02:20:32
  • MySQL数据库搜索中的大小写敏感性

    2008-11-24 12:44:00
  • Windows下mysql 8.0.29 winx64安装配置方法图文教程

    2024-01-15 14:07:10
  • python对象转字典的两种实现方式示例

    2023-12-06 15:47:05
  • 在VScode里面添加Python解释器的详细步骤

    2021-12-04 16:03:11
  • Pytorch数据读取与预处理该如何实现

    2021-12-23 17:44:35
  • Goland使用Go Modules创建/管理项目的操作

    2024-04-30 10:03:02
  • JavaScript数据结构和算法之图和图算法

    2024-05-03 15:32:34
  • python爬虫爬取网页表格数据

    2023-06-04 08:23:14
  • Pytorch中的model.train() 和 model.eval() 原理与用法解析

    2022-06-06 20:51:04
  • Google Map API 基本使用方法

    2008-06-15 06:51:00
  • python函数装饰器用法实例详解

    2023-09-23 09:40:16
  • asp之家 网络编程 m.aspxhome.com