百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 热门文章 > 正文

R 数据可视化——circlize 简单介绍

bigegpt 2024-10-05 13:42 3 浏览

简单介绍

圆形布局图非常适合表示复杂信息,其中最有名的软件当属 Circos,我们也介绍过 Circos 的配置文件方法。

虽然 Circos 软件很好用,但是它使用的是 perl 语言写的,而且使用的是配置文件的方式来绘制图形,这样就使得数据分析与绘图之间分离开了,造成了很大的不便。

circlizeCircosR 语言实现,但并不是生成 Circos 配置文件的前端封装,而是完全基于 R 语言风格的统计和图形语法实现的。

设计原理

circlize 圆形布局由 sectors(扇形)和 tracks(轨迹)组成。对于数据中的不同分类,会作为不同的 sectors,在圆形布局上看起来就是将圆切割为一个个扇形;而同一个类别的不同维度的观测值,会作为从圆外向圆内不断堆叠的图形轨迹 tracks,即展示的各种数据图形。

例如,对于下面这张图

数据被分为 8sector,即圆形被等分为 8 个扇形区域。

而从圆外到圆内,每个圆环代表一个 track,总共有 5track,添加顺序为点图、直方图、折线图、热图和连接图。

每个 sectortrack 交叠的图块称为一个单元格(或一个网格,一个 panel),是一个绘图区域。

其绘制方式类似于 grid,也是一个个图形添加到图层中,这些图形函数都是 circos.*() 形式,包括一些简单图形函数

  • circos.points(): 添加点
  • circos.lines(): 添加线
  • circos.segments(): 添加线段
  • circos.rect(): 添加矩形
  • circos.polygon(): 添加多边形
  • circos.text(): 添加文本
  • circos.axis()circos.yaxis(): 添加轴

绘制两个位置之间的连接函数

  • circos.link()

一些复杂图形

  • circos.barplot(): 绘制条形图
  • circos.boxplot(): 绘制箱线图
  • circos.violin(): 绘制小提琴图
  • circos.heatmap(): 绘制圆形热图
  • circos.raster(): 绘制光栅图片
  • circos.arrow(): 绘制圆形箭头

一些圆形布局的排布函数

  • circos.initialize(): 分配圆形上的扇形区域
  • circos.track(): 为单元格创建绘图区域
  • circos.update(): 更新修改某一单元格
  • circos.par(): 设置图形参数
  • circos.info(): 输出当前图形的参数
  • circos.clear(): 重置图形参数和内部变量

简单示例

我们先来看一个简单的例子,创建如下数据

n <- 1000
df <- data.frame(
  sectors = sample(letters[1:8], n, replace = TRUE),
  x = rnorm(n), y = runif(n)
)

首先,初始化一个圆形布局,确定扇形区域和 x 轴变量

circos.par("track.height" = 0.1)
circos.initialize(df$sectors, x = df$x)

扇形区域的大小会根据每个类别的数据范围自动计算,默认情况下,扇形的起始位置在极坐标系统 处,并且按顺时针方向排列

同时,我们设置了图形参数 track.height 的值为 0.1,圆形布局的半径为 10.1 表示 10% 的半径长度,即每个轨迹图形的高度设置为半径的 10%

初始化圆形布局之后,还不会显示图形,我们需要将轨迹添加到图片当中。所有轨迹都是通过 circos.track()(或者 circos.trackPlotRegion())函数来添加的。

我们先添加一个轨迹图

circos.track(df$sectors, y = df$y,
             panel.fun = function(x, y) {
               circos.text(CELL_META$xcenter, 
                           CELL_META$cell.ylim[2] + mm_y(7), 
                           CELL_META$sector.index)
               circos.axis(labels.cex = 0.6)
             })

怎么解析上面的代码呢?

在函数 circos.track 中,我们传递了三个参数,其中前两个参数指定了每个扇形区域及轨迹图中的 y 轴数据,panel.fun 参数传递了一个函数,在创建绘图区域时会被调用。

我们再来看看这个函数做了什么事情,首先,使用 circos.text 来绘制文本信息,CELL_META 提供了每个单元格的信息,从其取值的变量名可以看出,xcentercell.ylimsector.index 分别代表的是当前单元格的 x 轴中点、y 轴范围、当前扇形区域的索引。mm_y(7) 表示对 y 轴添加 7mm 的偏移,这样就添加了最外圈的标签 a-h.

circos.axis 表示添加坐标轴,可以看到有圆形最外侧坐标轴刻度。

然后,添加散点图

col <- rep(c("#e41a1c", "#4daf4a"), 4)
circos.trackPoints(df$sectors, df$x, df$y, col = col, pch = 16, cex = 0.5)
circos.text(-1, 0.5, "text", sector.index = "a", track.index = 1)

最后一行,使用 sector.indextrack.index 指定了单元格,在扇形 a 的第一层轨迹内部位置添加了 text 标签

添加第二层轨迹的方式也是一样的,例如,使用 circos.trackHist 添加直方图

bgcol <- rep(c("#fb8072", "#80b1d3"), 4)
circos.trackHist(df$sectors, df$x, bin.size = 0.2, bg.col = bgcol, col = NA)

第三层轨迹,我们随机抽取 12 个数据点来绘制折线

circos.track(df$sectors, x = df$x, y = df$y,
    panel.fun = function(x, y) {
        ind = sample(length(x), 12)
        x2 = x[ind]
        y2 = y[ind]
        od = order(x2)
        circos.lines(x2[od], y2[od], col = "#ff7f00")
})

其中 panel.fun 传递的函数的 xy 分别表示当前单元格的 xy 轴数据点

我们可以使用 circos.update 来修改某一单元格的图形,单元格使用 sector.indextrack.index 来进行定位

circos.update(sector.index = "d", track.index = 2, 
              bg.col = "white", bg.border = "black")
circos.points(x = -2:2, y = rep(0.5, 5), col = "#1f78b4")
circos.text(CELL_META$xcenter, CELL_META$ycenter, "updated", col = "#1f78b4")

虽然我们回到了第二个轨迹,但是还是可以使用 circos.track 来往内侧添加新的轨迹,例如,使用 circos.rect 添加热图

circos.track(ylim = c(0, 1), panel.fun = function(x, y) {
    xlim = CELL_META$xlim
    ylim = CELL_META$ylim
    breaks = seq(xlim[1], xlim[2], by = 0.1)
    n_breaks = length(breaks)
    circos.rect(breaks[-n_breaks], rep(ylim[1], n_breaks - 1),
                breaks[-1], rep(ylim[2], n_breaks - 1),
                col = rainbow(n_breaks), border = NA)
})

在最内层,我们可以添加连接线

circos.link("a", 0, "b", 0, h = 0.4, col = "blue")
circos.link("c", c(-0.5, 0.5), "e", c(-0.5,1), 
            col = "#fb9a99", border = "blue", h = 0.2)
circos.link("f", 0, "g", c(-1,1), col = "#b2df8a", 
            border = "black", lwd = 2, lty = 2)

最后,使用 circos.clear() 来重置所有的图形参数



相关推荐

C#.NET Autofac 详解(c# autoit)

简介Autofac是一个成熟的、功能丰富的.NET依赖注入(DI)容器。相比于内置容器,它额外提供:模块化注册、装饰器(Decorator)、拦截器(Interceptor)、强o的属性/方法注...

webapi 全流程(webapi怎么部署)

C#中的WebAPIMinimalApi没有控制器,普通api有控制器,MinimalApi是直达型,精简了很多中间代码,广泛适用于微服务架构MinimalApi一切都在组控制台应用程序类【Progr...

.NET外挂系列:3. 了解 harmony 中灵活的纯手工注入方式

一:背景1.讲故事上一篇我们讲到了注解特性,harmony在内部提供了20个HarmonyPatch重载方法尽可能的让大家满足业务开发,那时候我也说了,特性虽然简单粗暴,但只能解决95%...

C# 使用SemanticKernel调用本地大模型deepseek

一、先使用ollama部署好deepseek大模型。具体部署请看前面的头条使用ollama进行本地化部署deepseek大模型二、创建一个空的控制台dotnetnewconsole//添加依赖...

C#.NET 中间件详解(.net core中间件use和run)

简介中间件(Middleware)是ASP.NETCore的核心组件,用于处理HTTP请求和响应的管道机制。它是基于管道模型的轻量级、模块化设计,允许开发者在请求处理过程中插入自定义逻辑。...

IoC 自动注入:让依赖注册不再重复劳动

在ASP.NETCore中,IoC(控制反转)功能通过依赖注入(DI)实现。ASP.NETCore有一个内置的依赖注入容器,可以自动完成依赖注入。我们可以结合反射、特性或程序集扫描来实现自动...

C#.NET 依赖注入详解(c#依赖注入的三种方式)

简介在C#.NET中,依赖注入(DependencyInjection,简称DI)是一种设计模式,用于实现控制反转(InversionofControl,IoC),以降低代码耦合、提高可...

C#从零开始实现一个特性的自动注入功能

在现代软件开发中,依赖注入(DependencyInjection,DI)是实现松耦合、模块化和可测试代码的一个重要实践。C#提供了优秀的DI容器,如ASP.NETCore中自带的Micr...

C#.NET 仓储模式详解(c#仓库货物管理系统)

简介仓储模式(RepositoryPattern)是一种数据访问抽象模式,它在领域模型和数据访问层之间创建了一个隔离层,使得领域模型无需直接与数据访问逻辑交互。仓储模式的核心思想是将数据访问逻辑封装...

C#.NET 泛型详解(c# 泛型 滥用)

简介泛型(Generics)是指在类型或方法定义时使用类型参数,以实现类型安全、可重用和高性能的数据结构与算法为什么需要泛型类型安全防止“装箱/拆箱”带来的性能损耗,并在编译时检测类型错误。可重用同一...

数据分析-相关性分析(相关性 分析)

相关性分析是一种统计方法,用于衡量两个或多个变量之间的关系强度和方向。它通过计算相关系数来量化变量间的线性关系,从而帮助理解变量之间的相互影响。相关性分析常用于数据探索和假设检验,是数据分析和统计建模...

geom_smooth()函数-R语言ggplot2快速入门18

在每节,先运行以下这几行程序。library(ggplot2)library(ggpubr)library(ggtext)#用于个性化图表library(dplyr)#用于数据处理p...

规范申报易错要素解析(规范申报易错要素解析)

为什么要规范申报?规范申报是以满足海关监管、征税、统计等工作为目的,纳税义务人及其代理人依法向海关如实申报的行为,也是海关审接单环节依法监管的重要工作。企业申报的内容须符合《中华人民共和国海关进出口货...

「Eurora」海关编码归类 全球海关编码查询 关务服务

  海关编码是什么?  海关编码即HS编码,为编码协调制度的简称。  其全称为《商品名称及编码协调制度的国际公约》(InternationalConventionforHarmonizedCo...

9月1日起,河南省税务部门对豆制品加工业试行新政7类豆制品均适用投入产出法

全媒体记者杨晓川报道9月2日,记者从税务部门获悉,为减轻纳税人税收负担,完善农产品增值税进项税额抵扣机制,根据相关规定,结合我省实际情况,经广泛调查研究和征求意见,从9月1日起,我省税务部门对豆制品...