如何在使用R中公式的函数中使用数据框中的变量?

如何解决如何在使用R中公式的函数中使用数据框中的变量?

我正在尝试创建一个函数,对我作为参数提供的任何变量进行t检验。

出于演示目的,我刚刚在牙齿生长数据框中添加了另一列,因为我的原始数据框太大。

library(tidyverse)
library(rstatix) 
library(ggpubr)
df <- ToothGrowth
df$width <- runif(60,min = 5,max = 10)

我试图概括一种在Datanovia上找到的方法,该方法创建了一个类似Grouped Boxplot的分组箱形图。因此,我尝试将代码概括为一个函数:

plotStats <- function(var) {
stat.test <- df %>% group_by(supp) %>% t_test(.data[[var]] ~ dose)
stat.test
}

但是,这是我自己的,而这个演示df我得到了错误消息: 无法提取不存在的列。 x列.data [[var]]不存在。

我正在使用这种方法,因为在更深的地方,我正在探索性数据分析中提取绘图的p值。

这将是我希望工作的功能:

plotStats <- function(var) {
stat.test <- df %>% group_by(supp) %>% t_test(.data[[var]] ~ dose)
stat.test <- stat.test %>% 
  add_xy_position(x = "supp",dodge = 0.8)

ggplot(stats,aes(supp,.data[[var]])) +
  geom_boxplot(aes(fill = dose)) +
  stat_pvalue_manual(
    stat.test,label = "p.adj",tip.length = 0.01,bracket.nudge.y = -2
  ) +
  scale_y_continuous(expand = expansion(mult = c(0,0.1)))
}

plotStats(var = "len")
plotStats(var = "width")

我认为问题可能出在函数中公式的使用上,但似乎无法找到使之起作用的出路。

感谢您的帮助。 亲切的问候 最高

解决方法

这里有一些问题。主要的是正确地进行非标准评估。最好将未引用的列名传递给函数。您可以使用rlang::ensym捕获它们。您可以使用它来构建公式,然后将该公式传递给t_test(然后传递给facet_grid)。您还可以使用双捕获(!!)运算符将这些捕获的变量名传递给ggplot。

更普遍的观察是,最好对函数进行泛化,以使其在其他数据集上起作用,因此请删除函数中的硬编码数据帧和变量名。只需传入您使用的内容即可。

生成所需类型的绘图的通用函数将如下所示:

plotStats <- function(df,var1,var2,var3) 
{
  var1 <- ensym(var1)
  var2 <- ensym(var2)
  var3 <- ensym(var3)
  
  f <- as.formula(paste(as.character(var2),"~",as.character(var3)))
  fac <- as.formula(paste("~",as.character(var1)))
  stat.test <- df %>% 
                 group_by(!!var1) %>% 
                 t_test(f) %>%
                 add_xy_position(step.increase = 0.5)
  
  ggplot(df,aes(x = factor(!!var3),y = !!var2,fill = factor(!!var3))) +
    geom_boxplot() +
    scale_x_discrete(expand = c(0.5,0.5)) +
    facet_grid(fac,switch = "x") +
    geom_bracket(data = stat.test,inherit.aes = FALSE,aes(xmin = group1,xmax = group2,label = p)) +
    labs(fill = as.character(var3),x = as.character(var1)) +
    theme(panel.spacing = unit(0,"points"),strip.placement = "outside",strip.background = element_blank()) 
}

允许:

plotStats(df,supp,width,dose)

enter image description here

plotStats(df,len,dose)

enter image description here

您可以将其应用于其他数据框:

plotStats(mtcars,cyl,wt,am)

enter image description here

我将由您决定调整步长,填充颜色和主题以适合您的需求。

,

这是使这项工作有效的方法。它使用您的var参数构建一个公式对象。另外,优良作法是将函数所需的所有对象/变量作为参数传递(换句话说,不要让函数依赖全局环境中保存的某些东西)。

library(tidyverse)
library(rstatix)
plotStats <- function(df,var) {
  formula <- as.formula(paste(var,"dose"))
  stat.test <-  t_test(data = df %>% group_by(supp),formula)
  stat.test
}

plotStats(df,"width")
# A tibble: 6 x 11
  supp  .y.   group1 group2    n1    n2 statistic    df     p p.adj p.adj.signif
* <fct> <chr> <chr>  <chr>  <int> <int>     <dbl> <dbl> <dbl> <dbl> <chr>       
1 OJ    width 0.5    1         10    10    0.398   17.4 0.695     1 ns          
2 OJ    width 0.5    2         10    10   -0.114   15.0 0.911     1 ns          
3 OJ    width 1      2         10    10   -0.415   16.5 0.683     1 ns          
4 VC    width 0.5    1         10    10   -0.664   16.1 0.516     1 ns          
5 VC    width 0.5    2         10    10   -0.0830  16.2 0.935     1 ns          
6 VC    width 1      2         10    10    0.503   18.0 0.621     1 ns   

plotStats(df,"len")
# A tibble: 6 x 11
  supp  .y.   group1 group2    n1    n2 statistic    df            p      p.adj p.adj.signif
* <fct> <chr> <chr>  <chr>  <int> <int>     <dbl> <dbl>        <dbl>      <dbl> <chr>       
1 OJ    len   0.5    1         10    10     -5.05  17.7 0.0000878    0.000176   ***         
2 OJ    len   0.5    2         10    10     -7.82  14.7 0.00000132   0.00000396 ****        
3 OJ    len   1      2         10    10     -2.25  15.8 0.039        0.039      *           
4 VC    len   0.5    1         10    10     -7.46  17.9 0.000000681  0.00000136 ****        
5 VC    len   0.5    2         10    10    -10.4   14.3 0.0000000468 0.00000014 ****        
6 VC    len   1      2         10    10     -5.47  13.6 0.0000916    0.0000916  **** 

版权声明:本文内容由互联网用户自发贡献,该文观点与技术仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请发送邮件至 dio@foxmail.com 举报,一经查实,本站将立刻删除。

相关推荐


依赖报错 idea导入项目后依赖报错,解决方案:https://blog.csdn.net/weixin_42420249/article/details/81191861 依赖版本报错:更换其他版本 无法下载依赖可参考:https://blog.csdn.net/weixin_42628809/a
错误1:代码生成器依赖和mybatis依赖冲突 启动项目时报错如下 2021-12-03 13:33:33.927 ERROR 7228 [ main] o.s.b.d.LoggingFailureAnalysisReporter : *************************** APPL
错误1:gradle项目控制台输出为乱码 # 解决方案:https://blog.csdn.net/weixin_43501566/article/details/112482302 # 在gradle-wrapper.properties 添加以下内容 org.gradle.jvmargs=-Df
错误还原:在查询的过程中,传入的workType为0时,该条件不起作用 &lt;select id=&quot;xxx&quot;&gt; SELECT di.id, di.name, di.work_type, di.updated... &lt;where&gt; &lt;if test=&qu
报错如下,gcc版本太低 ^ server.c:5346:31: 错误:‘struct redisServer’没有名为‘server_cpulist’的成员 redisSetCpuAffinity(server.server_cpulist); ^ server.c: 在函数‘hasActiveC
解决方案1 1、改项目中.idea/workspace.xml配置文件,增加dynamic.classpath参数 2、搜索PropertiesComponent,添加如下 &lt;property name=&quot;dynamic.classpath&quot; value=&quot;tru
删除根组件app.vue中的默认代码后报错:Module Error (from ./node_modules/eslint-loader/index.js): 解决方案:关闭ESlint代码检测,在项目根目录创建vue.config.js,在文件中添加 module.exports = { lin
查看spark默认的python版本 [root@master day27]# pyspark /home/software/spark-2.3.4-bin-hadoop2.7/conf/spark-env.sh: line 2: /usr/local/hadoop/bin/hadoop: No s
使用本地python环境可以成功执行 import pandas as pd import matplotlib.pyplot as plt # 设置字体 plt.rcParams[&#39;font.sans-serif&#39;] = [&#39;SimHei&#39;] # 能正确显示负号 p
错误1:Request method ‘DELETE‘ not supported 错误还原:controller层有一个接口,访问该接口时报错:Request method ‘DELETE‘ not supported 错误原因:没有接收到前端传入的参数,修改为如下 参考 错误2:cannot r
错误1:启动docker镜像时报错:Error response from daemon: driver failed programming external connectivity on endpoint quirky_allen 解决方法:重启docker -&gt; systemctl r
错误1:private field ‘xxx‘ is never assigned 按Altʾnter快捷键,选择第2项 参考:https://blog.csdn.net/shi_hong_fei_hei/article/details/88814070 错误2:启动时报错,不能找到主启动类 #
报错如下,通过源不能下载,最后警告pip需升级版本 Requirement already satisfied: pip in c:\users\ychen\appdata\local\programs\python\python310\lib\site-packages (22.0.4) Coll
错误1:maven打包报错 错误还原:使用maven打包项目时报错如下 [ERROR] Failed to execute goal org.apache.maven.plugins:maven-resources-plugin:3.2.0:resources (default-resources)
错误1:服务调用时报错 服务消费者模块assess通过openFeign调用服务提供者模块hires 如下为服务提供者模块hires的控制层接口 @RestController @RequestMapping(&quot;/hires&quot;) public class FeignControl
错误1:运行项目后报如下错误 解决方案 报错2:Failed to execute goal org.apache.maven.plugins:maven-compiler-plugin:3.8.1:compile (default-compile) on project sb 解决方案:在pom.
参考 错误原因 过滤器或拦截器在生效时,redisTemplate还没有注入 解决方案:在注入容器时就生效 @Component //项目运行时就注入Spring容器 public class RedisBean { @Resource private RedisTemplate&lt;String
使用vite构建项目报错 C:\Users\ychen\work&gt;npm init @vitejs/app @vitejs/create-app is deprecated, use npm init vite instead C:\Users\ychen\AppData\Local\npm-