将%dopar%与自定义函数一起使用_R_Foreach_Parallel Processing

将%dopar%与自定义函数一起使用

r parallel-processing

将%dopar%与自定义函数一起使用,r,foreach,parallel-processing,R,Foreach,Parallel Processing,所以我得到了这个函数，它将来自多个探测器的测量值分组到定义的区域中 HMkit.dmr<-function(Mat,Classes,method.fdr=c("BH","bonferroni"),probe.features) { #Annotate first... require(plyr) require(dplyr) #Filter matrix for testing and stuff... message("Setting up merg

所以我得到了这个函数，它将来自多个探测器的测量值分组到定义的区域中

HMkit.dmr<-function(Mat,Classes,method.fdr=c("BH","bonferroni"),probe.features) {

   #Annotate first...
   require(plyr)
   require(dplyr)


   #Filter matrix for testing and stuff...

   message("Setting up merged table")
   Mat2<-Mat[match(probe.features$probe,rownames(Mat)),]

   #Split by classes

   if(!is.factor(Classes)) {
       Classes<-as.factor(Classes)
   }
   Class.1<-levels(Classes)[[1]]
   Class.2<-levels(Classes)[[2]]

   C1.Mat<-Mat2[,Classes==Class.1]
   C2.Mat<-Mat2[,Classes==Class.2]

   #Summarise and run wilcoxon's test for each dmr...
   num.regions<-length(unique(as.character(probe.features$region.id)))
   pvals.vec<-numeric(length=num.regions)
   unique.regions<-unique(as.character(probe.features$region.id))
   message(num.regions)
   Meds.1<-numeric(length=num.regions);Meds.2<-numeric(length=num.regions)

   for (i in 1:num.regions) {
       region<-probe.features%>%filter(region.id %in% unique.regions[[i]])
       Set1.Mat<-as.numeric(C1.Mat[rownames(C1.Mat) %in% region$probe,])
       Set2.Mat<-as.numeric(C2.Mat[rownames(C2.Mat) %in% region$probe,])
       pvals.vec[[i]]<-wilcox.test(Set1.Mat,Set2.Mat)$p.value
       Meds.1[[i]]<-median(Set1.Mat)
       Meds.2[[i]]<-median(Set2.Mat)
       message(i)
   }

    #Output frame
    dmrs.frame<-data.frame(region=unique.regions,pval=pvals.vec,G1=Meds.1,G2=Meds.2,dB=Meds.1-Meds.2)
    dmrs.frame$q.val<-p.adjust(dmrs.frame$pval,method=method.fdr)
    groups.ids<-levels(Classes)
    return(list(dmrs=dmrs.frame,groups=groups.ids))
}

HMkit.dmr在我看来，您的“for”循环可以轻松地并行化。它只是建立了三个向量，每次迭代一个元素，每个向量将成为“dmrs.frame”的一列。所以每次迭代都是计算一行结果
要使用“foreach”，只需将这三个值连接成一个向量。.combine
选项用于将所有这些向量组合成带有“rbind”的矩阵：
m谢谢你，Steve，工作非常出色-尽管dmrs中的下标。frame@AnkurChakravarthy谢谢你指出这一点。这应该在我现在的回答中得到修正。
Mat<-matrix(runif(200,0,1), ncol=10,nrow=20)
rownames(Mat)<-paste0("p",1:20)
colnames(Mat)<-paste0("S",1:10)

Classes<-as.character(c(rep("G1",6),rep("G2",4)))
probe.features<-data.frame(probe=paste0("p",1:20),region.id=c(rep("R1",5),rep("R2",3),rep("R3",4),rep("R5",4),rep("R6",4))

x<-HMkit.dmr(Mat,Classes,method.fdr=c("BH"),probe.features=probe.features)

 library(doParallel)
 ncores<-2
 Cl<-makeCluster(2)
 registerDoParallel(Cl)
x<-foreach(i=1:length(unique(probe.features$region.id)),packages=c("plyr","dplyr"))%dopar%HMkit.dmr(Mat,Classes,probe.features=probe.features,method.fdr="BH")

m <- foreach(uregion=unique.regions, .combine='rbind',
             .packages=c('plyr', 'dplyr')) %dopar% {
    region<-probe.features%>%filter(region.id %in% uregion)
    Set1.Mat<-as.numeric(C1.Mat[rownames(C1.Mat) %in% region$probe,])
    Set2.Mat<-as.numeric(C2.Mat[rownames(C2.Mat) %in% region$probe,])
    c(wilcox.test(Set1.Mat, Set2.Mat)$p.value,
      median(Set1.Mat), median(Set2.Mat))
}

dmrs.frame <- data.frame(region=unique.regions,
        pval=m[,1] G1=m[,2] G2=m[,3], dB=m[,2]-m[,3])