a) 我在第4列的所有行都有相同的字串。
b) 我試圖對這個字串進行重新排序。
c) 每一行都被分為8組,從strsplit開始。
c) 從strsplit中,每一行都被分成8組。
d) 我想為這一列的所有行重新排序(同樣的重新排序方式)。
我試過這個腳本... 我只是找不到要在[[?]]中插入什么。 我試了一下行的數量和列的名稱... 但還是不能改變列的順序......。 我應該在[[?]]的位置插入什么來使它作業,為該列的所有行排序? 有什么建議嗎?
df
dput(df[1: 4, ])
結構(list(V1 = c("chr1"。 "chr1"。 "chr1", "chr1")。 V2 = 3003641。 3003644,
V3 = 3003650。 3003653, V4 = c("Class=C2H2. 鋅.指.因子;家族=3個以上 .相鄰的鋅.指.因子;strand=-;id=ZNF449.Me9548.1.YY2017.HT-SE2;seq=CCCCCC;score=10.4571;pval=8.34e-05;Averageconservationscore=NA",
"Class=C2H2.zinc.finger.factors;Family=More.three .相鄰.鋅.指.因子;strand=-;id=ZNF449.Me9548.1.YY2017.HT-SE2;seq=CCCCCC;score=10.4571;pval=8.34e-05;Averageconservationscore=NA",
"Class=C2H2.zinc.finger.factors;Family=More.three .相鄰.鋅.指.因子;strand=-;id=ZNF449.Me9548.1.YY2017.HT-SE2;seq=CCCCCC;score=10.4571;pval=8.34e-05;Averageconservationscore=NA",
"Class=C2H2.zinc.finger.factors;Family=More.three.neighly.zinc.finger.factors;strand=-;id=ZNF449.Me9548.1.YY2017.HT-SE2;seq=ACCCCCCC;score=10.8429;pval=6.74e-05;Averageconservationscore=NA"
)。 V5 = c(0L。 0L, 0L。 0L)),行。 names = c(NA。 4L), class = "data. frame")
script
df$V4 < - strsplit(df$V4, '[, ]')
df$V4 <- df$V4[ ? ]][c(1。 2, 4。 3,5,6。 7,8)】
order col4 before (id after strand)
類=C2H2.zinc.finger.factors;族=多于.3 .相鄰的.鋅.指.因子;鏈=-;id=YY1.Ca9487.2.YY2017. HT-SE2;seq=AGCCATCTTGTCTCACGAGTCCA; score=5. 57576;pval=8.28e-05;Averageconservationscore=NA
order col4 after (id before strand)
類=C2H2.zinc.finger.factors;族=多于.3 .相鄰.鋅.指.因子;id=YY1.Ca9487.2.YY2017. HT-SE2;strand=-; seq=AGCCATCTTGTCTCACGAGTCCA;core=5. 57576;pval=8.28e-05;Averageconservationscore=NA
uj5u.com熱心網友回復:
使用strsplit來分割字串,sapply來重新排序并粘貼回字串。
df$V4 < - sapply(strsplit(df$V4, ' ; ',固定= TRUE)。 function(x)
paste0(x[c(1。 2,4, 3。 5, 6, 7, 8)],崩潰= ' 。 '))
轉載請註明出處,本文鏈接:https://www.uj5u.com/qukuanlian/307835.html
標籤:
