r - 在 R 中查找列表的元素

Question

现在我正在使用 R 中的字符向量，我使用 strsplit 逐字分隔。我想知道是否有一个函数可以用来检查整个列表，看看列表中是否有特定的单词，并且（如果可能的话）说出它在列表的哪些元素中。

前任。

a = c("a","b","c")
b= c("b","d","e")
c = c("a","e","f")

如果z=list(a,b,c), 那么f("a",z)将最优地屈服[1] 1 3, 并且f("b",z)将最优地屈服[1] 1 2

任何帮助都会很棒。

score 28 · Accepted Answer

正如 alexwhan 所说，grep是要使用的功能。但是，请小心将其与列表一起使用。它没有做你可能认为它正在做的事情。例如：

grep("c", z)
[1] 1 2 3   # ?

grep(",", z)
[1] 1 2 3   # ???

幕后发生的事情是将grep其第二个参数强制转换为字符，使用as.character. 当应用于列表时，返回的是通过对其进行解析获得as.character的该列表的字符表示。（取模一个非列表。）

as.character(z)
[1] "c(\"a\", \"b\", \"c\")" "c(\"b\", \"d\", \"e\")" "c(\"a\", \"e\", \"f\")"

cat(as.character(z))
c("a", "b", "c") c("b", "d", "e") c("a", "e", "f")

这就是grep正在进行的工作。

如果要grep在列表上运行，更安全的方法是使用lapply. 这将返回另一个列表，您可以对其进行操作以提取您感兴趣的内容。

res <- lapply(z, function(ch) grep("a", ch))
res
[[1]]
[1] 1

[[2]]
integer(0)

[[3]]
[1] 1


# which vectors contain a search term
sapply(res, function(x) length(x) > 0)
[1]  TRUE FALSE  TRUE

score 14 · Accepted Answer

比 grep 快得多的是：

sapply(x, function(y) x %in% y)

如果您想要索引当然只需使用 which()：

which(sapply(x, function(y) x %in% y))

证据！

x = setNames(replicate(26, list(sample(LETTERS, 10, rep=T))), sapply(LETTERS, list))

head(x)

$A
 [1] "A" "M" "B" "X" "B" "J" "P" "L" "M" "L"

$B
 [1] "H" "G" "F" "R" "B" "E" "D" "I" "L" "R"

$C
 [1] "P" "R" "C" "N" "K" "E" "R" "S" "N" "P"

$D
 [1] "F" "B" "B" "Z" "E" "Y" "J" "R" "H" "P"

$E
 [1] "O" "P" "E" "X" "S" "Q" "S" "A" "H" "B"

$F
 [1] "Y" "P" "T" "T" "P" "N" "K" "P" "G" "P"

system.time(replicate(1000, grep("A", x)))

   user  system elapsed 
   0.11    0.00    0.11 

system.time(replicate(1000, sapply(x, function(y) "A" %in% y)))

   user  system elapsed 
   0.05    0.00    0.05

score 6 · Accepted Answer

6

您正在寻找grep()：

grep("a", z)
#[1] 1 3

grep("b", z)
#[1] 1 2

于 2013-06-28T06:12:36.157 回答

r - 在 R 中查找列表的元素

3 回答 3

Related

Reference