使用 R 和 PostgreSQL 查询列表中的值

Query if value in list using R and PostgreSQL

我有一个这样的数据框

df1

ID  value
1   c(YD11,DD22,EW23)
2   YD34
3   c(YD44,EW23)
4 

而且我想查询另一个数据库以告诉我有多少行中有这些值。这最终将在所有行中循环完成,但现在我只想知道如何为一行执行此操作。

假设数据库如下所示:

sql_database

value  data
YD11   2222
WW20   4040
EW23   2114
YD44   3300
XH29   2040

所以如果我只看第 1 行,我会得到:

dbGetQuery(con,
       sprintf("SELECT * FROM sql_database WHERE value IN %i", 
               df1$value[1]) %>%
  nrow()


OUTPUT:  
2

其他行是:

第 2 行:0

第 3 行:2

第 4 行:0

我不需要创建循环,但因为我的代码不起作用,我想知道如何查询 table 中在 R 列表中具有值的所有行。

你不需要 for 循环。

library(tidyverse)
library(DBI)
library(dbplyr)


df1 <- tibble(
  id = 1:4,
  value = list(c("YD11","DD22","EW23"), "YD34", c("YD44","EW23"), NA)
)

# creating in memory database table
df2 <- tibble(
  value = c("YD11", "WW20", "EW23", "YD44", "XH29"),
  data = c(2222, 4040, 2114, 3300, 2040)
)

con <- dbConnect(RSQLite::SQLite(), ":memory:")
# Add auxilary schema
tmp <- tempfile()
DBI::dbExecute(con, paste0("ATTACH '", tmp, "' AS some_schema"))
copy_to(con, df2, in_schema("some_schema", "some_sql_table"), temporary = FALSE)

# counting rows
df1 %>%
  unnest(cols = c(value)) %>%
  left_join(tbl(con, dbplyr::in_schema("some_schema", "some_sql_table")) %>% collect(), by = "value") %>%
  mutate(data = if_else(is.na(data), 0, 1)) %>%
  group_by(id) %>%
  summarise(n = sum(data))