←
PDF 387 / 520 grid % data\grid(x) %>% add\predictions(mod2) grid #> # A tibble: 4 × 2 #> x pred #> #> 1 a 1.15
→
English · PDF 387
Original PDF page 387
中文 · PDF 387

grid <- sim2 %>% data_grid(x) %>% add_predictions(mod2) grid #> # 一个 tibble:4 × 2 #> x pred #> #> 1 a 1.15 #> 2 b 8.12 #> 3 c 6.13 #> 4 d 1.91

实际上,带有分类变量 x 的模型会为每个类别预测其均值。(为什么?因为均值能使均方根距离最小化。)如果我们将预测值叠加到原始数据上,就很容易看出这一点:

ggplot(sim2, aes(x)) + geom_point(aes(y = y)) + geom_point( data = grid, aes(y = pred), color = "red", size = 4 )

你无法对未观测到的水平进行预测。有时你会不小心这样做,所以最好能识别这个错误信息:

tibble(x = "e") %>% add_predictions(mod2)