←
PDF 148 / 520 Subsetting
→
English · PDF 148
Original PDF page 148
中文 · PDF 148

#> # 一个 tibble:1,000 × 5 #> a b c d e #> #> 1 2016-10-10 17:14:14 2016-10-17 1 0.368 h #> 2 2016-10-11 11:19:24 2016-10-22 2 0.612 n #> 3 2016-10-11 05:43:03 2016-11-01 3 0.415 l #> 4 2016-10-10 19:04:20 2016-10-31 4 0.212 x #> 5 2016-10-10 15:28:37 2016-10-28 5 0.733 a #> 6 2016-10-11 02:29:34 2016-10-24 6 0.460 v #> # ... 还有 994 行

tibble 的设计目的是在你打印大型数据框时,不会意外地刷屏你的控制台。但有时你需要比默认显示更多的输出。有几个选项可以提供帮助。

首先,你可以显式地调用 print() 来打印数据框,并控制行数(n)和显示的宽度。width = Inf 将显示所有列:

nycflights13::flights %>% print(n = 10, width = Inf)

你还可以通过设置 options 来控制默认的打印行为:

  • options(tibble.print_max = n, tibble.print_min = m):如果超过 m 行,则只打印 n 行。使用 options(dplyr.print_min = Inf) 可以始终显示所有行。
  • 使用 options(tibble.width = Inf) 可以始终打印所有列,而不受屏幕宽度的限制。

你可以通过 package?tibble 查看该包的帮助文档,以获取完整的选项列表。

最后一个选项是使用 RStudio 内置的数据查看器,以可滚动的方式查看完整数据集。在一长串操作的最后,这也常常很有用:

nycflights13::flights %>% View()

子集选取

到目前为止,你学到的所有工具都是针对完整数据框进行操作的。如果你想提取单个变量,就需要一些新工具:$ 和 [[。[[ 可以按名称或位置提取;$ 只能按名称提取,但输入起来稍微省事一些: