#> # 一个 tibble:1,000 × 5 #> a b c d e #>
tibble 的设计目的是在你打印大型数据框时,不会意外地刷屏你的控制台。但有时你需要比默认显示更多的输出。有几个选项可以提供帮助。
首先,你可以显式地调用 print() 来打印数据框,并控制行数(n)和显示的宽度。width = Inf 将显示所有列:
nycflights13::flights %>% print(n = 10, width = Inf)
你还可以通过设置 options 来控制默认的打印行为:
- options(tibble.print_max = n, tibble.print_min = m):如果超过 m 行,则只打印 n 行。使用 options(dplyr.print_min = Inf) 可以始终显示所有行。
- 使用 options(tibble.width = Inf) 可以始终打印所有列,而不受屏幕宽度的限制。
你可以通过 package?tibble 查看该包的帮助文档,以获取完整的选项列表。
最后一个选项是使用 RStudio 内置的数据查看器,以可滚动的方式查看完整数据集。在一长串操作的最后,这也常常很有用:
nycflights13::flights %>% View()
子集选取
到目前为止,你学到的所有工具都是针对完整数据框进行操作的。如果你想提取单个变量,就需要一些新工具:$ 和 [[。[[ 可以按名称或位置提取;$ 只能按名称提取,但输入起来稍微省事一些: