←
PDF 152 / 520 - read\fwf() reads fixed-width files. You can specify fields either by their widths with fwf\wid
→
English · PDF 152
Original PDF page 152
中文 · PDF 152
  • read_fwf() 读取固定宽度文件。你可以通过 fwf_widths() 指定字段的宽度,或通过 fwf_positions() 指定字段的位置。read_table() 读取固定宽度文件的一种常见变体,其列由空白字符分隔。
  • read_log() 读取 Apache 风格的日志文件。(也可以看看 webreadr,它构建在 read_log() 之上,提供了更多有用的工具。)

这些函数都有相似的语法:一旦掌握了其中一个,就可以轻松使用其他函数。在本章的剩余部分,我们将重点介绍 read_csv()。CSV 文件不仅是最常见的数据存储形式之一,而且一旦理解了 read_csv(),你就可以轻松地将所学知识应用到 readr 中的所有其他函数上。

read_csv() 的第一个参数最重要;它是要读取的文件的路径:

heights <- read_csv("data/heights.csv") #> Parsed with column specification: #> cols( #> earn = col_double(), #> height = col_double(), #> sex = col_character(), #> ed = col_integer(), #> age = col_integer(), #> race = col_character() #> )

当你运行 read_csv() 时,它会打印出一个列规范,给出每列的名称和类型。这是 readr 的一个重要部分,我们将在第 137 页的“解析文件”一节中再回到这个话题。

你还可以提供内联的 CSV 文件。这对于试验 readr 以及创建可与他人分享的可复现示例非常有用:

read_csv("a,b,c 1,2,3 4,5,6") #> # A tibble: 2 × 3 #> a b c #> #> 1 1 2 3 #> 2 4 5 6*