R hardhat fct_encode_one_hot 将一个因子编码为 one-hot 指标矩阵

fct_encode_one_hot() 将因子编码为one-hot 指示矩阵。

该矩阵由length(x) 行和length(levels(x)) 列组成。矩阵行 i 中的每个值都用 0L 填充，但与 x[[i]] 同名的列除外，该列由 1L 填充。

用法

fct_encode_one_hot(x)

参数

x

一个因子。

x 不能包含缺失值。

x 允许为有序因子。

值

具有 length(x) 行和 length(levels(x)) 的整数矩阵

列。

细节

这些列的返回顺序与 levels(x) 相同。

如果 x 有名称，则名称将作为行名称传播到结果上。

例子

fct_encode_one_hot(factor(letters))
#>       a b c d e f g h i j k l m n o p q r s t u v w x y z
#>  [1,] 1 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0
#>  [2,] 0 1 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0
#>  [3,] 0 0 1 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0
#>  [4,] 0 0 0 1 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0
#>  [5,] 0 0 0 0 1 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0
#>  [6,] 0 0 0 0 0 1 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0
#>  [7,] 0 0 0 0 0 0 1 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0
#>  [8,] 0 0 0 0 0 0 0 1 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0
#>  [9,] 0 0 0 0 0 0 0 0 1 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0
#> [10,] 0 0 0 0 0 0 0 0 0 1 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0
#> [11,] 0 0 0 0 0 0 0 0 0 0 1 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0
#> [12,] 0 0 0 0 0 0 0 0 0 0 0 1 0 0 0 0 0 0 0 0 0 0 0 0 0 0
#> [13,] 0 0 0 0 0 0 0 0 0 0 0 0 1 0 0 0 0 0 0 0 0 0 0 0 0 0
#> [14,] 0 0 0 0 0 0 0 0 0 0 0 0 0 1 0 0 0 0 0 0 0 0 0 0 0 0
#> [15,] 0 0 0 0 0 0 0 0 0 0 0 0 0 0 1 0 0 0 0 0 0 0 0 0 0 0
#> [16,] 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 1 0 0 0 0 0 0 0 0 0 0
#> [17,] 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 1 0 0 0 0 0 0 0 0 0
#> [18,] 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 1 0 0 0 0 0 0 0 0
#> [19,] 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 1 0 0 0 0 0 0 0
#> [20,] 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 1 0 0 0 0 0 0
#> [21,] 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 1 0 0 0 0 0
#> [22,] 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 1 0 0 0 0
#> [23,] 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 1 0 0 0
#> [24,] 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 1 0 0
#> [25,] 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 1 0
#> [26,] 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 1

fct_encode_one_hot(factor(letters[1:2], levels = letters))
#>      a b c d e f g h i j k l m n o p q r s t u v w x y z
#> [1,] 1 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0
#> [2,] 0 1 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0 0

set.seed(1234)
fct_encode_one_hot(factor(sample(letters[1:4], 10, TRUE)))
#>       a b c d
#>  [1,] 0 0 0 1
#>  [2,] 0 0 0 1
#>  [3,] 0 1 0 0
#>  [4,] 0 1 0 0
#>  [5,] 1 0 0 0
#>  [6,] 0 0 0 1
#>  [7,] 0 0 1 0
#>  [8,] 1 0 0 0
#>  [9,] 1 0 0 0
#> [10,] 0 1 0 0

源代码：R/encoding.R

相关用法

注：本文由纯净天空筛选整理自Davis Vaughan等大神的英文原创作品 Encode a factor as a one-hot indicator matrix。非经特殊声明，原始代码版权归原作者所有，本译文未经允许或授权，请勿转载或复制。