首页
学习
活动
专区
圈层
工具
发布
首页
学习
活动
专区
圈层
工具
MCP广场
社区首页 >问答首页 >R等价于Stata `Stata,generate( )‘命令

R等价于Stata `Stata,generate( )‘命令
EN

Stack Overflow用户
提问于 2021-01-18 16:51:05
回答 2查看 636关注 0票数 0

我想在R中模拟Stata的tabulate , generate()命令的行为,如下所示;该命令的功能是双重的。首先,在我的例子中,它产生了一个单向频率计数表.其次,它为包含在变量(var1)上的每个值生成虚拟变量,使用选项,generate()中声明的前缀(,generate())来命名生成的虚拟变量(d_1 - d_7)。我的问题是关于第二个功能。R基解决方案是首选,但打包依赖也是受欢迎的。

编辑:我的最终目标是生成一个模拟屏幕上最后一组数据的data.frame()

代码语言:javascript
运行
复制
clear all
input var1 
0
1
2
2
2
2
42
42
777
888
999999
end
tabulate var1 ,gen(d_)

/*     var1 |      Freq.     Percent        Cum.
------------+-----------------------------------
          0 |          1        9.09        9.09
          1 |          1        9.09       18.18
          2 |          4       36.36       54.55
         42 |          2       18.18       72.73
        777 |          1        9.09       81.82
        888 |          1        9.09       90.91
     999999 |          1        9.09      100.00
------------+-----------------------------------
      Total |         11      100.00          */


list, sep(11)



/*   +--------------------------------------------------+
     |   var1   d_1   d_2   d_3   d_4   d_5   d_6   d_7 |
     |--------------------------------------------------|
  1. |      0     1     0     0     0     0     0     0 |
  2. |      1     0     1     0     0     0     0     0 |
  3. |      2     0     0     1     0     0     0     0 |
  4. |      2     0     0     1     0     0     0     0 |
  5. |      2     0     0     1     0     0     0     0 |
  6. |      2     0     0     1     0     0     0     0 |
  7. |     42     0     0     0     1     0     0     0 |
  8. |     42     0     0     0     1     0     0     0 |
  9. |    777     0     0     0     0     1     0     0 |
 10. |    888     0     0     0     0     0     1     0 |
 11. | 999999     0     0     0     0     0     0     1 |
     +--------------------------------------------------+ */
EN

回答 2

Stack Overflow用户

回答已采纳

发布于 2021-01-20 08:34:35

代码语言:javascript
运行
复制
set.seed(123)
df = data.frame(var1 = factor(sample(10, 20, TRUE)))

df = data.frame(df, model.matrix(~0+var1, df)) # 0 here is to suppress the intercept. The smallest value will be the base group--and hence will be dropped. 
names(df)[-1] = paste0('d_', 1:(ncol(df)-1))
df
    var1 d_1 d_2 d_3 d_4 d_5 d_6 d_7 d_8 d_9
1     3   0   1   0   0   0   0   0   0   0
2     3   0   1   0   0   0   0   0   0   0
3    10   0   0   0   0   0   0   0   0   1
4     2   1   0   0   0   0   0   0   0   0
5     6   0   0   0   0   1   0   0   0   0
6     5   0   0   0   1   0   0   0   0   0
7     4   0   0   1   0   0   0   0   0   0
8     6   0   0   0   0   1   0   0   0   0
9     9   0   0   0   0   0   0   0   1   0
10   10   0   0   0   0   0   0   0   0   1
11    5   0   0   0   1   0   0   0   0   0
12    3   0   1   0   0   0   0   0   0   0
13    9   0   0   0   0   0   0   0   1   0
14    9   0   0   0   0   0   0   0   1   0
15    9   0   0   0   0   0   0   0   1   0
16    3   0   1   0   0   0   0   0   0   0
17    8   0   0   0   0   0   0   1   0   0
18   10   0   0   0   0   0   0   0   0   1
19    7   0   0   0   0   0   1   0   0   0
20   10   0   0   0   0   0   0   0   0   1
票数 1
EN

Stack Overflow用户

发布于 2021-01-18 17:44:22

我猜您假设var_1中的每个值都是唯一的,这样就可以得到虚拟变量,而不是d_字段中的计数。

你可以试试这样的方法:

代码语言:javascript
运行
复制
var1 <- 1:5
dummy_matrix <- vapply(var1, function(x) as.numeric(var1 == x), rep(1, 5)) # create a matrix of dummy vars
colnames(dummy_matrix) <- paste0("d_", var1) # name the columns
cbind(var1, dummy_matrix) # bind to var1

输出:

代码语言:javascript
运行
复制
  var1 d_1 d_2 d_3 d_4 d_5
1    1   1   0   0   0   0
2    2   0   1   0   0   0
3    3   0   0   1   0   0
4    4   0   0   0   1   0
5    5   0   0   0   0   1
票数 1
EN
页面原文内容由Stack Overflow提供。腾讯云小微IT领域专用引擎提供翻译支持
原文链接:

https://stackoverflow.com/questions/65778753

复制
相关文章

相似问题

领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档