1、首先需要打开R studio,新建文件脚本,【File】——【New Script】。
2、然后会发现,global environment这里之前代码留下的数据集非常麻烦,清除方法如下:
3、首先,写入 rm(A),即可清除相应object的数据(rm=remove)。
4、对比即可发现,之前的object已经被清除了。
R语言第二章数据处理③删除重复数据果子学生信
1.保留第一个重复: A,A,B,C --->A,B,C
2.去掉所有重复:A,A,B,C --->B,C
一般情况函数默认都是保留第一个重复。
比如:
在R中识别和删除重复数据:
主要运用 dplyr::n()
do包中的duplicate()命令和duplicated()命令的主要区别是前者包含了所有重复项,后者不包含重复的第一项。
duplicate()命令在开发版的do包中,CRAN上的do包并不包含这一命令。
安装方法是devtools:install_github("yikeshu0611/do")
去掉所有重复最简洁函数: df %>% group_by(a) %>% filter(n()==1)