|
1
2
然后,您可以在循环中运行这些“通用模式”,以更正条目:
您需要决定这一点的通用性,也就是说,您只是想在9月份的模式中添加“5ep”,还是应该是“.ep”?但我认为我已经为一项相当复杂的任务提供了相当紧凑的代码。 如果您想使字符位置完全通配符,那么可以在模式中使用句点,例如,您可以决定让任何后跟“ul”的字母在7月份成为可接受的命中率,然后只需将“.ul”添加到该模式字符串中(当然带有“|”管道分隔符)。 -----------旧答案--
我不确定我是否理解,但如果你只是想对月份缩写字母进行“规范化”排序,那么你可以使用
显然,这可以通过factor函数生成一个factor,但可能应该按照正确的顺序设置级别:
|
|
|
2
1
但是,如果您使用的是OCR生成的数据,为什么不在创建要素之前对其进行大量清理呢?下面我修改了我在一个类似项目中使用的一些语法,它并不完美,但你会得到大致的想法。而不是
|
|
3
1
我(还)找不到工作
考虑一个值已知但由于OCR有点中断的列。
然后,我用
把他们统一成一个整体
最后,我将列分解并为每个类别分配正确的标签。
|
|
|
Hard_Course · 用另一列中的值替换行的最后一个非NA条目 1 年前 |
|
Mark R · 使用geom_sf()删除地球仪上不需要的网格线 1 年前 |
|
|
Joe · 根据对工作日和本周早些时候的日期的了解,找到一个日期 1 年前 |
|
Ben · 统计向量中的单词在字符串中出现的频率 1 年前 |
|
|
TheCodeNovice · R中符号格式的尾随零和其他问题[重复] 1 年前 |
|
dez93_2000 · 在R管道子功能中引用管道对象的当前状态 1 年前 |
|
|
Mankka · 如何在Ggplot2中绘制均匀的径向图 1 年前 |