R语言 UTF-8各种问题的解决方案

 更新时间:2021年04月17日 11:30:35   作者:snowdroptulip  
这篇文章主要介绍了R语言 UTF-8各种问题的解决方案,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧

R语言在碰到读UTF-8文件,或者处理UTF-8数据时总是会遇到各种各样的问题,本姑娘也是在碰了n多次壁,被气得吐血好多次之后,终于对这类总结出了一些解决办法:

1. 读UTF-8文件,例如UTF-8格式的csv:

最好的处理办法就是:

a1=read.table('C:\\test11.csv',sep=',',fileEncoding = 'UTF-8',header = F)

如果使用如下方法可能会出错(全是血泪教训啊):

a2=read.csv('C:\\test11.csv',fileEncoding = 'UTF-8',header = F)
a2=read.csv('C:\\test11.csv',encoding = 'UTF-8',header = F)

2. 如何在R里把一个数据转化为UTF-8格式:

因为我在R里写了一段程序,需要把数据转化为JSON格式,通过上面的方法读进来的数据是没有问题,但是数据再R里并不是utf-8格式存储的,所以toJSON()时报了如下错误:

unable to escape string. String is not utf8

后来发现R里有一个函数可以把数据转为utf8格式:enc2utf8()

> a='小源'
> Encoding(a)#查看a的编码格式
[1] "unknown"
> b=enc2utf8(a)
> Encoding(b)
[1] "UTF-8"

3. 如何SOURCE一个UTF-8格式的R文件:

source一个utf8编码保存的R脚本,在windows下(linux由于默认编码就是utf8,直接source就可以)

source('test.R',encoding = 'UTF-8')

补充:mac系统csv乱码_R语言写入UTF-8格式CSV乱码解决办法

中文编码方式有GBK(GB2312)和UTF-8两种。

由于区域设置问题,在Windows系统下,Excel程序默认用GBK格式读取CSV文件。

因此会导致乱码。

如下图所示:

eb163b05995ec24dd3c026ef2a1c76bf.png

解决的办法是用tidyverse包中的write_excel_csv()函数。

下面上代码:

library(tidyverse)
x <- c('好好地', '针对是棒极啦', '哈好好好好好爱吼吼吼啊', '啊')
y <- c(1, 2, 3, 4)
z <- c('haha', 'hehe', 'hoho', 'lala')
xyz_tbl <- tibble(x,y,z)
        read_csv(file = 'data1.csv', )
#乱码
write.csv(xyz_tbl,'data_old.csv',row.names = T,fileEncoding='UTF-8')
#再次乱码
write_csv(xyz_tbl, 'data.csv')
#解决问题
write_excel_csv(xyz_tbl, 'data_ex.csv')
#以上文件用R读取都没问题
read_csv(file = 'data.csv')
read_csv(file = 'data_ex.csv')
read_csv(file = 'data_old.csv')

50379635e55fa90a3e6ca3a1e03204a2.png

原数据

3eaf7b79d1df09ea9d48bb785f391c3c.png

data.csv

436a7bb6de0de69e2e81f7c9de54d95d.png

data_ex.csv

56c00a36b452d70dde655a0447c360c0.png

data_old.csv

以上为个人经验,希望能给大家一个参考,也希望大家多多支持脚本之家。如有错误或未考虑完全的地方,望不吝赐教。

相关文章

  • R语言数据类型与相应运算的实现

    R语言数据类型与相应运算的实现

    本文主要介绍了R语言数据类型与相应运算的实现,文中通过示例代码介绍的非常详细,具有一定的参考价值,感兴趣的小伙伴们可以参考一下
    2022-03-03
  • 详解R语言caret包trainControl函数

    详解R语言caret包trainControl函数

    这篇文章主要介绍了R语言caret包trainControl函数详解,本文通过源码分析给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友可以参考下
    2022-08-08
  • R语言关于数据帧的知识点详解

    R语言关于数据帧的知识点详解

    在本篇文章里小编给大家整理的是一篇关于R语言关于数据帧的知识点详解内容,有兴趣的朋友们可以学习下。
    2021-04-04
  • R语言ggplot2图例标签、标题、顺序修改和删除操作实例

    R语言ggplot2图例标签、标题、顺序修改和删除操作实例

    R语言中画图时我们常常要设定标题,如果图片标题是固定则很容易操作,下面这篇文章主要给大家介绍了关于R语言ggplot2图例标签、标题、顺序修改和删除操作的相关资料,需要的朋友可以参考下
    2022-07-07
  • R语言中ifelse、which、%in%的用法详解

    R语言中ifelse、which、%in%的用法详解

    这篇文章主要介绍了R语言中ifelse、which、%in%的用法详解,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧
    2021-04-04
  • vscode配置R语言debugger环境:'vscDebugger"的安装方法

    vscode配置R语言debugger环境:'vscDebugger"的安装方法

    在R中安装vscDebugger包可以通过两种方法:第一种是使用Visual Studio Code的命令面板自动安装,操作简便,第二种是手动在R控制台中安装,这两种方法都可以有效地安装vscDebugger包,进而帮助用户在R语言中进行代码调试,更多详细步骤和信息可以参考相关教程或文章
    2024-10-10
  • R语言ggplot2之图例的设置

    R语言ggplot2之图例的设置

    这篇文章主要介绍了R语言ggplot2之图例的设置方式,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧
    2021-04-04
  • R语言实现导出矩阵

    R语言实现导出矩阵

    这篇文章主要介绍了R语言实现导出矩阵,具有很好的参考价值,希望对大家有所帮助。一起跟随小编过来看看吧
    2021-04-04
  • R语言作图之直方图histogram绘制过程详解

    R语言作图之直方图histogram绘制过程详解

    这篇文章主要介绍了R语言作图之直方图histogram详解,本文给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友可以参考下
    2021-03-03
  • R语言条形图创建方法

    R语言条形图创建方法

    在本篇文章里小编给大家整理的是一篇关于R语言条形图创建方法,有需要的朋友们可以跟着学习参考下。
    2021-04-04

最新评论