【发布时间】:2020-02-05 23:38:12
【问题描述】:
我正在尝试将加载在 databricks 中的 R 数据帧转换为 sparklyr 数据帧,但我认为通常使用的 copy_to 函数无法处理文件大小。我需要转换的文件范围为 780MB - 4.7GB。
代码是:
chloedf<-copy_to(sc,Chloe)
并返回错误:
Error in writeBin(utfVal, con, endian = "big", useBytes = TRUE) : Error in writeBin(utfVal, con, endian = "big", useBytes = TRUE) :
attempting to add too many elements to raw vector
Error in writeBin(utfVal, con, endian = "big", useBytes = TRUE) :
attempting to add too many elements to raw vector
In addition: Warning message:
closing unused connection 11 (raw())
【问题讨论】:
标签: r apache-spark-sql databricks sparklyr azure-databricks