pyspark读取指定分隔符文件,dataframe与csv互转

阅读: 评论:0

pyspark读取指定分隔符文件,dataframe与csv互转

pyspark读取指定分隔符文件,dataframe与csv互转

dataframe转csv,并将文件保存至HDFS,然后下载到本地  
dfResult = spark.sql("select * from tmp.lanfz_dirty_imei")
dfResult.write.format("csv").option("header","true").mode("overwrite").save("/user/lanfz/dirty_imei/")
注意:结果目录可能会产生多个文件
提供以下两种方式合并文件,并获取到本地
方式一(适用较大数据量)
dfResult.write.format("csv").option("header","true").mode("overwrite").save("/user/lanfz/dirty_imei/")
hadoop fs -getmerge /user/lanfz/dirty_imei/* dirty_imei.csv
方式二(适用较小数据量)
partition(1).write.format("csv").option("header","true").mode("overwrite").save("/user/lanfz/dirty_imei/")
hadoop fs -get /user/lanfz/dirty_imei/* dirty_imei.csv

csv转dataframe

 
# 默认分隔符为","
df = sp

本文发布于:2024-01-31 09:39:35,感谢您对本站的认可!

本文链接:https://www.4u4v.net/it/170666517627590.html

版权声明:本站内容均来自互联网,仅供演示用,请勿用于商业和其他非法用途。如果侵犯了您的权益请与我们联系,我们将在24小时内删除。

标签:文件   分隔符   pyspark   互转   csv
留言与评论(共有 0 条评论)
   
验证码:

Copyright ©2019-2022 Comsenz Inc.Powered by ©

网站地图1 网站地图2 网站地图3 网站地图4 网站地图5 网站地图6 网站地图7 网站地图8 网站地图9 网站地图10 网站地图11 网站地图12 网站地图13 网站地图14 网站地图15 网站地图16 网站地图17 网站地图18 网站地图19 网站地图20 网站地图21 网站地图22/a> 网站地图23