首页
学习
活动
专区
圈层
工具
发布
社区首页 >问答首页 >PySpark --将行列表转换为数据帧

PySpark --将行列表转换为数据帧
EN

Stack Overflow用户
提问于 2016-05-01 16:31:17
回答 1查看 12.7K关注 0票数 7

实际上,我要解决的问题是,获取PySpark数据的第一/最后N行,结果是数据。具体来说,我想做这样的事情:

代码语言:javascript
复制
 my_df.head(20).toPandas()

但是,因为head()返回一个行列表,所以我得到了以下错误:

代码语言:javascript
复制
AttributeError: 'list' object has no attribute 'toPandas'

所以,我要么寻找将PySpark数据rows的前N行作为数据返回的方法,要么寻找将这些行列表转换为数据rows的方法。有什么想法吗?

EN

回答 1

Stack Overflow用户

回答已采纳

发布于 2016-05-01 18:25:55

limit

代码语言:javascript
复制
>>> df = sc.parallelize((("a", 1), ("b", 2))).toDF()
>>> df.limit(1).toPandas()
  _1  _2
0  a   1

pd.DataFrame

代码语言:javascript
复制
>>> pd.DataFrame(df.head(1), columns=df.columns)
  _1  _2
0  a   1
票数 9
EN
页面原文内容由Stack Overflow提供。腾讯云小微IT领域专用引擎提供翻译支持
原文链接:

https://stackoverflow.com/questions/36969047

复制
相关文章

相似问题

领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档