腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
文章
问答
(9999+)
视频
沙龙
0
回答
从
RDD
中
提取
RDD
[(
Array
[
String
]) [(
String
,
Array
[
String
]) [
Spark
/
scala
]
scala
、
apache-spark
、
extract
、
rdd
我有这个问题,我有一个
RDD
[(
String
,ArrayString),我想从中
提取
一个包含按键分组的值的
RDD
[ArrayString]:val x :
RDD
[(
String
,
Array
[
String
]) = (a,
Array
[ "ta&quo
浏览 1
提问于2017-06-06
得票数 0
1
回答
在调用
scala
类方法以逗号拆分字符串时,
Spark
失败
scala
、
apache-spark
class StringSplit(val query:
String
) def getStrSplit(
rdd
:
RDD
[
String
]):
RDD
[
String
]={}我试图调用这个类
中
的方法,例如val st
浏览 1
提问于2015-08-26
得票数 1
回答已采纳
1
回答
Apache火花过滤器
scala
、
apache-spark
Exception in thread "main" java.lang.UnsupportedOperationException: empty collection at org.apache.
spark
.
rdd
.RDDOperationScope$.withScope(RDDOperationSc
浏览 0
提问于2018-10-18
得票数 0
回答已采纳
1
回答
将数组类型的列处理为udf时的
Spark
- java.lang.ClassCastException [数组[Map[
String
,
String
]
scala
、
apache-spark
、
apache-spark-sql
、
user-defined-functions
我连接了
Array
[Map[
String
,
String
]]类型的
spark
中
的两个列,生成了一个新的
Array
[
Array
[Map[
String
,
String
]]]类型的列。但是,我希望将该列展平,以获得一个
Array
[Map[
String
,
String
]]类型的列,其中包含两个原始列的值 我
从
Spark
2.4
中
读到,可以直接在
浏览 30
提问于2020-12-24
得票数 0
回答已采纳
1
回答
将已保存的文本文件
从
星火程序读取到另一个
scala
、
apache-spark
我编写了一个
Spark
程序,它接收一些输入,对数据执行各种操作,在处理结束时,我有一个processedData的类型是
RDD
[( Key,ListData现在,在我刚刚开始编写的另一个程序
中
,我开始对我的输出进行一些统计分析,首先:然而,我的IDE (正确地)认为groupedData是RDDString类型的 告诉编译器/IDE groupedData是
RDD
[(
浏览 4
提问于2015-07-20
得票数 1
回答已采纳
1
回答
串行化星火的Scalaz订单
scala
、
serialization
、
apache-spark
、
scalaz
在本例
中
,我尝试使用类型类来自定义排序星火中的数组。在一个不太完美的例子
中
,我愿意考虑其他的实现。 如果发生这种情况,则必须以可操作和可扩展的方式保持自定义排序和不同的实现。
浏览 6
提问于2016-12-21
得票数 2
回答已采纳
1
回答
在
spark
: org.apache.
spark
.SparkException: Task中使用
scala
的函数或类不可序列化
scala
、
class
、
apache-spark
我刚刚开始学习
scala
和
spark
。这里有一个关于
scala
函数和类的问题:
scala
> class MyClass extends Serializable { |def doStuff(
rdd
:
RDD
[
Str
浏览 0
提问于2016-05-24
得票数 0
1
回答
从
ES
中
获取数据并保存到HDFS作为Avro (火花)
scala
、
apache-spark
、
rdd
我对
Spark
和
Scala
还不熟悉,所以我有一个非常基本的问题。我有
Spark
1.5.2和
Scala
2.10.4。我创建了一个配置,允许我在使用
spark
-shell命令启动--config时直接
从
ES
中
以JSON的形式获取一些数据;我还导入了elasticsearch-hadoop的--jar。就会得到以下结果: res9: Class[_ <: org.apache.
spark
.
rdd
.
RDD
[(
S
浏览 3
提问于2017-05-11
得票数 0
回答已采纳
1
回答
如何将
RDD
[List[
String
]]转换为
RDD
[
String
]
scala
、
apache-spark
我在
scala
中有一个场景,需要将
RDD
[List[
String
]]转换为
RDD
[
String
]。@eric,我能知道为什么这个问题不是主题吗?
浏览 0
提问于2017-06-10
得票数 0
2
回答
值联接不是org.apache.
spark
.
rdd
.
RDD
的成员
scala
、
apache-spark
我得到了这个错误: org.apache.
spark
.
rdd
.
RDD
[(Long, (Int, (Long,
String
,
Array
[_0])))我找到的唯一建议是import org.apache.
spark
.SparkContext编辑:更改代码以消除forSome (即,当对象的类型为o
浏览 1
提问于2015-03-26
得票数 4
回答已采纳
1
回答
如何将数组
中
的每个元素转换为星火中的数组
scala
、
apache-spark
给定具有多行的数据集:如何在火花中产生成果:
Array
(
Array
(
Array
(0),
Array
(1),
Array
(2)),
Array
(
Array
(7),
Array
(8),
Array
(9)),
Array
(
Array
(18),
Array
(19),
Array
(5))
浏览 2
提问于2017-07-18
得票数 0
回答已采纳
2
回答
Array
[Byte]
Spark
字符串
Spark
scala
、
apache-spark
、
hbase
我使用Cloudera的SparkOnHBase模块
从
HBase获取数据。我用这种方式得到了一个
RDD
:基于此,我得到的是一个类型的对象。
RDD
[(
Array
[Byte], List[(
Array
[Byte],
Array
[Byte],
Array
[Byte])])] 它对应于行键和值列表。它们都由一个字节数组表示。,
浏览 4
提问于2015-10-21
得票数 1
回答已采纳
2
回答
星星之弹
Scala
XML如何连接属性
scala
、
apache-spark
我试图用逗号分隔符连接
Scala
中
的XML属性。
scala
> val fileRead = sc.textFile("source_file") fileRead: org.apache.
spark
.
rdd
.
RDD
[
String
] = source_filestrLines: org.apache.
spark
.
rdd
.
RDD
[
String
] = MapPartitionsR
浏览 1
提问于2015-12-09
得票数 0
回答已采纳
2
回答
distinct和map的调用一起在
spark
库
中
抛出NPE
scala
、
nullpointerexception
、
apache-spark
我不确定这是不是一个bug,所以如果你这样做d.distinct().map(x => d.filter(_.equals(x))) 您将获得一个Java
浏览 1
提问于2012-12-08
得票数 7
回答已采纳
2
回答
如何将双倍数组转换为
RDD
[
String
]
scala
、
apache-spark
、
rdd
我需要将
Array
[
Array
[Double]]转换为
RDD
,例如将[[1.1, 1.2 ...], [2.1, 2.2 ...], [3.1, 3.2 ...], ...]转换为val testData =
spark
.sparkContexttestDensit
浏览 6
提问于2017-03-24
得票数 3
回答已采纳
1
回答
如何
从
scala
星火壳
Array
[
String
]读取字符串
scala
我被困在一个需要使用
Scala
的ArrayString来阅读fileRead: org.apache.
spark
.
rdd
.
RDD
(x => x.toString) strLines: org.apache.
spark
.
rdd
.
RDD
[
String
] = MapPartitionsRDD[9] at map
浏览 1
提问于2015-12-08
得票数 2
回答已采纳
1
回答
将
RDD
的值替换为另一个
scala
、
apache-spark
、
rdd
val
rdd
1 = sc.textFile(dataset1).flatMap(l => l.split(","))val result =
rdd
1.zip(
rdd
2).map( x => if(x._1 == "0") x._2 else x._1) 我得到的输出是RDDString但是我需要
RDD
[A
浏览 3
提问于2016-04-28
得票数 0
回答已采纳
4
回答
在
Spark
/
Scala
中将
RDD
转换为Dataframe
scala
、
hadoop
、
apache-spark
RDD
是以
Array
[
Array
[
String
]]格式创建的,具有以下值:
Array
("4580056797", "0"> val rowRDD =
rdd
.map(p =>
Array
(p(0), p(1), p(2),p(3),p(4),p(5)
浏览 8
提问于2015-10-14
得票数 6
回答已采纳
1
回答
抛出任务不可串行化
scala
、
apache-spark
def main(args:
Array
[
String
]): Unit = { .builder:112) at org.apache.
spark
.
rdd
.PairRDDFunctions.combi
浏览 1
提问于2020-03-04
得票数 1
2
回答
运行在星火阵上的
Scala
函数是否并行化?
scala
、
apache-spark
要将函数映射到
RDD
的所有元素,需要首先使用collect方法将
RDD
转换为
Array
类型:x: org.apache.
spark
.
rdd
.
RDD
[List[
String
]] = ParallelCollectionRD
浏览 3
提问于2014-05-21
得票数 2
回答已采纳
点击加载更多
相关
资讯
万字长文,Spark 架构原理和RDD算子详解一网打进!
Spark 核心编程RDD的使用(1)
英雄惜英雄-当Spark遇上Zeppelin之实战案例
Spark 核心编程RDD 行动算子
扩展RDD API三部曲之第二部自定义操作算子
热门
标签
更多标签
云服务器
ICP备案
对象存储
实时音视频
云点播
活动推荐
运营活动
广告
关闭
领券