问答 2018-12-21 来自:开发者社区

Spark Scala - ML - Kmeans聚类预测列

我想在我的数据集中使用Kmeans算法后在我的数据集中添加预测列,我不知道如何实现这一点。下面是我到目前为止使用的代码(摘自spark文档)case class MyCase(sId: Int, tId:Int, label:Double, sAuthors:String, sYear:Int, sJournal:String,tAuthors:String, tYear:Int,tJourna....

问答 2018-12-19 来自:开发者社区

flattern scala数组类型列到多列

他们是否有可能在Scala DF中展平阵列?正如我所知,使用列并选择filed.a可行,但我不想手动指定它们。df.printSchema() |-- client_version: string (nullable = true) |-- filed: array (nullable = true) | |-- element: struct (containsNull = true) ...

问答 2018-12-12 来自:开发者社区

如何重命名scala数据框中的列标题

如何在scala数据帧上执行string.replace(“fromstr”,“tostr”)。据我所知,withColumnRenamed执行替换所有列而不仅仅是标题。

问答 2018-12-06 来自:开发者社区

根据spark scala中数据框中的列拆分获取长度

有一个包含文本的“备注”列的数据框。我想通过检查备注列长度来添加新列。例如,如果备注列的长度== 2,我需要拆分($“备注”,“”)(1)。否则我会把备注栏视为原样。例如:remarks =“xxxx yyyy”,我希望count应该是2,如果是这种情况,我需要将yyyy作为我们正在添加的新列中的值。这是我尝试过的代码,但没有得到预期的结果。val df1 = df.withColumn("re....

问答 2018-12-05 来自:开发者社区

在Scala Spark中以编程方式将所有特定数据类型列转换为其他数据类型

我正在以编程方式尝试转换列的数据类型并遇到一些编码问题。 我修改了这里使用的代码。 数据>>任何数字都被读作字符串。 代码>> import org.apache.spark.sqlraw_data.schema.fields .collect({case x if x.dataType.typeName == "string" => x.name}) .foldLe...

本页面内关键词为智能算法引擎基于机器学习所生成,如有任何问题,可在页面下方点击"联系我们"与我们沟通。

开发与运维

集结各类场景实战经验,助你开发运维畅行无忧

+关注
AI助理

你好,我是AI助理

可以解答问题、推荐解决方案等