Spark Scala - ML - Kmeans聚类预测列
我想在我的数据集中使用Kmeans算法后在我的数据集中添加预测列,我不知道如何实现这一点。下面是我到目前为止使用的代码(摘自spark文档)case class MyCase(sId: Int, tId:Int, label:Double, sAuthors:String, sYear:Int, sJournal:String,tAuthors:String, tYear:Int,tJourna....
flattern scala数组类型列到多列
他们是否有可能在Scala DF中展平阵列?正如我所知,使用列并选择filed.a可行,但我不想手动指定它们。df.printSchema() |-- client_version: string (nullable = true) |-- filed: array (nullable = true) | |-- element: struct (containsNull = true) ...
如何重命名scala数据框中的列标题
如何在scala数据帧上执行string.replace(“fromstr”,“tostr”)。据我所知,withColumnRenamed执行替换所有列而不仅仅是标题。
根据spark scala中数据框中的列拆分获取长度
有一个包含文本的“备注”列的数据框。我想通过检查备注列长度来添加新列。例如,如果备注列的长度== 2,我需要拆分($“备注”,“”)(1)。否则我会把备注栏视为原样。例如:remarks =“xxxx yyyy”,我希望count应该是2,如果是这种情况,我需要将yyyy作为我们正在添加的新列中的值。这是我尝试过的代码,但没有得到预期的结果。val df1 = df.withColumn("re....
在Scala Spark中以编程方式将所有特定数据类型列转换为其他数据类型
我正在以编程方式尝试转换列的数据类型并遇到一些编码问题。 我修改了这里使用的代码。 数据>>任何数字都被读作字符串。 代码>> import org.apache.spark.sqlraw_data.schema.fields .collect({case x if x.dataType.typeName == "string" => x.name}) .foldLe...
本页面内关键词为智能算法引擎基于机器学习所生成,如有任何问题,可在页面下方点击"联系我们"与我们沟通。
开发与运维
集结各类场景实战经验,助你开发运维畅行无忧
+关注