Spark Scala - ML - Kmeans聚类预测列

我想在我的数据集中使用Kmeans算法后在我的数据集中添加预测列,我不知道如何实现这一点。下面是我到目前为止使用的代码(摘自spark文档)case class MyCase(sId: Int, tId:Int, label:Double, sAuthors:String, sYear:Int, s...

flattern scala数组类型列到多列

他们是否有可能在Scala DF中展平阵列?正如我所知,使用列并选择filed.a可行,但我不想手动指定它们。df.printSchema() |-- client_version: string (nullable = true) |-- filed: array (nullable = true...

Scala核心编程 - 进阶

142 课时 |
349 人已学 |
免费
开发者课程背景图

如何重命名scala数据框中的列标题

如何在scala数据帧上执行string.replace(“fromstr”,“tostr”)。据我所知,withColumnRenamed执行替换所有列而不仅仅是标题。

根据spark scala中数据框中的列拆分获取长度

有一个包含文本的“备注”列的数据框。我想通过检查备注列长度来添加新列。例如,如果备注列的长度== 2,我需要拆分($“备注”,“”)(1)。否则我会把备注栏视为原样。例如:remarks =“xxxx yyyy”,我希望count应该是2,如果是这种情况,我需要将yyyy作为我们正在添加的新列中的值...

在Scala Spark中以编程方式将所有特定数据类型列转换为其他数据类型

我正在以编程方式尝试转换列的数据类型并遇到一些编码问题。 我修改了这里使用的代码。 数据>>任何数字都被读作字符串。 代码>> import org.apache.spark.sqlraw_data.schema.fields .collect({case x if x.da...

本页面内关键词为智能算法引擎基于机器学习所生成,如有任何问题,可在页面下方点击"联系我们"与我们沟通。

社区圈子

开发与运维
开发与运维
集结各类场景实战经验,助你开发运维畅行无忧
6411+人已加入
加入
相关电子书
更多
Just Enough Scala for Spark
JDK8新特性与生产-for“华东地区scala爱好者聚会”
JDK8新特性与生产-for“华东地区scala爱好者聚会”
立即下载 立即下载 立即下载