DataFrame.DropDuplicates 方法
定义
重要
一些信息与预发行产品相关,相应产品在发行之前可能会进行重大修改。 对于此处提供的信息,Microsoft 不作任何明示或暗示的担保。
重载
| 名称 | 说明 |
|---|---|
| DropDuplicates(String, String[]) |
返回删除了重复行的新 |
| DropDuplicates() |
返回仅包含此 |
DropDuplicates(String, String[])
返回删除了重复行的新 DataFrame 行,只考虑列的子集。
public Microsoft.Spark.Sql.DataFrame DropDuplicates(string col, params string[] cols);
member this.DropDuplicates : string * string[] -> Microsoft.Spark.Sql.DataFrame
Public Function DropDuplicates (col As String, ParamArray cols As String()) As DataFrame
参数
- col
- String
列名称
- cols
- String[]
其他列名
返回
DataFrame 对象
适用于
DropDuplicates()
返回仅包含此DataFrame行的唯一行的新DataFrame值。
这是 Distinct() 的别名。
public Microsoft.Spark.Sql.DataFrame DropDuplicates();
member this.DropDuplicates : unit -> Microsoft.Spark.Sql.DataFrame
Public Function DropDuplicates () As DataFrame