Метод unique
Метод unique применяется к Series
и возвращает массив уникальных значений в том порядке,
в котором они впервые встречаются в серии. Этот метод не принимает
параметров и всегда возвращает объект numpy.ndarray.
Синтаксис
ser.unique()
Пример
Давайте получим уникальные значения из серии с повторяющимися элементами:
import pandas as pd
ser = pd.Series([1, 2, 2, 3, 3, 3, 4, 4, 4, 4])
res = ser.unique()
print(res)
Результат выполнения кода:
[1 2 3 4]
Пример
Метод unique работает с сериями, содержащими строки:
import pandas as pd
ser = pd.Series(['abcde', 'article', 'abcde', 'user', 'article', 'data.csv'])
res = ser.unique()
print(res)
Результат выполнения кода:
['abcde' 'article' 'user' 'data.csv']
Пример
Метод unique сохраняет порядок первого появления элементов.
Создадим серию с перемешанными значениями:
import pandas as pd
ser = pd.Series([3, 1, 2, 3, 1, 2, 3, 1, 2])
res = ser.unique()
print(res)
Результат выполнения кода:
[3 1 2]
Пример
Для получения количества уникальных значений используйте метод nunique
вместе с unique:
import pandas as pd
ser = pd.Series([1, 2, 2, 3, 3, 3, 4, 4, 4, 4])
unique_values = ser.unique()
count_unique = len(unique_values)
print(unique_values)
print(count_unique)
Результат выполнения кода:
[1 2 3 4]
4
Смотрите также
-
метод
nunique,
который возвращает количество уникальных значений -
метод
value_counts,
который подсчитывает частоту уникальных значений -
метод
drop_duplicates,
который удаляет дубликаты из серии -
метод
duplicated,
который находит дубликаты в серии