Функция unique
Функция unique применяется к Series
или Index и возвращает массив уникальных
значений в порядке их первого появления.
В отличие от метода drop_duplicates,
возвращается именно массив numpy.ndarray,
а не объект Series.
Синтаксис
Series.unique()
Пример
Давайте получим уникальные значения из серии:
import pandas as pd
ser = pd.Series([1, 2, 2, 3, 3, 3, 4, 5])
res = ser.unique()
print(res)
Результат выполнения кода:
[1 2 3 4 5]
Пример
Давайте получим уникальные строковые значения из серии:
import pandas as pd
ser = pd.Series(['abcde', 'article', 'abcde', 'user', 'user'])
res = ser.unique()
print(res)
Результат выполнения кода:
['abcde' 'article' 'user']
Пример
Давайте применим функцию unique к индексу:
import pandas as pd
df = pd.DataFrame({
'a': [1, 2, 3, 4, 5],
'b': [10, 20, 30, 40, 50]
}, index=[1, 1, 2, 3, 3])
res = df.index.unique()
print(res)
Результат выполнения кода:
[1 2 3]
Пример
Давайте получим уникальные значения из столбца таблицы:
import pandas as pd
df = pd.DataFrame({
'a': [1, 2, 2, 3, 3],
'b': [10, 20, 20, 30, 40]
})
res = df['b'].unique()
print(res)
Результат выполнения кода:
[10 20 30 40]
Смотрите также
-
функция
to_numeric,
которая преобразует данные к числовому типу -
функция
is_integer_dtype,
которая проверяет, является ли тип целочисленным -
функция
is_string_dtype,
которая проверяет, является ли тип строковым -
функция
show_versions,
которая выводит информацию о версиях библиотек