Метод sample
Метод sample применяется к DataFrame
и возвращает случайную выборку строк. Основные параметры:
n - количество строк для выборки,
frac - доля строк для выборки (от 0 до 1),
random_state - для воспроизводимости результатов,
replace - разрешает выборку с повторением.
Если параметры не указаны, возвращается 1 случайная строка.
Синтаксис
df.sample(n=None, frac=None, replace=False, random_state=None)
Пример
Давайте получим 2 случайные строки из таблицы:
import pandas as pd
df = pd.DataFrame({
'a': [1, 2, 3, 4, 5],
'b': [10, 20, 30, 40, 50]
})
print(df.sample(n=2, random_state=42))
Результат выполнения кода:
a b
3 4 40
1 2 20
Пример
Давайте выберем 50% строк с помощью параметра frac:
import pandas as pd
df = pd.DataFrame({
'a': [1, 2, 3, 4, 5],
'b': [10, 20, 30, 40, 50]
})
print(df.sample(frac=0.5, random_state=42))
Результат выполнения кода:
a b
3 4 40
1 2 20
0 1 10
Пример
Давайте выполним выборку с повторением, указав replace=True:
import pandas as pd
df = pd.DataFrame({
'a': [1, 2, 3, 4, 5],
'b': [10, 20, 30, 40, 50]
})
print(df.sample(n=5, replace=True, random_state=42))
Результат выполнения кода:
a b
3 4 40
1 2 20
0 1 10
4 5 50
3 4 40
Пример
Давайте получим случайную строку без указания параметров:
import pandas as pd
df = pd.DataFrame({
'a': [1, 2, 3, 4, 5],
'b': [10, 20, 30, 40, 50]
})
print(df.sample(random_state=42))
Результат выполнения кода:
a b
3 4 40