РЕПЕТИТОР математика физика информатика
Для школьников и студентов. Подтягивание пробелов. ЦЭ, ЦТ, ОГЭ, ЕГЭ.
Идет набор на ЛЕТО. Жмите для подробностей:)
31 of 687 menu

Метод sample

Метод sample применяется к DataFrame и возвращает случайную выборку строк. Основные параметры: n - количество строк для выборки, frac - доля строк для выборки (от 0 до 1), random_state - для воспроизводимости результатов, replace - разрешает выборку с повторением. Если параметры не указаны, возвращается 1 случайная строка.

Синтаксис

df.sample(n=None, frac=None, replace=False, random_state=None)

Пример

Давайте получим 2 случайные строки из таблицы:

import pandas as pd df = pd.DataFrame({ 'a': [1, 2, 3, 4, 5], 'b': [10, 20, 30, 40, 50] }) print(df.sample(n=2, random_state=42))

Результат выполнения кода:

a b 3 4 40 1 2 20

Пример

Давайте выберем 50% строк с помощью параметра frac:

import pandas as pd df = pd.DataFrame({ 'a': [1, 2, 3, 4, 5], 'b': [10, 20, 30, 40, 50] }) print(df.sample(frac=0.5, random_state=42))

Результат выполнения кода:

a b 3 4 40 1 2 20 0 1 10

Пример

Давайте выполним выборку с повторением, указав replace=True:

import pandas as pd df = pd.DataFrame({ 'a': [1, 2, 3, 4, 5], 'b': [10, 20, 30, 40, 50] }) print(df.sample(n=5, replace=True, random_state=42))

Результат выполнения кода:

a b 3 4 40 1 2 20 0 1 10 4 5 50 3 4 40

Пример

Давайте получим случайную строку без указания параметров:

import pandas as pd df = pd.DataFrame({ 'a': [1, 2, 3, 4, 5], 'b': [10, 20, 30, 40, 50] }) print(df.sample(random_state=42))

Результат выполнения кода:

a b 3 4 40

Смотрите также

  • метод head,
    который возвращает первые строки таблицы
  • метод tail,
    который возвращает последние строки таблицы
  • метод nlargest,
    который возвращает строки с наибольшими значениями
  • метод nsmallest,
    который возвращает строки с наименьшими значениями
Мы используем cookie для работы сайта, аналитики и персонализации. Обработка данных происходит согласно Политике конфиденциальности.
принять все настроить отклонить