Размер группы в Pandas
У каждой группы есть размер - сколько
строк таблицы в неё вошло. Метод
size после группировки считает
именно строки, а не число заполненных
ячеек в каком-то столбце. Строка
с пропуском в числовом поле всё равно
увеличивает размер своей группы.
Создадим таблицу с городами и баллами, в одной строке балл пропущен, и выведем размер каждой группы:
import pandas as pd
data = {
'city': ['M', 'M', 'K', 'K'],
'score': [1, 2, None, 4],
}
exams = pd.DataFrame(data)
groups = exams.groupby('city')
counts = groups.size()
print(counts) # выведет city
# K 2
# M 2
# dtype: int64
Для K и M размер 2,
хотя у K в столбце score
одна ячейка пустая. Это отличает
метод size от подсчёта только
непустых значений в столбце.
Соберите таблицу с отделом и зарплатой, добавьте строку с пропуском в зарплате. Выведите, сколько строк в каждом отделе.
Создайте таблицу с предметом и оценкой на несколько учеников по каждому предмету. Получите сводку по предметам с числом строк в группе и выведите её.
Из таблицы с регионом и температурой выведите для каждого региона размер группы - сколько замеров в таблице относится к этому региону.