Просмотр таблицы в Pandas
Строк в таблице может быть сотни и тысячи. Печатать её целиком на экран неудобно: легко потерять нужную деталь среди длинного списка. Обычно сначала смотрят на края - как выглядят первые и последние записи, совпадает ли порядок столбцов с ожиданием.
Параллельно полезна сводка: сколько строк и столбцов, как называются поля, какие типы в ячейках, есть ли пропуски. Для числовых данных отдельно смотрят типичный уровень, разброс, минимум и максимум, чтобы понять масштаб без просмотра каждой строки.
Иногда достаточно случайной небольшой
выборки: она показывает разнообразие
значений и помогает заметить странные
записи. Такой обзор дополняет уже
знакомые атрибуты вроде shape
и dtypes, но не заменяет их.
Со всем этим мы и будем разбираться в рамках данного раздела.