Введение в Pandas
Давайте познакомимся с библиотекой pandas. Это популярная библиотека Python для работы с табличными данными: строками, столбцами и подписями к ним. Такой вид данных часто встречается в отчётах, списках учеников, продажах по дням и других задачах, где важны и сами значения, и их место в таблице.
В основе pandas лежит таблица - набор строк одной длины, у каждой строки есть номер или метка, у каждого столбца - имя. Одна ячейка однозначно определяется строкой и столбцом, поэтому данные легко читать и сравнивать.
Список списков в Python тоже может хранить таблицу, но без имён столбцов и без удобных меток строк приходится помнить, какой индекс за что отвечает. Добавить столбец или отфильтровать строки по условию получается громоздко и легко ошибиться.
Вы уже знакомы с NumPy: там удобно считать над массивами чисел одного типа. Но массив - это сетка значений без имён столбцов и без подписей строк в привычном табличном виде. Для анализа, где столбец «цена» или «город» имеет смысл, одного массива часто недостаточно.
Со всем этим мы и будем разбираться в рамках данного учебника. Давайте приступим:)