Повторные строки в Pandas
Повторяющиеся строки мешают считать
уникальные записи. Метод
drop_duplicates возвращает
таблицу без копий: при совпадении
всех значений в строке остаётся
первая из таких строк.
Создадим таблицу с одинаковыми строками, уберём повторы и выведем результат:
import pandas as pd
data = {
'city': ['A', 'B', 'A', 'C'],
'temp': [1, 2, 1, 3],
}
weather = pd.DataFrame(data)
unique = weather.drop_duplicates()
print(unique) # выведет city temp
# 0 A 1
# 1 B 2
# 3 C 3
Вторая строка с городом A
и температурой 1 исчезла,
потому что такая же строка уже
была выше. Строка с C осталась.
Соберите таблицу с оценками 4,
5, 4, 3 в столбце
mark и предметами в столбце
subject, где две строки
полностью совпадают. Выведите
таблицу без повторов.
Создайте таблицу учеников с двумя одинаковыми строками. Сохраните вариант, где каждая комбинация полей встречается один раз, и выведите его.
Из таблицы с городами и часовыми поясами уберите полные дубликаты строк и выведите результат.