Вхождение подстроки в Pandas
Чтобы узнать, встречается ли один
фрагмент текста внутри ячейки,
используют метод contains
через аксессор str. Он
возвращает ряд из True и
False: по одному ответу
на каждую строку столбца.
Создадим таблицу с названиями и
построим маску для подстроки
Ap:
import pandas as pd
data = {
'item': ['Apple', 'Banana', 'Apricot'],
}
shop = pd.DataFrame(data)
mask = shop['item'].str.contains('Ap')
print(mask) # выведет 0 True
# 1 False
# 2 True
# Name: item, dtype: bool
Маску можно сразу подставить в квадратные скобки после таблицы и оставить только подходящие строки:
import pandas as pd
data = {
'item': ['Apple', 'Banana', 'Apricot'],
}
shop = pd.DataFrame(data)
mask = shop['item'].str.contains('Ap')
picked = shop[mask]
print(picked) # выведет item
# 0 Apple
# 2 Apricot
Соберите таблицу с командами
North, South и
East в столбце team.
Выведите маску для названий,
где есть буква o.
Создайте таблицу с предметами
Math, Music и
Art в столбце subject.
Покажите только строки, где в
названии встречается Ma.
Из таблицы с городами Paris,
Prague и Rome в столбце
city отберите строки, в
которых название содержит
ra, и выведите таблицу.