Разбиение строки в Pandas
У столбца с текстом метод split
через аксессор str режет строку
на части. По умолчанию разделитель -
пробел, и в каждой ячейке получается
список слов.
Создадим таблицу с короткими фразами и выведем ряд списков:
import pandas as pd
data = {
'phrase': ['one two', 'red blue green'],
}
lines = pd.DataFrame(data)
parts = lines['phrase'].str.split()
print(parts) # выведет 0 [one, two]
# 1 [red, blue, green]
# Name: phrase, dtype: object
Индекс строк таблицы сохраняется:
первая ячейка дала два слова, вторая -
три. Сами строки в столбце
phrase не меняются, пока
списки не записывают обратно.
Соберите таблицу с подписями
north wind и south rain
в столбце label. Выведите
ряд списков слов из каждой ячейки.
Создайте таблицу с фразами
big red bus и old green tree
в столбце text. Получите
и выведите разбиение по пробелам.
Из таблицы с кодами alpha beta
и gamma delta в столбце
pair выведите ряд, где
каждая ячейка стала списком
из двух слов.