Функция read_csv
Функция read_csv используется для чтения данных из CSV-файлов
и преобразования их в объект DataFrame. Основным параметром
передаётся путь к файлу. Дополнительные параметры позволяют
управлять разделителем, заголовками, пропуском строк и другими
аспектами парсинга.
Синтаксис
pd.read_csv(filepath_or_buffer, sep=',', header='infer',
names=None, skiprows=None, nrows=None)
Пример
Прочитаем CSV-файл с данными и выведем его содержимое:
a,b
1,10
2,20
3,30
import pandas as pd
df = pd.read_csv('data.csv')
print(df)
Результат выполнения кода:
a b
0 1 10
1 2 20
2 3 30
Пример
Укажем другой разделитель с помощью параметра sep.
Например, файл с разделителем-точкой с запятой:
a;b
1;10
2;20
3;30
import pandas as pd
df = pd.read_csv('data.csv', sep=';')
print(df)
Результат выполнения кода:
a b
0 1 10
1 2 20
2 3 30
Пример
Зададим имена столбцов вручную с помощью параметра names.
При этом заголовок файла пропускаем через header:
x,y
1,10
2,20
3,30
import pandas as pd
df = pd.read_csv('data.csv', header=0, names=['a', 'b'])
print(df)
Результат выполнения кода:
a b
0 1 10
1 2 20
2 3 30
Пример
Пропустим первые две строки файла с помощью skiprows:
# Это комментарий
# Игнорируем первую строку
a,b
1,10
2,20
3,30
import pandas as pd
df = pd.read_csv('data.csv', skiprows=2)
print(df)
Результат выполнения кода:
a b
0 1 10
1 2 20
2 3 30
Пример
Прочитаем только первые две строки данных с помощью nrows:
a,b
1,10
2,20
3,30
4,40
5,50
import pandas as pd
df = pd.read_csv('data.csv', nrows=2)
print(df)
Результат выполнения кода:
a b
0 1 10
1 2 20
Смотрите также
-
функция
read_table,
которая читает файлы с любым разделителем -
функция
read_excel,
которая читает данные из Excel-файлов -
функция
read_json,
которая читает данные из JSON-файлов -
функция
read_sql,
которая выполняет SQL-запрос и возвращает DataFrame