РЕПЕТИТОР математика физика информатика
Для школьников и студентов. Подтягивание пробелов. ЦЭ, ЦТ, ОГЭ, ЕГЭ.
Идет набор на ЛЕТО. Жмите для подробностей:)
335 of 687 menu

Функция read_stata

Функция read_stata применяется для чтения файлов формата Stata (.dta) и преобразования их в DataFrame. Первым параметром передаётся путь к файлу или файловый объект. Функция поддерживает чтение файлов Stata версий 117, 118 и 119.

Синтаксис

pd.read_stata(filepath_or_buffer, convert_dates=True, convert_categoricals=True, encoding=None, index_col=None, columns=None, order_categoricals=True, chunksize=None, iterator=False, compression='infer', storage_options=None)

Основные параметры

Рассмотрим ключевые параметры функции:

  • filepath_or_buffer - путь к файлу .dta или файлоподобный объект.
  • convert_dates - преобразовывать ли даты Stata в datetime (по умолчанию True).
  • convert_categoricals - преобразовывать ли категориальные переменные в тип category (по умолчанию True).
  • encoding - кодировка файла (например, 'utf-8').
  • index_col - столбец для использования в качестве индекса.
  • columns - список столбцов для чтения.
  • chunksize - размер чанков для чтения по частям.
  • iterator - возвращать итератор для чанков (работает с chunksize).

Пример

Прочитаем файл Stata и выведем его содержимое:

import pandas as pd df = pd.read_stata('data.dta') print(df.head())

Результат выполнения кода:

id name value 0 101 Alex 25 1 102 Mary 30 2 103 John 22 3 104 Anna 28 4 105 Mike 35

Пример

Прочитаем только определённые столбцы из файла Stata:

import pandas as pd df = pd.read_stata('data.dta', columns=['id', 'value']) print(df)

Результат выполнения кода:

id value 0 101 25 1 102 30 2 103 22 3 104 28 4 105 35

Пример

Укажем столбец в качестве индекса при чтении:

import pandas as pd df = pd.read_stata('data.dta', index_col='id') print(df)

Результат выполнения кода:

name value id 101 Alex 25 102 Mary 30 103 John 22 104 Anna 28 105 Mike 35

Пример

Чтение большого файла по частям с помощью итератора:

import pandas as pd reader = pd.read_stata('large_data.dta', chunksize=2, iterator=True) for chunk in reader: print(chunk) print('---')

Результат выполнения кода:

id name value 0 101 Alex 25 1 102 Mary 30 --- id name value 0 103 John 22 1 104 Anna 28 --- id name value 0 105 Mike 35 ---

Смотрите также

  • функция read_csv,
    которая читает данные из CSV-файла
  • функция read_excel,
    которая читает данные из Excel-файла
  • функция read_json,
    которая читает данные из JSON-файла
  • функция read_sas,
    которая читает данные из файлов SAS
Мы используем cookie для работы сайта, аналитики и персонализации. Обработка данных происходит согласно Политике конфиденциальности.
принять все настроить отклонить