pd.read_csv парсит файл/буфер в DataFrame: разделитель, encoding, dtype, parse_dates, usecols, na_values — ключевые параметры качества загрузки.
Разбор
sep/delimiter, header, names для нестандартных файлов.
nrows / chunksize для больших файлов.
- Ошибки типов часто из-за смешанных колонок → object.
read_parquet/read_feather предпочтительнее CSV в пайплайнах.
Пример
df = pd.read_csv("data.csv", parse_dates=["ts"], dtype={"id": "Int64"})
Итог
read_csv — точка входа; контролируйте dtype, даты и пропуски на чтении.