Каждая колонка имеет dtype (int64, float64, bool, datetime64, category, object, nullable Int64/boolean/string); неправильный dtype ломает память, сравнения и groupby.
Разбор
astype меняет тип; ошибки при несовместимых значениях.
- object часто = смешанный/строковый мусор — дорого.
- Nullable dtypes (
Int64) сохраняют <NA> без float-cast.
- После CSV проверяйте dtypes явно.
Итог
Dtype — контракт колонки: точность, NA и стоимость операций.