pandas 전처리 완전 정복 — 파일 입출력부터 인덱싱까지 한 번에 잡는 5단계
pandas 전처리의 핵심 5단계를 한 번에 정리했다. CSV·엑셀 파일 입출력부터 결측값 처리, loc·iloc 인덱싱, 조건 필터링, 행·열 삭제까지 — 데이터 분석 전에 반드시 잡아야 할 pandas 전처리 흐름을 실전 코드와 함께 설명한다.

pandas 전처리의 핵심 5단계를 한 번에 정리했다. CSV·엑셀 파일 입출력부터 결측값 처리, loc·iloc 인덱싱, 조건 필터링, 행·열 삭제까지 — 데이터 분석 전에 반드시 잡아야 할 pandas 전처리 흐름을 실전 코드와 함께 설명한다.

판다스 결측치인 NaN·None·NA가 섞인 채 분석하면 결과가 틀리거나 에러가 난다. 각각의 차이, dropna·fillna 사용법, loc·iloc까지 이해하면 AI에게 정확한 데이터 처리를 요청할 수 있게 된다.

pandas 인덱싱에서 loc과 iloc의 차이는 레이블 기준인지 정수 위치 기준인지에 있다. 범위·비연속 접근, 단일값 at·iat, 불리언 필터링까지 각 방법의 쓰임새를 구분해두면 AI에게 정확한 데이터 요청이 가능해진다.

판다스 Series는 값에 인덱스 레이블을 붙인 1차원 구조다. NumPy와의 차이, Series 생성 3가지 방법, 인덱싱, 결측치 처리(isnull·notnull)까지 한 번에 정리한다.