익명 사용자
로그인하지 않음
토론
기여
계정 만들기
로그인
IT 위키
검색
파이썬 pandas DataFrame
편집하기
IT 위키
이름공간
문서
토론
더 보기
더 보기
문서 행위
읽기
편집
원본 편집
역사
경고:
로그인하지 않았습니다. 편집을 하면 IP 주소가 공개되게 됩니다.
로그인
하거나
계정을 생성하면
편집자가 사용자 이름으로 기록되고, 다른 장점도 있습니다.
스팸 방지 검사입니다. 이것을 입력하지
마세요
!
파이썬 pandas DataFrame은 pandas 라이브러리에서 제공하는 2차원 데이터 구조로, 표 형태의 데이터를 다루기 위한 핵심 객체이다. ==개요== DataFrame은 행(row)과 열(column)로 구성된 테이블 형태의 자료구조로, 서로 다른 데이터 타입을 각 열에 저장할 수 있다. 엑셀이나 SQL 테이블과 유사한 구조를 가지며, 레이블이 지정된 축을 통해 효율적인 데이터 조작과 분석이 가능하다. pandas는 파이썬 기반의 데이터 분석 도구로, 대용량 데이터 처리와 통계 분석, 시계열 처리 등에 광범위하게 사용된다. ==생성== DataFrame은 다양한 방식으로 생성할 수 있으며, 주로 딕셔너리, 리스트, 넘파이 배열, 시리즈 등을 이용한다. 예시: *딕셔너리를 이용한 생성: **코드: pd.DataFrame({'이름': ['홍길동', '김철수'], '나이': [25, 30]}) **출력: {| class="wikitable" |- !이름!!나이 |- |홍길동||25 |- |김철수||30 |} *리스트를 이용한 생성: **코드: pd.DataFrame([[1, 2], [3, 4]], columns=['A', 'B']) **출력: {| class="wikitable" |- !A!!B |- |1||2 |- |3||4 |} ==인덱스== DataFrame은 각 행에 고유한 인덱스를 가지고 있으며, 이를 통해 특정 행에 직접 접근하거나 정렬, 병합 등의 연산을 수행할 수 있다. 기본적으로 정수형 순차 인덱스가 자동으로 생성되지만, 사용자 정의 인덱스를 지정할 수도 있다. 예시: *기본 인덱스 사용: **코드: pd.DataFrame({'과목': ['수학', '영어'], '점수': [90, 85]}) **출력: {| class="wikitable" |- ! !!과목!!점수 |- |0||수학||90 |- |1||영어||85 |} *사용자 정의 인덱스 지정: **코드: pd.DataFrame({'과목': ['수학', '영어'], '점수': [90, 85]}, index=['학생1', '학생2']) **출력: {| class="wikitable" |- ! !!과목!!점수 |- |학생1||수학||90 |- |학생2||영어||85 |}인덱스는 df.index 속성을 통해 확인할 수 있으며, set_index() 메서드를 통해 열을 인덱스로 설정할 수 있다. 예를 들어, df.set_index('과목')은 '과목' 열을 인덱스로 설정한다. ==주요 기능== *열 단위 데이터 접근 및 수정 (df['열이름'], df.열이름) *행 단위 슬라이싱 및 필터링 (df.loc[], df.iloc[]) *결측값 처리 (df.isnull(), df.fillna()) *집계 함수 (df.mean(), df.sum(), df.groupby()) *데이터 정렬과 병합 (df.sort_values(), pd.merge()) *파일 입출력 (CSV, Excel, SQL 등) ==활용== DataFrame은 데이터 전처리, 탐색적 분석, 시각화, 모델링 등 다양한 분석 단계에서 중심적으로 사용된다. 특히 표 형식의 데이터가 주어지는 데이터 과학 및 머신 러닝 프로젝트에서 기본 도구로 자리잡고 있다. ==같이 보기== *[[pandas]] *[[NumPy]] *[[시리즈 (pandas)]] *[[데이터 전처리]] *[[탐색적 데이터 분석]] ==참고 문헌== *McKinney, Wes. ''Python for Data Analysis''. O'Reilly Media, 2018. *Harris, Charles R., et al. "Array programming with NumPy." ''Nature'' 585.7825 (2020): 357–362. ==각주== [[분류:파이썬]] [[분류:프로그래밍]]
요약:
IT 위키에서의 모든 기여는 크리에이티브 커먼즈 저작자표시-비영리-동일조건변경허락 라이선스로 배포된다는 점을 유의해 주세요(자세한 내용에 대해서는
IT 위키:저작권
문서를 읽어주세요). 만약 여기에 동의하지 않는다면 문서를 저장하지 말아 주세요.
또한, 직접 작성했거나 퍼블릭 도메인과 같은 자유 문서에서 가져왔다는 것을 보증해야 합니다.
저작권이 있는 내용을 허가 없이 저장하지 마세요!
취소
편집 도움말
(새 창에서 열림)
둘러보기
둘러보기
대문
최근 바뀜
광고
위키 도구
위키 도구
특수 문서 목록
문서 도구
문서 도구
사용자 문서 도구
더 보기
여기를 가리키는 문서
가리키는 글의 최근 바뀜
문서 정보
문서 기록