// education

파이썬 분산 빅데이터 처리: PySpark와 RDD/DataFrame 대용량 분산 연산

단일 컴퓨터의 메모리 한계를 넘어서는 수백 GB~수 TB 대용량 빅데이터를 분산 서버 클러스터에서 초고속으로 처리하는 PySpark 빅데이터 파이프라인을 다룹니다.

← 이전파이썬 딥러닝 입문: PyTorch 텐서(Tensor)와 신경망(Neural Network) 구현 다음 →파이썬 시스템 제어 표준 라이브러리: os, sys 및 subprocess 프로세스 관리