반응형

공공데이터 2

[데이터 소개] 국민건강영양조사 2편(Feat. R DataExplorer)

오늘은 지난번 포스팅에 이어 두 번째로 식품섭취량 조사 DB를 가지고 데이터 탐색을 해보겠습니다. 지난번 포스팅을 못 보신 분들은 먼저 보시면 됩니다. [데이터소개] 국민건강영양조사 1편 [데이터 소개] 국민건강영양조사 1편(Feat. 질병관리본부 KCDC) 들어가며 코로나-19(COVID-19) 사태로 대한민국에서 가장 바쁜신 분들이 바로 질병관리본부 직원들이지 않을까 싶습니다. (국민의 한사람으로서 이 자리를 빌어 감사의 인사를 전합니다.) 오늘은 �� uincity.tistory.com 식품섭취조사(hn18_24rc) 데이터 탐색 DataExplorer 패키지로 살펴보기 해당 파일은 509,819개의 데이터(rows)와 114개의 변수(columns)로 되어 있습니다. 1 2 > dim(df_hn1..

[100원] Python 데이터분석 01 - 부산교통공사 시간대별승하차인원

아재도 하는 데이터 분석 첫 번째 포스팅입니다. 여름방학 특강으로 들었던 개인 프로젝트에서 사용했던 데이터 파일에 대한 부분입니다. 요즘은 공공데이터 개방을 많이 하는 추세라 정부를 비롯해 많은 공공기관에서도 보유한 데이터들을 제공하고 있답니다. 그중에서 공공데이터 포털(https://www.data.go.kr/)을 통해서 내가 필요한 데이터셋을 찾아볼 수 있으니 자주 가봐야겠습니다. 프로젝트 시간에 분석하고 싶었던 데이터는 부산 도시철도 역별 이용객수를 확인해보고 싶은 거였습니다. 공공데이터 포털에서 찾을 수도 있지만 일단 부산 지하철을 운용하는 부산교통공사 홈페이지(https://www.humetro.busan.kr/default/main.do)에 가봤습니다. 여기서 정보공개-공공데이터 개방에 갔더니..

반응형