Earticle

현재 위치 Home

기계학습 분류모델을 이용한 하천퇴적물의 중금속 오염원 식별
Identifying sources of heavy metal contamination in stream sediments using machine learning classifiers

첫 페이지 보기
  • 발행기관
    한국습지학회 바로가기
  • 간행물
    한국습지학회지 KCI 등재 바로가기
  • 통권
    제25권 제4호 (2023.11)바로가기
  • 페이지
    pp.306-314
  • 저자
    반민정, 신상욱, 이동훈, 김정규, 이호식, 김영, 박정훈, 이순화, 김선영, 강주현
  • 언어
    한국어(KOR)
  • URL
    https://www.earticle.net/Article/A438792

※ 기관로그인 시 무료 이용이 가능합니다.

4,000원

원문정보

초록

영어
Stream sediments are an important component of water quality management because they are receptors of various pollutants such as heavy metals and organic matters emitted from upland sources and can be secondary pollution sources, adversely affecting water environment. To effectively manage the stream sediments, identification of primary sources of sediment contamination and source-associated control strategies will be required. We evaluated the performance of machine learning models in identifying primary sources of sediment contamination based on the physico-chemical properties of stream sediments. A total of 356 stream sediment data sets of 18 quality parameters including 10 heavy metal species(Cd, Cu, Pb, Ni, As, Zn, Cr, Hg, Li, and Al), 3 soil parameters(clay, silt, and sand fractions), and 5 water quality parameters(water content, loss on ignition, total organic carbon, total nitrogen, and total phosphorous) were collected near abandoned metal mines and industrial complexes across the four major river basins in Korea. Two machine learning algorithms, linear discriminant analysis (LDA) and support vector machine (SVM) classifiers were used to classify the sediments into four cases of different combinations of the sampling period and locations (i.e., mine in dry season, mine in wet season, industrial complex in dry season, and industrial complex in wet season). Both models showed good performance in the classification, with SVM outperformed LDA; the accuracy values of LDA and SVM were 79.5% and 88.1%, respectively. An SVM ensemble model was used for multi-label classification of the multiple contamination sources inlcuding landuses in the upland areas within 1 km radius from the sampling sites. The results showed that the multi-label classifier was comparable performance with sinlgle-label SVM in classifying mines and industrial complexes, but was less accurate in classifying dominant land uses (50~60%). The poor performance of the multi-label SVM is likely due to the overfitting caused by small data sets compared to the complexity of the model. A larger data set might increase the performance of the machine learning models in identifying contamination sources.
한국어
하천퇴적물은 유역내 다양한 오염원으로부터 발생하는 중금속, 유기물 등 오염물질의 수용체일 뿐만 아니라 수질 오 염 및 수생태 악영향을 유발할 수 있는 2차적 오염원이기에 중요한 관리대상이라고 할 수 있다. 오염된 하천퇴적물의 효과적인 관리를 위해서는 오염원에 대한 식별과 이와 연계된 관리대책의 수립이 우선되어야 한다. 본 연구는 하천퇴 적물내 측정된 다양한 이화학적 오염항목 분포 특성에 기반하여 퇴적물의 주요 오염원을 식별하기 위한 방법으로서 기계학습모델의 적용성을 평가하였다. 기계학습 모델의 성능 평가를 위해 전국 4대강 수계내 주요 폐금속광산 및 산 업단지 인근에서 수집된 총 356개의 하천퇴적물에 대한 중금속 10개 항목(Cd, Cu, Pb, Ni, As, Zn, Cr, Hg, Li, Al) 과 토양항목 3개(모래, 실트, 점토 비율) 수질항목 5개(함수율, 강열감량, 총유기탄소, 총질소, 총인)를 포함한 총 18개 오염항목에 대한 분석자료를 활용하였다. 기계학습 분류 모델로서 선형판별분석(linear discriminant analysis, LDA)과 서포트벡터머신(support vector machine, SVM) 분류기를 사용하여 폐금속광산(‘광산’)과 산업단지(‘산단’) 인근에서 의 하천퇴적물 시료의 분류 성능을 평가한 결과, 채취 지점 및 시기별 4가지 경우(비강우시 광산, 강우시 광산, 비강 우시 산단, 및 강우시 산단)에 대한 퇴적물 시료의 분류 성능이 우수하였으며, 특히 비선형 모델인 SVM(88.1%)이 선 형모델인 LDA(79.5%) 보다 퇴적물을 분류하는데 있어 보다 우수한 성능을 나타냈다. SVM 앙상블 기반 비배타적 다중라벨분류기 모델을 이용하여 각 시료채취 지점 상류 유역 1km 반경 내 지배적인 토지이용 및 오염원을 다중 타 겟값으로 다중분류 예측을 수행한 결과, 폐금속광산과 산업단지의 분류는 비교적 높은 정확도로 수행하였으나, 도시 와 농업지역 등 다른 비점오염원에 대한 분류정확도는 56~60%범위로 비교적 낮게 나타났다. 이는 다중라벨 분류모 델의 복잡성에 비해 데이터셋의 크기가 상대적으로 작아서 발생한 과적합에 기인한 것으로 향후 보다 많은 측정자료 가 확보될 경우 기계학습 모델을 적용한 오염원 분류의 정확도를 보다 향상시킬 수 있을 것으로 판단된다.

목차

요약
Abstract
1. 서론
2. 연구방법
2.1 데이터 확보
2.2 통계분석
2.3 기계학습 모델
3. 연구결과
3.1 지점별 및 시기별 퇴적물 성상 비교 분석
3.2 단일분류 기계학습모델을 이용한 퇴적물의 분류
3.3 다중분류 기계학습모델을 이용한 퇴적물의 분류
4. 결론
사사
References

키워드

하천퇴적물 기계학습 중금속 오염원 분류모델 토지이용 Freshwater Sediment Machine Learning Heavy metal Pollutant sources Classifier Landuse

저자

  • 반민정 [ Min Jeong Ban | 동국대학교 ]
  • 신상욱 [ Sangwook Shin | GS건설 ]
  • 이동훈 [ Dong Hoon Lee | 동국대학교 ]
  • 김정규 [ Jeong-Gyu Kim | 고려대학교 ]
  • 이호식 [ Hosik Lee | 국립한국교통대학교 ]
  • 김영 [ Young Kim | 고려대학교 세종캠퍼스 ]
  • 박정훈 [ Jeong-Hun Park | 전남대학교 ]
  • 이순화 [ ShunHwa Lee | 영남대학교 ]
  • 김선영 [ Seon-Young Kim | 국립환경과학원 ]
  • 강주현 [ Joo-Hyon Kang | 동국대학교 ] Corresponding Author

참고문헌

자료제공 : 네이버학술정보

간행물 정보

발행기관

  • 발행기관명
    한국습지학회 [Korean Wetlands Society]
  • 설립연도
    1999
  • 분야
    자연과학>기타자연과학
  • 소개
    습지보전에 관한 특성 및 이용현황을 파악하여 습지의 보전과 개발의 조화방안을 조사 및 연구하고 람사협약 등 국제협력에 동참하여 습지보전에 기여함

간행물

  • 간행물명
    한국습지학회지 [韓國濕地學會誌]
  • 간기
    계간
  • pISSN
    1229-6031
  • eISSN
    2384-0056
  • 수록기간
    1999~2026
  • 등재여부
    KCI 등재
  • 십진분류
    KDC 472 DDC 570

이 권호 내 다른 논문 / 한국습지학회지 제25권 제4호

    피인용수 : 0(자료제공 : 네이버학술정보)

    함께 이용한 논문 이 논문을 다운로드한 분들이 이용한 다른 논문입니다.

      페이지 저장