거대언어모델을 이용한 tabular 데이터 증강 기법 연구

서유민; 한태현; 이태진

216.73.216.19

개인회원 가입

개인회원
기관회원

개인회원 로그인

개인회원 가입으로 더욱 편리하게 이용하세요. 개인회원 가입

아이디/비밀번호를 잊으셨나요? 아이디/비밀번호 찾기

기관회원 로그인

소속기관에서 검색되지 않는 기관은 무료원문다운이 불가능합니다. 개인회원 가입 후 유료구매를 하시거나 소속기관 도서관에 이용문의해 주세요.

Home

Poster Session 차세대컴퓨팅 기술 전 분야(정보보안)

거대언어모델을 이용한 tabular 데이터 증강 기법 연구
Enhancing Tabular Data Augmentation with Large Language Models

발행기관

한국차세대컴퓨팅학회 바로가기
간행물

한국차세대컴퓨팅학회 학술대회 바로가기
통권

2025 한국차세대컴퓨팅학회 춘계학술대회 (2025.05)바로가기
페이지

pp.177-181
저자

서유민, 한태현, 이태진
언어

한국어(KOR)
URL

https://www.earticle.net/Article/A468938

원문정보

초록

한국어: 본 연구는 기존의 수치 기반 오버샘플링(SMOTE, RandomOverSampler)과 달리, LLM을 활용한 자 연어 기반 데이터 증강 기법을 통해 네트워크 보안 데이터의 불균형 문제를 해결하고자 하였다. TON-IoT 데이터셋을 기반으로 수치형 및 범주형 특성에 통계 정보를 반영한 프롬프트를 설계하였고, LLM이 이를 기반으로 실제 분포에 근접한 데이터를 생성하도록 유도하였다. 생성된 증강 데이터는 기존 학습 데이터와 함께 LightGBM 모델로 평가되었으며, LLM 기반 증강 방식이 기존 오버샘플링 기법 대비 높은 분류 성능을 보이며 효과를 입증하였다. 이는 LLM이 단순한 수치 보간을 넘어서 도 메인 특성을 반영한 고품질 데이터를 생성할 수 있는 새로운 데이터 증강 도구로 활용 가능함을 시사 한다.

요약
1. 서론
2. 관련 연구
2.1 데이터 증강 기법의 발전 흐름
2.2 네트워크 보안 분야 데이터 증강 적용
3. 언어모델 기반 데이터 증강
3.1 데이터셋
3.2 데이터 전처리
3.3 프롬프트 설계 (Prompt Design)
4. 실험결과
5. 결론
Acknowledgement
참고문헌

키워드

Network Data Augmentation Prompt Engineering LLM Tabular Data Imbalance Data

저자

서유민 [ Yu Min Seo | 호서대학교 컴퓨터공학과 ]
한태현 [ TaeHyn Han | 가천대학교 정보보호학과 ]
이태진 [ Tae Jin Lee | 가천대학교 스마트보안학과 ]

참고문헌

자료제공 : 네이버학술정보

간행물 정보

발행기관

발행기관명

한국차세대컴퓨팅학회 [Korean Institute of Next Generation Computing]
설립연도
2005
분야
공학>컴퓨터학
소개
본 학회는 차세대 PC 및 그 관련분야의 학술활동을 통하여 차세대 PC의 학문 및 기술발전을 도모하고 산업발전 및 국제협력 증진을 목적으로 한다.

간행물

간행물명

한국차세대컴퓨팅학회 학술대회
간기
반년간
수록기간
2021~2025
십진분류
KDC 566 DDC 004

이 권호 내 다른 논문 / 한국차세대컴퓨팅학회 학술대회 2025 한국차세대컴퓨팅학회 춘계학술대회

피인용수 : 0건 (자료제공 : 네이버학술정보)

함께 이용한 논문 이 논문을 다운로드한 분들이 이용한 다른 논문입니다.

출처 : 네이버학술정보

0개의 논문이 장바구니에 담겼습니다.

페이지 저장

소속기관 조회

이용자님의 소속기관(단체)이 서비스에 가입되어 있는지 확인해 보십시오.
기관회원에 소속되어 있는 이용자는 원문을 무료로 이용할 수 있습니다.

상호: 주식회사 학술교육원 I 대표: 노방용 I 사업자등록번호: 122-81-88227 I 통신판매업신고번호: 제2008-인천부평-00176호 I 정보보호책임자: 이두영
주소: (21319)인천광역시 부평구 영성중로 50 미래타워 701호 I 전화: 0505-555-0740 I 팩스: 0505-555-0741 I 이메일: earticle@earticle.net

음성지원 및 돋보기 서비스

Earticle

거대언어모델을 이용한 tabular 데이터 증강 기법 연구
Enhancing Tabular Data Augmentation with Large Language Models

원문정보

초록

목차

키워드

저자

참고문헌

간행물 정보

발행기관

간행물

이 권호 내 다른 논문 / 한국차세대컴퓨팅학회 학술대회 2025 한국차세대컴퓨팅학회 춘계학술대회

피인용수 : 0건 (자료제공 : 네이버학술정보)

함께 이용한 논문 이 논문을 다운로드한 분들이 이용한 다른 논문입니다.

Earticle

거대언어모델을 이용한 tabular 데이터 증강 기법 연구 Enhancing Tabular Data Augmentation with Large Language Models

원문정보

초록

목차

키워드

저자

참고문헌

간행물 정보

발행기관

간행물

이 권호 내 다른 논문 / 한국차세대컴퓨팅학회 학술대회 2025 한국차세대컴퓨팅학회 춘계학술대회

피인용수 : 0건 (자료제공 : 네이버학술정보)

함께 이용한 논문 이 논문을 다운로드한 분들이 이용한 다른 논문입니다.

거대언어모델을 이용한 tabular 데이터 증강 기법 연구
Enhancing Tabular Data Augmentation with Large Language Models