주요 논문
5
*2026년 기준 최근 6년 이내 논문에 한해 Impact Factor가 표기됩니다.
1
Article
|
인용수 0
·
2025Multi-agent reinforcement learning for a distributed multi-channel access game
Zhongyang Li, Yu Zhao, Joohyun Lee
IF 4.2 (2025)
ICT Express
본 연구에서는 U개의 채널과 N명의 사용자를 갖는 다중 사용자 분산 채널 접속을 게임으로 모델링하고, Multi-Agent Thompson Sampling(MA-TS) 알고리즘을 제안한다. 이 알고리즘은 베이즈 정리를 활용하여 행동 선택을 동적으로 최적화한다. 이러한 최적화의 목적은 처리율(throughput)을 최대화하는 것이다. 알고리즘의 계산 복잡도를 O(T N U N max 2)로 도출한다. 시뮬레이션 결과, MA-TS는 순수 전략 내쉬 균형(PNE)으로 수렴하며 평균 처리율 측면에서 기존 방법보다 우수함을 보여준다.
https://doi.org/10.1016/j.icte.2025.06.001
Reinforcement learning
Reinforcement
Computer science
Channel (broadcasting)
Mathematics
Artificial intelligence
Computer network
Psychology
Social psychology
2
Article
|
·
인용수 5
·
2023SOQ: Structural Reinforcement Learning for Constrained Delay Minimization With Channel State Information
Yu Zhao, Yeongjin Kim, Joohyun Lee
IF 8.2 (2023)
IEEE Internet of Things Journal
본 연구의 목표는 블록 페이딩 채널을 갖는 단일 대기열 및 단일 서버 무선 통신 시스템에서, 평균 에너지 소비 제약 하에 평균 지연을 최소화하는 것이다. 이를 위해 본 연구는 이 문제를 무한 기간 제약 마르코프 결정 과정(CMDP)으로 정식화한다. 본 CMDP에서는 대기열 길이와 채널 상태를 상태로서 함께 고려한다. 라그랑주 승수 방법을 적용하여 제약 최적화 문제를 무제약 최적화 문제로 변환한다. 이어서 최적 스케줄링 전략이 대기열 길이 및 채널 상태에 관해 단조증가함을 증명한다. 최적 스케줄링 정책을 얻기 위해 효율적인 강화학습 알고리즘인 Structural-Optimistic -learning 알고리즘(SOQ)을 제안하며, 정책 투영을 사용하여 최적 정책의 단조증가 성질을 활용한다. 마지막으로 주어진 에너지 소비 제약을 만족하도록 평균 에너지 소비를 제어하는 방법을 분석한다. 시뮬레이션 결과, 학습 단계 동안의 평균 비용 측면에서 SOQ의 성능이 전통적인 -learning 알고리즘보다 우수함을 보여준다.
https://doi.org/10.1109/jiot.2023.3299598
Computer science
Reinforcement learning
Minification
Channel (broadcasting)
State (computer science)
Channel state information
State information
Reinforcement
Mathematical optimization
Computer network
3
Article
|
·
인용수 30
·
2023Deep learning-based natural language processing for detecting medical symptoms and histories in emergency patient triage
Siryeol Lee, Juncheol Lee, Juncheol Lee, Juntae Park, Jiwoo Park, Dohoon Kim, Joohyun Lee, Joohyun Lee, Jaehoon Oh
IF 2.7 (2023)
The American Journal of Emergency Medicine
https://doi.org/10.1016/j.ajem.2023.11.063
Triage
Medical diagnosis
Artificial intelligence
Medical emergency
Computer science
Natural language processing
Medicine
Machine learning
Pathology
4
Article
|
인용수 33
·
2022Machine learning-based diagnosis and risk factor analysis of cardiocerebrovascular disease based on KNHANES
Taeseob Oh, Dongkyun Kim, Siryeol Lee, Chang Won Won, Sun Young Kim, Ji-soo Yang, Junghwa Yu, Byung Sung Kim, Joohyun Lee
IF 4.6 (2022)
Scientific Reports
심뇌혈관질환(CVD)의 유병률은 지속적으로 증가하고 있으며, 인류 사망의 주요 원인이다. 의료진이 수천 명을 대상으로 선별검사를 수행하기는 어렵기 때문에, 높은 정확도와 해석 가능성을 갖춘 방법을 제시할 필요가 있다. 본 연구에서는 한국 국민건강영양조사 자료(KNHANES)를 기반으로 4가지 기계학습 기반 CVD 분류기(즉, 다층 퍼셉트론, 서포트 벡터 머신, 랜덤 포레스트, light gradient boosting)를 개발하였다. 복잡한 표본추출 가중치를 사용하여 KNHANES 데이터를 재표본화하고 재균형화함으로써, 재균형화된 데이터셋이 전체 모집단으로부터 균일하게 표본 추출된 데이터셋을 모사하도록 하였다. 명확한 위험요인 분석을 위해 VIF 기반 필터링과 Boruta 알고리즘을 이용하여 다중공선성과 CVD-무관 변수를 제거하였다. ML 학습 전 합성 소수자 오버샘플링 기법과 무작위 언더샘플링을 적용하였다. 제안된 분류기들은 AUC가 0.853을 초과하는 등 우수한 성능을 달성함을 확인하였다. Shapley 값 기반 위험요인 분석을 통해 CVD의 가장 중요한 위험요인은 연령, 성별, 그리고 고혈압 유병률임을 확인하였다. 또한 연령, 고혈압 및 BMI는 CVD 유병률과 양의 상관관계를 보인 반면, 성별(여성), 음주 및 월 소득은 음의 상관관계를 보였다. 결과는 특징 선택과 클래스 균형화 기법이 모델의 해석 가능성을 효과적으로 향상시킨다는 것을 보여주었다.
https://doi.org/10.1038/s41598-022-06333-1
Computer science
Risk factor
Medicine
Internal medicine
5
Article
|
·
인용수 8
·
2022Multi-Agent Reinforcement Learning for a Random Access Game
Dongwoo Lee, Yu Zhao, Jun-Bae Seo, Joohyun Lee
IF 6.8 (2022)
IEEE Transactions on Vehicular Technology
본 연구는 시간 슬롯 할당 방식의 RA(랜덤 액세스) 시스템을 위한 랜덤 액세스(RA) 게임을 조사한다. 이때 명의 플레이어가 프레임의 슬롯 집합을 선택하며, 각 프레임은 개의 다중 시간 슬롯으로 구성된다. 본 연구에서는 중앙 집중형 스케줄링에서처럼 슬롯이 완전히 활용되는 조건에서, 이 RA 게임의 순수 전략 내쉬 균형(PNE, pure strategy Nash equilibria)을 구한다. PNE(순수 전략 내쉬 균형)를 실현하기 위한 알고리즘으로서, 탐색과 활용(Exploration and Exploitation)을 위한 지수 가중(Exponential-weight) 알고리즘 기반의 다중 에이전트(MA) 학습 알고리즘을 제안하며, 그 계산 복잡도는 $O(N N_{
max }^{2} T)$ 이다. EXP3는 다중 팔 밴딧(MAB) 문제에서, 사용자들이 각 전략의 기대 보상을 알지 못하는 상황에서 최적 전략을 찾도록 설계된 밴딧 알고리즘이다. 시뮬레이션 결과는 제안된 알고리즘이 PNE를 달성할 수 있음을 보여준다. 또한 플레이어의 수가 시간에 따라 변하는 시간 가변 환경(time-varying environments)에 적응할 수 있다.
https://doi.org/10.1109/tvt.2022.3176722
Notation
Nash equilibrium
Reinforcement learning
Stochastic game
Frame (networking)
Discrete mathematics
Mathematics
Computer science
Combinatorics
Algorithm