셀렉트스타, 'EMNLP 2026'에 AI 신뢰성 연구 5편 채택

셀렉트스타, 'EMNLP 2026'에 AI 신뢰성 연구 5편 채택

AI 신뢰성 평가·안전성 연구 역량 국제 학술 무대 인정 받아

[아이뉴스24 최효경 기자] 셀렉트스타(대표 김세엽)는 자사 연구진이 참여한 인공지능(AI) 신뢰성 및 안전성 관련 연구 논문 5편이 자연어처리(NLP) 학회인 'EMNLP 2026'에 채택됐다고 28일 밝혔다.

셀렉트스타 emnlp2026 논문 채택. [사진=셀렉트스타]

EMNLP는 전산언어학회(ACL·Association for Computational Linguistics)가 주관하는 세계 최고 권위의 자연어처리 학술대회 중 하나다. 경험적 방법론과 검증을 기반으로 한 자연어처리 연구를 다룬다. 올해 학회는 오는 10월 24일부터 29일까지 헝가리 부다페스트에서 열린다.

이번에 채택된 논문은 메인 콘퍼런스 1편과 파인딩스(Findings) 1편, 워크숍 논문 3편이다. 메인 콘퍼런스에 채택된 연구는 AI가 문제를 맞히는지만 평가하는 기존 방식에서 나아가, 틀린 경우에도 사람과 유사한 오답을 선택하는지를 분석한 내용이다. 셀렉트스타 최혜지 연구원이 공동 주저자로 참여했다.

연구진은 표준화 시험 문항에서 나타나는 사람들의 정답·오답 선택 분포와 대규모언어모델(LLM)의 응답 분포를 비교해, AI가 인간과 얼마나 유사하게 성공하고 실패하는지를 정량적으로 진단하는 평가 프레임워크를 제시했다.

Findings에 채택된 연구는 유해하거나 위험한 요청을 판별하는 가드 모델이 자신의 판단을 얼마나 확신하는지 분석한 것이다. 연구 결과, 일부 가드 모델은 기반 모델의 판단이 불확실한 상황에서도 높은 확신을 보이며 잘못된 결정을 내릴 수 있는 것으로 나타났다.

이는 가드레일의 정확도뿐 아니라 모델이 '이 판단은 90% 확실하다'고 평가했을 때 실제로도 그만큼 정확한지 함께 확인해야 한다는 점을 보여준다. 해당 연구에는 홍종현 연구원이 주저자, 정민재 연구원이 공동저자, 김민우 AI 안전(Safety)팀 리더가 교신저자로 참여했다.

EMNLP 2026 산하 워크숍에서도 셀렉트스타 김민우 AI Safety팀 리더가 교신저자로 참여한 공동연구 논문 3편이 채택됐다. FinNLP에 채택된 연구는 금융 분야 레드팀 공격 가운데 가드레일이 차단하지 못한 사례를 학습해 방어 정책을 반복적으로 개선하는 기술을 제시한다. 정책을 업데이트하는 과정에서 기존 방어 성능이 저하되지 않는지도 자동으로 검증한다.

함께 채택된 연구는 피싱 사이트의 첫 화면뿐 아니라 연결된 페이지까지 추적·분석해 개인정보 입력과 전송 등 실제 피싱 행위를 LLM이 정확하게 식별하도록 한 연구다. 판도라(PANDORA) 워크숍에 채택된 연구는 안전성 데이터를 단순 번역하는 데 그치지 않고, 멕시코·엘살바도르·코스타리카·칠레의 언어와 제도, 사회적 맥락을 반영해 레드팀 공격 데이터를 현지화했다.

김세엽 셀렉트스타 대표는 "이번 EMNLP 논문 채택은 셀렉트스타의 AI 신뢰성 평가와 안전성 연구 역량을 국제 학술 무대에서 인정받았다는 점에서 의미가 있다"라며 "연구 성과를 셀렉트스타의 평가·레드티밍·가드레일 기술과 연결해 기업이 실제 서비스 환경에서 활용할 수 있는 AI 신뢰성 검증 체계로 발전시키겠다"고 말했다.

/최효경 기자(hyomirror@inews24.com)