google.com, pub-9005101102414487, DIRECT, f08c47fec0942fa0

서울공대 컴퓨터공학부 김건희 교수팀, 말버릇·추임새도 사람처럼 따라 하는 AI 대화 생성 모델 개발

자연어처리 최우수학회 ‘NAACL 2025’ 음성 인식 부문 최고 논문상 수상

팟캐스트 제작, 상담 AI, 음성 비서, 돌봄 서비스 분야 상용화 기대

[사진=왼쪽부터 서울대학교 컴퓨터공학부 김강욱 연구원(학사과정), 서울대학교 컴퓨터공학부 김건희 교수, 서울대학교 컴퓨터공학부 이세훈 연구원(박사과정)]

 

서울대학교 공과대학은 컴퓨터공학부 김건희 교수팀이 말버릇, 추임새, 끼어들기 등 사람의 대화 행동을 인공지능(AI)이 이해하고 재현하는 음성 대화 생성 기술을 개발했다고 밝혔다.
 

김 교수팀은 이번 연구에서 세계 최대 규모의 대화 행동 기반 음성 데이터셋인 ‘Behavior-SD’를 구축하고, 이를 바탕으로 자연스럽게 음성 대화를 나누는 AI 모델 ‘BeDLM’을 제안했다.

연구팀은 지난 4월 29일부터 5월 4일까지 미국 뉴멕시코주 앨버커키에서 열린 ‘NAACL 2025(북미 전산언어학회)’에서 해당 연구 논문을 구두 발표했으며, 음성 처리 및 음성 언어 이해(Speech Processing and Spoken Language Understanding) 분야에서 최고 논문상(Senior Area Chair Award)을 수상했다. NAACL은 컴퓨터가 인간의 언어를 이해, 생성할 수 있도록 해주는 AI의 한 분야인 자연어 처리(NLP) 관련 세계 최고 권위 학회 중 하나다.

연구팀은 사람들이 음성 대화를 나눌 때 텍스트 대화에서는 잘 나타나지 않는 대화 행동을 보이는 점에 주목했다. 예컨대 우리는 대화할 때 ‘음…’, ‘그니까…’ 같은 말버릇을 쓰고, 적절한 순간에 ‘맞아’, ‘응’ 같은 추임새를 넣거나 때로는 상대의 말을 끊기도 한다. 하지만 이런 미묘한 특징들을 반영하지 못한 기존 AI 대화 시스템의 말투는 부자연스럽고 기계적으로 느껴질 수밖에 없었다. 따라서 김 교수팀은 실제 사람처럼 자연스러운 대화를 나누는 AI를 구현하려면 대화 행동의 반영이 반드시 이뤄져야 한다고 봤다.

이 문제의 해결에 나선 연구팀은 말버릇과 추임새(backchannel), 끼어들기(interruption), 감정 표현 등 사람 개개인의 대화 행동을 정밀하게 반영한 음성 데이터셋과 대화 생성 기술을 함께 제시하는 성과를 거뒀다.

먼저 김 교수팀은 실제 대화 환경을 최대한 비슷하게 재현하기 위해 10만 개의 대화 패턴과 총 2000시간 분량의 음성 대화를 모아 ‘Behavior-SD (Spoken Dialogue)’ 데이터셋을 구축했다. 이 대규모의 데이터는 사람 간의 자연스러운 대화를 정밀하게 구현하도록 설계됐다. 각 화자가 주고받는 단순한 문장에 더해 세밀하게 구분된 다양한 대화 행동을 주석 처리한 방식 덕분이다.
 


이렇게 구축한 데이터를 바탕으로 연구팀은 행동 기반 대화 생성 모델인 ‘BeDLM (Behaviorally Aware Spoken Dialogue Generation with Large Language Models)’을 개발했다. 거대 언어 모델(Large Language Model, LLM)에 기반한 BeDLM은 대화 상황과 두 화자의 행동 패턴이 입력되면 실제 사람 간 대화에 가까운 음성 대화를 손쉽게 만들어내는 AI 기술이다. 추임새를 넣거나 말을 끊는 습관, 말버릇 등의 대화 행동을 자연스럽게 조절해 반영하기 때문에 기존 AI 대화 시스템의 한계를 극복하고 한층 더 사람다운 음성 대화를 생성할 수 있다.

BeDLM은 향후 팟캐스트 콘텐츠 제작, 상담 AI, 개인 맞춤형 음성 비서 등 사람과 AI 간의 상호작용과 정서적 반응이 필요한 여러 분야에서 널리 활용될 것으로 예상된다. 나아가 이 기술은 앞으로 상담, 교육, 돌봄 서비스 등 다양한 영역에서 사람과 AI가 더욱 원활하게 소통할 수 있도록 돕는 데에도 이용될 전망이다. 아울러 이번 연구에서 개발된 Behavior-SD 데이터셋과 코드는 모두 오픈소스로 공개돼 국내외 연구자 누구나 자유롭게 활용할 수 있다. 따라서 관련 기술의 확산과 후속 연구 또한 촉진될 것으로 기대된다.

김건희 교수는 “대화하는 사람은 보통 말하는 중에도 귀를 열고 상대방의 음성적 반응과 시각적 반응에 적응하고 맞춰가며 대화를 이끄는데, 지금까지 개발된 AI 대화 생성 모델은 이를 반영하지 못했기 때문에 그 한계를 넘고자 했다”면서 “AI가 사람처럼 자연스럽게 대화하는 기술을 한 단계 더 발전시켰다는 점에서 금번 연구의 의미가 크다”고 밝혔다.

논문의 제1저자인 이세훈 연구원은 “이번 연구는 음성 대화에서만 나타나는 다양한 행동 패턴을 데이터와 모델에 반영함으로써 한층 더 사람다운 대화를 AI로 구현하는 작업이 가능해졌다는 데 그 의의가 있다”고 밝혔다. 이어 “물론 데이터를 구축하고, AI가 사람의 대화 행동을 이해하도록 하는 모델링 방법을 찾는 과정이 쉽지 않았다”고 연구과정을 돌아보며 “BeDLM이 실제 음성 대화 서비스에 적용돼 자연스럽고 몰입감 높은 대화를 제공하는 AI 기술로 자리매김하길 기대한다”고 말했다.

서울대 컴퓨터공학부에서 박사과정을 밟고 있는 이세훈 연구원은 AI가 사람의 더 다양한 행동 패턴을 모델링하고 세밀하게 조절할 수 있도록 행동 기반 음성 대화 생성 모델의 고도화를 연구하고 있다. 앞으로 음성 기반 대화형 AI의 심화 기술을 계속 연구할 예정이며, 기업 인턴십 등 실무 경험을 통해 실제 서비스 적용과 기술 확산에도 기여할 계획이다.

※ 참고자료
- 논문명/학회 : “Behavior-SD : Behaviorally Aware Spoken Dialogue Generation with Large Language Models”, 2025 Annual Conference of the Nations of the Americas Chapter of the Association for Computational Linguistics (NAACL2025)
- 논문 링크 : https://aclanthology.org/2025.naacl-long.484.pdf

김유미 문화부 기자 yum1024@daum.net
작성 2025.05.30 12:04 수정 2025.05.30 13:10

RSS피드 기사제공처 : 한국IT산업뉴스 / 등록기자: 김유미 문화부 무단 전재 및 재배포금지

해당기사의 문의는 기사제공처에게 문의

댓글 0개 (/ 페이지)
댓글등록- 개인정보를 유출하는 글의 게시를 삼가주세요.
등록된 댓글이 없습니다.
Shorts NEWS 더보기
경기도 AI디지털배움터 가동…15만 도민을 위한 생성형 AI 및 키오스크..
카이스트가 알아낸 늙지 않는 세포 브레이크의 비밀
비만치료제 정체기 돌파할 뇌 신호 스위치, 마침내 풀렸다!
서울 한복판 지하에 40년 동안 숨겨진 역대급 비밀 공간의 정체
매매는 꽁꽁, 전세는 불타는 중! 지금 서울 부동산 시장에서 벌어지는 기..
만성 피로와 번아웃을 돈으로 바꾸는 역발상 비즈니스의 비밀
오늘부터 안 받으면 공중분해? 내 돈 25만 원 찾아가는 법
왜 가평·연천만 20만 원 주냐!" 난리 난 경기도 지원금 팩트 체크
작년보다 20% 급증! 응급실 실려 가기 싫으면 필독
경기도 사는데 이걸 모르면 손해? 우리 동네 주인공 되는 법!
지금 삼성 주식보다 이게 더 핫해? 8인치 반도체의 기막힌 반란
영구 혜택이라더니 이제 와서 중과세? 매입임대 잔혹사의 시작
충격 데이터! 코로나 낫고 30일 안에 사망할 확률 20배 폭증하는 이유..
경기도 예술가라면 150만 원 놓치지 마세요! (선착순 급함)
TIME지가 극찬한 한국 기업, 삼성이 아니라 여기라고?
요즘 대세는 웰니스! 하치노헤가 떡상한 이유
서울만 사람 사나요? 응급실 뺑뺑이 종결 선언!
"맛있게 먹었을 뿐인데..." 5월 나들이가 응급실로 변하는 이유
커피 세 잔 값으로 경기도 관광지 130곳 정복하기
하남 교산에 임대주택? 솔직히 강남 아파트보다 나은 듯ㄷㄷ
회 좋아하는 친구 태그하세요, 진짜 큰일 납니다...
치매 예방부터 낙상 감지까지? 어르신 위한 첨단기술 TOP 5
일본 나가노 연쇄 지진, 진도 6강 대규모 본진 경고 – 활단층 요동
이제 자식보다 AI가 효도하는 시대? (진짜 시작됨)
일본 숨겨진 벚꽃 성지… 아직 모르는 사람 많다
정부 서비스 700개 마비… 서울시는 왜 멀쩡했나
공모전 헌터들 주목! 상금 800만 원 걸린 배달특급 역대급 찬스
돌연사 원인 1위 심근병증, 이제 유전자로 미리 압니다.
유튜브 NEWS 더보기

일론 머스크의 경고, 2030년 당신의 책상은 사라진다

부의 이동심리, 타워팰리스가 던지는 경제적 신호

그대는 소중한 사람 #유활의학 #마음챙김 #휴식

나 홀로 뇌졸중, 생존 확률 99% 높이는 실전 매뉴얼

숨결처럼 다가온 희망. 치유.명상.수면.힐링

통증이 마법처럼 사라지다./유활도/유활의학/유활파워/류카츠대학/기치유

O자 다리 한국, 칼각 일본? 앉는 습관 하나가 평생 건강을 좌우한다

겨울마다 돌아오는 ‘급성 장폭풍’… 노로바이러스, 아이들 먼저 덮쳤다

아오모리 강진, 철도·항만·도심 모두 멈췄다… 충격 확산

경기도, 숨겨진 가상자산까지 추적했다… 50억 회수한 초정밀 징수혁신으로 대통령상 수상

간병 파산 막아라... 경기도 'SOS 프로젝트' 1천 가구 숨통 틔웠다 120만 원의 기적,...

100세 시대의 진짜 재앙은 '빈곤'이 아닌 '고독', 당신의 노후는 안전합니까...

브레이크 밟았는데 차가 '쭉'... 눈길 미끄러짐, 스노우 타이어만 믿다간 '낭패...

"AI도 설렘을 알까?"... 첫눈 오는 날 GPT에게 '감성'을 물었더니

응급실 뺑뺑이 없는 경기도, '적기·적소·적시' 치료의 새 기준을 세우다

GTX·별내선·교외선이 바꾼 경기도의 하루… 이동이 빨라지자 삶이 달라졌다

행복은 뇌에서 시작된다. 신경과학이 밝혀낸 10가지 습관

행복은 뇌에서 시작된다 신경과학이 밝혀낸 10가지 습관

자신을 칭찬할 수 있는 용기, 삶을 존중하는 가장 아름다운 습관

아이젠사이언스생명연, AI 신약 개발 초격차 확보 전략적 동행