

‘FoCus Dataset’은 사용자 개인의 페르소나와 외부 지식을 모두 활용하는 세계 최초의 AI 대화 데이터셋이다. 약 8000여 개의 광범위한 주제를 다룬 1만 5000개 이상의 대화로 구성되어 있다.
‘FoCus Dataset’은 초거대 언어 모델을 사용하지 않고도 같은 성능의 대화 기술 구현이 가능하다는 특징도 있다.
공동연구팀은 지난 2월 세계 최고 권위의 인공지능 학회 ‘AAAI 2022’에서 해당 연구 논문을 게재 및 발표했다. 오는 10월에는 세계 전산언어학회인 ‘COLING 2022’에서 데이터 활용 경진 대회(Shared Tasks)를 비롯한 연구 성과를 공유하는 워크샵(The 1st Workshop on Customized Chat Grounding Persona and Knowledge)을 고려대와 공동 개최한다.
이연수 엔씨소프트 Language AI Lab 실장은 “최근 NLP 학계에서는 비용 및 환경 문제로 초거대 언어모델 기반의 대화 기술에 필적할 수 있는 새로운 대화 기술들이 제안되고 있다”며 “이러한 연구 방향에 공감하는 차원에서 이번 데이터 공개를 결정하였으며, 글로벌 연구 커뮤니티에서 활발한 논의와 기술 개발이 이루어지기를 기대한다”고 설명했다.
정은경 기자 ek7869@fntimes.com
[관련기사]
가장 핫한 경제 소식! 한국금융신문의 ‘추천뉴스’를 받아보세요~
데일리 금융경제뉴스 Copyright ⓒ 한국금융신문 & FNTIMES.com
저작권법에 의거 상업적 목적의 무단 전재, 복사, 배포 금지