Yuri
←

AI Audio Description

시각장애인을 위한 AI 영상 해설 자동 생성

AI 영상 해설 자동 생성 기술을 위해 시각장애인 20명과 FGI를 진행했습니다. 만족도 78점의 진짜 이유는 '해설이 없을 때보다 나아서'였고 여기서 개선 방향을 정리했습니다.

Year
2023
Role
Research Assistant (FGI 진행 · 녹취 · 분석)
With
KAIST Assistive AI Lab
  1. 01부산(2023.10) · 울산(11월) · 대전(12월) 3개 지역의 시각장애인 20명(30대 2 · 40대 7 · 50대 10 · 60대 1, 점자 사용 17명)을 대상으로 세션당 1시간~1시간 30분의 FGI를 직접 진행하고 녹취록 작성과 분석까지 담당
  2. 02현재 영상 해설 서비스 만족도는 평균 78점(최하 30점, 최상 90점). 그렇게 답한 이유로는 '해설이 없을 때보다 낫기 때문'을 들었고 서비스 자체에 대한 만족도는 낮음
  3. 03해설 대신 '해석'을 하는 경향, 해설 음성과 영화 음성을 따로 조절할 수 없는 문제, 여러 역할을 한 음성으로 해설하는 문제를 페인 포인트로 추림
  4. 04사람마다 관심 요소가 달라 단계별 해설과 개인화 옵션을 제안하고 용어 통일·장면별 해설 요소 분류·불필요한 해설 제거를 개선 방향으로 정리
  5. 05개인화로는 패션·자동차·날씨·음악 제목처럼 화면에만 있는 정보를 원함. 해설이 더 필요한 분야로는 TV 광고·건물 구조·스포츠를 꼽음
Next projectBubble Cone →