창의적 콘텐츠 생성에서 GPT-4의 성능 평가: 인간 작성물과의 비교 연구

Performance Evaluation of GPT-4 in Creative Content Generation: A Comparative Study with Human Outputs

초록

대규모 언어 모델 (LLMs)은 다양한 분야에서 경쟁력 있는 성능을 보여주었으며, 특히 창의성을 요구하는 작업에서 광범위한 응용 서비스를 제공한다. 본 논문은 GPT-4와 같은 대규모 언어 모델이 창의적 글쓰기를 생성하는 데 있어 인간의 텍스트 작성물과 비교하여 어떤 성과를 내는지 평가한다. 본 연구는 GPT-4가 생성한 100개의 텍스트와 인간이 작성한 100개의 텍스트를 유창성, 유연성, 독창성, 구체성, 유용성 및 특정 창의적 전략과 같은 벤치마크를 사용하여 분석한다. 연구 결과에서 GPT-4는 높은 품질의 창의적 콘텐츠를 생성하며 인간의 성과에 근접하는 것으로 나타난다. 평가자들 간의 일관성 부족에도 불구하고, GPT-4는 인간의 창의력을 향상시키고 창의적 글쓰기의 질을 개선할 수 있는 상당한 잠재력을 보여준다. 그러나 GPT-4는 사실 정보와 역사적 배경에 의존하는 훈련 데이터로 인해 인간 창의성과의 중요한 차이를 나타낸다.

키워드

챗GPT 4; 대규모 언어 모델; 창의적 글쓰기; 창의적 콘텐츠; 창의성 평가; GPT-4; Large Language Models (LLMs); Creative Writing; Creative Contents; Creativity Evaluation
제목
창의적 콘텐츠 생성에서 GPT-4의 성능 평가: 인간 작성물과의 비교 연구
제목 (타언어)
Performance Evaluation of GPT-4 in Creative Content Generation: A Comparative Study with Human Outputs
저자
김성은; 김자경; 오동석
DOI
10.9728/dcs.2024.25.9.2479
발행일
2024-09
유형
Y
저널명
디지털콘텐츠학회논문지
권
25
호
9
페이지
2479 ~ 2490