사회

#C3 Bench

#GIST

#AI

#GPT 5.2

GIST, AI의 문맥 인식 및 변화 설명 능력 평가하는 'C3 Bench' 개발

logo

뉴스보이

2026.09.14. 10:37

GIST, AI의 문맥 인식 및 변화 설명 능력 평가하는 'C3 Bench' 개발

간단 요약

GIST 연구팀이 AI의 문맥 인식과 변화 설명 능력을 평가하는 새로운 기준인 'C3 Bench'를 개발했습니다.

AI는 문장력은 뛰어나나, 실제 상황의 변화 이해력과 가역성 측면에서는 인간의 수준에 미치지 못했습니다.

이 기사는 5개 언론사의 보도를 교차 검증하여 작성되었습니다.

광주과학기술원(GIST) AI학과 김의환 교수 연구팀이 AI가 두 이미지의 차이를 넘어 맥락을 이해하고 변화를 설명하는 능력을 평가하는 'C3 Bench(Context Aware Change Captioning Benchmark)'를 개발했다고 14일 밝혔습니다. 김 교수의 지도로 김재우 석·박사통합과정생이 제1저자로 참여한 이번 연구는 유럽컴퓨터비전학회(ECCV) 2026에서 그 가치를 인정받았습니다. 연구팀은 자연환경, 위성·항공 영상 등 4개 분야의 51개 상황과 4996쌍의 이미지를 활용해 사람과 GPT 5.2의 성능을 비교했습니다. 종합 평가 결과 사람은 7.45점, GPT 5.2는 5.72점을 기록하며 1.73점의 격차를 보였습니다. 특히 사진 순서를 뒤집었을 때 변화를 올바르게 인식하는 가역성 평가에서 사람은 93%의 정확도를 보인 반면, GPT 5.2는 61%에 그쳤습니다. 다만 문장의 자연스러움 항목에서는 GPT 5.2가 8.53점으로 사람(8.32점)을 앞서며 뛰어난 언어 구사력을 입증했습니다. AI의 주요 오류 원인으로는 시각적 인식 오류가 전체의 63.3%를 차지했습니다. 연구팀은 이번 평가 체계가 재난 감시, 자율주행, 이상 탐지 등 다양한 산업 현장에서 AI의 변화 이해 능력을 개선하는 핵심 지표로 활용될 것으로 기대하고 있습니다.
이 콘텐츠는 뉴스보이의 AI 저널리즘 엔진으로 생성 되었으며, 중립성과 사실성을 준수합니다.
AI가 작성한 초안을 바탕으로 뉴스보이 에디터들이 최종검수하였습니다. (오류신고 : support@curved-road.com)
소셜데이터 분석
기사 댓글이 많은 언론사를 기준으로 분석했어요
지디넷코리아
1개의 댓글
best 1
2026.9.14 03:13
5.2면 작년 12월에 출시된 모델인데 6개월도 더된 구닥다리 모델 평가하는게 뭔 소용?
thumb-up
0
thumb-down
0
본 기사는 AI 기술을 활용하여 뉴스를 요약/분석한 정보로, 원문 기사의 내용과 일부 차이가 있을 수 있습니다.
제공되는 정보는 투자 및 법률적 조언이 아니며, 이에 따른 책임은 뉴스보이가 지지 않습니다.
appstore logoplaystore logo

고객센터

운영시간 : 평일 오전 10시 ~ 오후 5시

서비스 이용문의 : support@curved-road.com

제휴 문의 : support@curved-road.com

주식회사 커브길에서

footer text logo

대표 : 최재형, 안세현

서울시 서대문구 성산로 512-42, 307호

사업자 등록 번호 : 237-86-03199

전화번호 : 1688-4564

발행인・편집인・청소년보호책임자 : 최재형

제호 : 뉴스보이

등록번호 : 서울 아 56429

등록・발행일자 : 2026-03-10