Skip to content

Latest commit

 

History

History
37 lines (27 loc) · 1.81 KB

File metadata and controls

37 lines (27 loc) · 1.81 KB

korean_multimodal_data

데이터

cocoqa_korean
	cocoqa 한국어 번역본
	train
	test
	관련 스크립트 또는 사전: 자세한 내용은 cocoqa 검색 및 스크립트 파일 내용 참조

flickr8k
	한국어 이미지 캡션 데이터 
	images.zip: flickr8k 이미지 파일
	dataset.org.json: 영어 원본 데이터
	dataset.korean.utf8.json: 한국어 번역 데이터

mnmt
	한국어-영어 이미지 번역 데이터 based flickr8k
	train
	test
	val
	vgg_feats.mat 피쳐 파일


*이미지 피쳐 파일: 폴더에 있는 파일 우선, 데이터와 세트 번역 데이터의 경우 남아있는 스크립트나 이미지-텍스트 매칭 크스립트가 없으니 flickr 등의 데이터를 활용하여 새로 만들고, 새로운 CNN 모델로 피쳐를 새로 만들것을 권고, 이는 다른 데이터셋도 마찬가지임

과제 수행 결과 논문

배장성, 황현선, 이창기, “이미지 정보를 이용한 영어-한국어 자동 번역,” 정보과학회논문지, 제46권 제7호, pp. 690-696, 2019.07.
배장성, 황현선, 이창기, “이미지 정보를 이용한 영어-한국어 자동 번역,” 한국정보과학회 2018 한국소프트웨어종합학술대회 논문집, pp. 584-586, 2018.12.
배장성, 이창기, “딥러닝을 이용한 한국어 VQA,” 제30회 한글 및 한국어 정보처리 학술대회 논문집, pp. 364-366, 2018.10.
배장성, 이창기, “Context-Gate를 이용한 이미지 캡션 생성,” 한국정보과학회 2018 한국컴퓨터종합학술대회 논문집, pp. 589-591, 2018.06.
배장성, 이창기, “딥러닝을 이용한 한국어 이미지 캡션 생성,” 한국정보과학회 2016년 동계학술대회 논문집, pp. 488-490, 2016.12.

관련 사이트 https://www.cs.toronto.edu/~mren/research/imageqa/data/cocoqa/