Microsoft COCO: common objects in context
Original
Tsung-Yi Lin, Michael Maire, Serge J. Belongie, Lubomir D. Bourdev, Ross B. Girshick, James Hays, Pietro Perona, Deva Ramanan, Piotr Dollár, and C. Lawrence Zitnick. 2014 · 2014
Cited alongside, same era.
From image descriptions to visual denotations: New similarity metrics for semantic inference over event descriptions
Peter Young, Alice Lai, Micah Hodosh, and Julia Hockenmaier. 2014 · 2014
Cited alongside, same era.
Learning language through pictures
Original
Grzegorz Chrupala, Ákos Kádár, and Afra Alishahi. 2015 · 2015
Cited alongside, same era.
Faster r-cnn: Towards real-time object detection with region proposal networks
Shaoqing Ren, Kaiming He, Ross Girshick, and Jian Sun. 2015 · 2015
Cited alongside, same era.
ImageNet Large Scale Visual Recognition Challenge
Olga Russakovsky, Jia Deng, Hao Su, Jonathan Krause, Sanjeev Satheesh, Sean Ma, Zhiheng Huang, Andrej Karpathy, Aditya Khosla, Michael Bernstein, Alexander C. Berg, and Li Fei-Fei. 2015 · 2015
Cited alongside, same era.
Neural machine translation of rare words with subword units
Original
Rico Sennrich, Barry Haddow, and Alexandra Birch. 2015 · 2015
Cited alongside, same era.
Multi30k: Multilingual english-german image descriptions
Original
Desmond Elliott, Stella Frank, Khalil Sima’an, and Lucia Specia. 2016 · 2016
Cited alongside, same era.
Attention-based multimodal neural machine translation
Po-Yao Huang, Frederick Liu, Sz-Rung Shiang, Jean Oh, and Chris Dyer. 2016 · 2016
Cited alongside, same era.
Doubly-attentive decoder for multi-modal neural machine translation
Original
Iacer Calixto, Qun Liu, and Nick Campbell. 2017a
Cited in the paper.
Incorporating global visual features into attention-based neural machine translation
Original
Iacer Calixto, Qun Liu, and Nick Campbell. 2017b
Cited in the paper.
Multilingual multi-modal embeddings for natural language processing
Original
Iacer Calixto, Qun Liu, and Nick Campbell. 2017c
Cited in the paper.
Deep residual learning for image recognition
Original
Kaiming He, Xiangyu Zhang, Shaoqing Ren, and Jian Sun. 2015a
Cited in the paper.