Skicka posten per e-post: Retrieval-Guided and Semantically Grounded Image Captioning for Open-Domain Scenes