# Training and Finetuning Multimodal Embedding & Reranker Models with Sentence Transformers

DevFeed: [Training and Finetuning Multimodal Embedding & Reranker Models with Sentence Transformers](<https://devfeed.tech/articles/training-and-finetuning-multimodal-embedding-reranker-models-with-sentence-transformers-7527.md>)

Original publisher: [Read original article](<https://huggingface.co/blog/train-multimodal-sentence-transformers>)

Author: Tom Aarsen

Published: 2026-04-16T00:00:00Z

Content type: tutorial

Language: en

Sources: [Hugging Face - Blog](<https://devfeed.tech/sources/hugging-face-blog.md>)

Topics: [multimodal](<https://devfeed.tech/topics/multimodal.md>), [sentence-transformers](<https://devfeed.tech/topics/sentence-transformers.md>), [datasets](<https://devfeed.tech/topics/datasets.md>), [Machine learning](<https://devfeed.tech/topics/machine-learning.md>), [Artificial Intelligence](<https://devfeed.tech/topics/ai.md>), [Open Source](<https://devfeed.tech/topics/open-source.md>)

Tags: [community](<https://devfeed.tech/tags/community.md>), [data](<https://devfeed.tech/tags/data.md>), [datasets](<https://devfeed.tech/tags/datasets.md>), [embedding](<https://devfeed.tech/tags/embedding.md>), [evaluation](<https://devfeed.tech/tags/evaluation.md>), [models](<https://devfeed.tech/tags/models.md>), [multimodal](<https://devfeed.tech/tags/multimodal.md>), [nlp](<https://devfeed.tech/tags/nlp.md>), [open-source](<https://devfeed.tech/tags/open-source.md>), [optimization](<https://devfeed.tech/tags/optimization.md>), [performance](<https://devfeed.tech/tags/performance.md>), [retrieval](<https://devfeed.tech/tags/retrieval.md>), [sentence-transformers](<https://devfeed.tech/tags/sentence-transformers.md>), [train](<https://devfeed.tech/tags/train.md>), [training](<https://devfeed.tech/tags/training.md>), [transformers](<https://devfeed.tech/tags/transformers.md>), [vision](<https://devfeed.tech/tags/vision.md>)

## AI overview

A practical guide to fine-tuning multimodal Sentence Transformer embedding and reranker models for visual document retrieval. It explains the training pipeline and shows how domain-specific fine-tuning improved retrieval performance from 0.888 to 0.947 in the example evaluation.

## Source excerpt

We're on a journey to advance and democratize artificial intelligence through open source and open science.