Alibaba gte-multilingual-base logo

Alibaba gte-multilingual-base

Free

70+ languages, compact

FreeFree tier
Inputs: text
Type
Open Source
Company
Alibaba-NLP

About Alibaba gte-multilingual-base

A multilingual sentence embedding model developed by Alibaba NLP that supports over 70 languages. Built with sentence-transformers and transformers, it is optimized for sentence similarity tasks and achieves competitive performance on MTEB benchmarks including clustering, STS, classification, reranking, and retrieval. The model is compact and open-source, available on Hugging Face for easy integration.

Key Features

Supports 70+ languages
Compact model size
Sentence similarity embeddings
Compatible with sentence-transformers
Trained for multilingual text representation
Evaluated on MTEB benchmarks (clustering, STS, classification, reranking, retrieval)

Pros & Cons

Pros
  • Broad multilingual coverage (70+ languages)
  • Compact and efficient for deployment
  • Open-source and freely available
  • Strong performance on standard MTEB tasks
  • Easy to use with sentence-transformers library
Cons
  • May be less accurate than larger multilingual models
  • Benchmark performance varies across languages and tasks
  • Limited documentation beyond model card

Best For

Multilingual semantic searchCross-lingual text clusteringSentence similarity and paraphrase detectionMultilingual retrieval and rerankingText classification in multiple languages

FAQ

What is GTE-Multilingual-Base?
A multilingual sentence embedding model by Alibaba NLP that supports over 70 languages, designed for sentence similarity and related tasks.
Is the model free to use?
Yes, it is open-source and free to download and use from Hugging Face.
What framework is it built with?
It uses sentence-transformers and transformers libraries.
What tasks can it be used for?
Sentence similarity, clustering, classification, reranking, and retrieval across multiple languages.