vultr

Fournisseur cloud dont les modèles VultronRetriever outillent la recherche et le RAG

3 fiches modèlesorties 18 juin 2026 → 22 juin 20263 à poids ouvertscontexte jusqu'à 262 144 tokens

Vultr est un fournisseur d'infrastructure cloud indépendant (serveurs virtuels, calcul, Kubernetes, GPU), connu pour son réseau de centres de données répartis à l'échelle mondiale. Au-delà de l'hébergement classique, l'entreprise a étendu son offre vers l'IA avec Vultr Serverless Inference, un service de déploiement et de service de modèles génératifs incluant une brique RAG clé en main (base vectorielle privée alimentée via l'API Vultr).

Au catalogue, son organisation Hugging Face vérifiée met à disposition la famille VultronRetriever (déclinaisons Core et Prime bâties sur une base Qwen3), des modèles de récupération et de classement de documents. L'approche s'inscrit dans le prolongement direct de sa plateforme : fournir les composants d'embedding et de reranking nécessaires à des pipelines de recherche et de génération augmentée, plutôt qu'un modèle conversationnel généraliste.

Ces modèles visent les développeurs qui construisent des applications RAG et des moteurs de recherche documentaire, en particulier ceux qui s'appuient sur l'inférence serverless de Vultr.