watch·ia
AccueilActusTutosGlossaireCette semaineTendancesSources
/
ACTUS
4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·4 sept.Crusoe lève 3 milliards de dollars pour une valorisation de 30 milliards·3 sept.Accel en pourparlers pour diriger une levée de 1 milliard chez Thinking Machines·3 sept.Abliteration.ai propose des modèles IA sans restrictions via une plateforme commerciale·3 sept.Meta propose des réductions pour partager les données d’usage de Muse Spark·3 sept.OpenAI présente GPT-6 Astra, son modèle le plus avancé à ce jour·3 sept.Ollie lance un assistant IA familial conforme SOC 2 pour préserver la confidentialité·3 sept.Nvidia propose PAIR, un outil gratuit pour agréger des PC locaux en cluster d'inférence IA·3 sept.Google ajoute des modes vocaux en temps réel pour Gmail, Docs et Keep·3 sept.Panne simultanée de ChatGPT, Grok et Claude : trois assistants IA majeurs inaccessibles·3 sept.Google améliore son modèle météo IA WeatherNext 3 avec une résolution cinq fois supérieure·

Sentence Transformers v6.0 permet d'entraîner des embeddings multi-vecteurs

mercredi 26 août 202600:002 min de lecture1 source citée
L'essentiel — 3 points
  • 01Sentence Transformers v6.0 introduit le MultiVectorEncoder pour entraîner des embeddings multi-vecteurs.
  • 02Les modèles multi-vecteurs décomposent les textes en plusieurs représentations partielles, améliorant la précision des recherches.
  • 03Un modèle entraîné sur des données médicales a surpassé des modèles généralistes en 14,5 heures sur une RTX 3090.
Sentence Transformers v6.0 permet d'entraîner des embeddings multi-vecteurs

Sentence Transformers v6.0 intègre désormais un MultiVectorEncoder pour entraîner des modèles d’embeddings multi-vecteurs, une méthode de late interaction inspirée de ColBERT.

La version 6.0 de Sentence Transformers ajoute un quatrième type de modèle, le MultiVectorEncoder, conçu pour des tâches de retrieval avancé comme la recherche sémantique ou l’amélioration de modèles de génération augmentée par récupération (RAG). Contrairement aux embeddings denses qui compressent un texte en un seul vecteur, les modèles multi-vecteurs décomposent le texte en plusieurs représentations partielles, permettant une interaction tardive (late interaction) entre les segments. Cette approche, popularisée par ColBERT, vise à améliorer la précision des recherches en comparant des parties spécifiques des documents plutôt que des vecteurs globaux.

Le blog de Hugging Face détaille les composants nécessaires à l’entraînement ou à l’affinage de ces modèles : choix du modèle de base, préparation des jeux de données, sélection des fonctions de perte, configuration des arguments d’entraînement, évaluation des performances et optimisation des index. La bibliothèque permet désormais d’entraîner un modèle multi-vecteurs à partir de zéro ou d’affiner un modèle existant, avec des exemples concrets d’implémentation. L’article mentionne également un cas pratique où un modèle entraîné sur des données médicales, en 14,5 heures sur une RTX 3090, surpasse des modèles de retrieval généralistes (denses, clairsemés, lexicaux ou multi-vecteurs) sur une évaluation dédiée.

L’entraînement repose sur des outils intégrés à Sentence Transformers, accessibles via pip install -U "sentence-transformers[train]". Les utilisateurs peuvent exploiter des données locales ou hébergées sur la Hugging Face Hub, avec des formats de jeu de données adaptés aux besoins des modèles multi-vecteurs. Le processus inclut une évaluation systématique des performances, permettant d’optimiser l’indexation des vecteurs pour des applications spécifiques.

Réagir :
Partager —XLinkedIn
Sources citées