Bases vectorielles

Stockage et recherche d'embeddings : Pinecone, Qdrant, recherche semantique.

85 skills

# Skill Source Description Δ
1 qdrant-clients-sdk github/awesome-copilot Rechercher des exemples de code pour interagir avec l'API Qdrant via ses SDKs officiels. 38 295 222
2 qdrant-deployment-options github/awesome-copilot Choisir le bon déploiement Qdrant selon ses besoins de production ou prototypage. 38 295 222
3 qdrant-model-migration github/awesome-copilot Migrer une collection Qdrant lors d'un changement de modèle d'embedding sans interruption. 38 295 222
4 qdrant-performance-optimization github/awesome-copilot Optimiser les performances Qdrant : vitesse, indexation et mémoire. 38 295 222
5 qdrant-indexing-performance-optimization github/awesome-copilot Diagnostiquer et résoudre les problèmes de lenteur d'indexation dans Qdrant. 38 295 222
6 qdrant-memory-usage-optimization github/awesome-copilot Optimiser et surveiller l'utilisation mémoire de Qdrant pour des performances maximales. 38 295 222
7 qdrant-search-speed-optimization github/awesome-copilot Diagnostiquer et résoudre les problèmes de performance de recherche vectorielle. 38 295 222
8 qdrant-scaling github/awesome-copilot Choisir et appliquer la bonne stratégie de scaling Qdrant selon l'objectif visé. 38 295 222
9 qdrant-minimize-latency github/awesome-copilot Optimiser la latence des requêtes Qdrant via RAM, CPU et configuration HNSW. 38 295 222
10 qdrant-scaling-data-volume github/awesome-copilot Scaler des volumes de données massifs via multi-tenancy, fenêtre temporelle ou sharding distribué. 38 295 222
11 qdrant-horizontal-scaling github/awesome-copilot Planifier la scalabilité verticale et horizontale d'un cluster Qdrant efficacement. 38 295 222
12 qdrant-sliding-time-window github/awesome-copilot Gérer une fenêtre temporelle glissante dans Qdrant avec rotation de shards ou collections. 38 295 222
13 qdrant-tenant-scaling github/awesome-copilot Partitionner efficacement Qdrant multi-tenant selon le volume et les contraintes d'isolation. 38 295 222
14 qdrant-vertical-scaling github/awesome-copilot Dimensionner verticalement un cluster Qdrant en augmentant CPU, RAM ou disque. 38 295 222
15 qdrant-scaling-qps github/awesome-copilot Optimiser le débit de requêtes Qdrant via segmentation, quantification et réplication horizontale. 38 295 222
16 qdrant-scaling-query-volume github/awesome-copilot Optimiser les requêtes multi-shards via sous-échantillonnage statistique de Poisson. 38 295 222
17 qdrant-search-quality github/awesome-copilot Diagnostiquer et optimiser la qualité de recherche vectorielle dans Qdrant. 38 295 222
18 qdrant-search-quality-diagnosis github/awesome-copilot Diagnostiquer et corriger la qualité de recherche vectorielle dans Qdrant. 38 295 222
19 qdrant-search-strategies github/awesome-copilot Optimiser la recherche vectorielle avec hybridation, reranking et feedback de pertinence. 38 295 222
20 qdrant-version-upgrade github/awesome-copilot Gérer les mises à niveau de version Qdrant en garantissant compatibilité et continuité de service. 38 295 222
21 pinecone-rag github/awesome-copilot Construire un pipeline RAG ou une mémoire d'agent persistante avec Pinecone. 38 295 222
22 embedding-strategies wshobson/agents Choisir et optimiser les modèles d'embedding pour la recherche vectorielle. 39 177 219
23 hybrid-search-implementation wshobson/agents Combiner recherche vectorielle et par mots-clés pour améliorer le rappel RAG. 39 177 219
24 rag-implementation wshobson/agents Implémenter la RAG pour construire des applications LLM avec réponses factuelles et sourcées. 39 177 219
25 similarity-search-patterns wshobson/agents Implémenter une recherche vectorielle sémantique efficace et scalable en production. 39 177 219
26 vector-index-tuning wshobson/agents Optimiser les index vectoriels HNSW pour maximiser rappel, vitesse et mémoire. 39 177 219
27 cognee topoteretes/cognee Gérer des graphes de connaissances avec Cognee via ingestion, enrichissement et recherche. 30 290 139
28 nemo-retriever nvidia/skills Indexer et interroger des dossiers de fichiers multimédias via une CLI RAG optimisée. 3 114 79
29 azure-search-documents-dotnet microsoft/skills Créer des applications de recherche full-text, vectorielle et hybride sur Azure. 2 958 34
30 azure-search-documents-py microsoft/skills Implémenter la recherche full-text, vectorielle et hybride avec Azure AI Search. 2 958 34
31 azure-search-documents-ts microsoft/skills Implémenter la recherche vectorielle, hybride et sémantique avec Azure AI Search en TypeScript. 2 958 34
32 redis-search redis/agent-skills Indexer, interroger et optimiser des recherches Redis lexicales, vectorielles et hybrides. 125 5
33 iris-development redis/agent-skills Intégrer une mémoire persistante de session et long terme pour agents IA avec Redis. 125 5
34 redis-search redis/agent-skills Indexer, interroger et optimiser des recherches Redis lexicales, vectorielles et hybrides. 125 5
35 redis-semantic-cache redis/agent-skills Mettre en cache sémantiquement les réponses LLM via Redis LangCache pour réduire coûts et latence. 125 5
36 qdrant-clients-sdk qdrant/skills Rechercher des exemples de code pour interagir avec l'API Qdrant via ses SDKs officiels. 224 2
37 qdrant-deployment-options qdrant/skills Choisir le bon déploiement Qdrant selon ses besoins de production ou prototypage. 224 2
38 qdrant-model-migration qdrant/skills Migrer une collection Qdrant lors d'un changement de modèle d'embedding sans interruption. 224 2
39 qdrant-monitoring-debugging qdrant/skills Diagnostiquer les problèmes de performance Qdrant via métriques d'optimisation et mémoire. 224 2
40 qdrant-performance-optimization qdrant/skills Optimiser les performances Qdrant : vitesse, indexation et mémoire. 224 2
41 qdrant-indexing-performance-optimization qdrant/skills Optimiser la vitesse d'indexation et d'ingestion dans Qdrant. 224 2
42 qdrant-memory-usage-optimization qdrant/skills Optimiser et surveiller l'utilisation mémoire de Qdrant pour réduire l'empreinte RAM. 224 2
43 qdrant-search-speed-optimization qdrant/skills Diagnostiquer et résoudre les problèmes de performance de recherche Qdrant. 224 2
44 qdrant-scaling qdrant/skills Choisir et appliquer la bonne stratégie de scaling Qdrant selon l'objectif visé. 224 2
45 qdrant-minimize-latency qdrant/skills Optimiser la latence des requêtes Qdrant via RAM, CPU et segmentation. 224 2
46 qdrant-scaling-data-volume qdrant/skills Scaler des volumes de données massifs via multi-tenancy, fenêtre temporelle ou sharding distribué. 224 2
47 qdrant-horizontal-scaling qdrant/skills Configurer et dimensionner un cluster Qdrant distribué pour maximiser capacité et tolérance aux pannes. 224 2
48 qdrant-sliding-time-window qdrant/skills Gérer une fenêtre temporelle glissante dans Qdrant via rotation de shards ou suppression filtrée. 224 2
49 qdrant-tenant-scaling qdrant/skills Implémenter le multitenancy Qdrant performant selon l'échelle et les contraintes d'isolation. 224 2
50 qdrant-vertical-scaling qdrant/skills Dimensionner verticalement un cluster Qdrant en augmentant CPU, RAM ou disque. 224 2

À propos de cette sélection

Relier un LLM à une mémoire persistante exige bien plus qu'un appel HTTP. Il faut créer des collections typées, gérer les namespaces par tenant, calibrer les paramètres HNSW pour que la latence reste acceptable sous charge, et piloter les mises à jour d'embeddings sans corrompre les vecteurs existants. Ce sont ces opérations que couvrent les skills bases vectorielles répertoriés ici. Le profil ciblé est le dev backend ou ML engineer qui intègre de la recherche sémantique dans un pipeline RAG ou un moteur de recommandation. Qdrant concentre une part importante de la sélection, avec des skills dédiés à la migration de modèles, au scaling et à l'optimisation d'indexation. Pinecone est aussi représenté. L'outillage est mature côté SDK, mais reste fragmenté dès qu'on touche à l'observabilité ou au fine-tuning des index en production.