Skip to main content
Haystack integration provides pipeline components for building RAG applications with vector databases.

Pipeline Types

VectorDB provides several pre-built pipeline types for Haystack:
  • Semantic Search: Dense vector retrieval using embedding models
  • Hybrid Indexing: Combined dense and sparse vector indexing
  • Sparse Indexing: BM25-style keyword-based retrieval
  • MMR (Maximal Marginal Relevance): Diversity-optimized retrieval
  • Parent Document Retrieval: Hierarchical chunking with parent-child relationships
  • Query Enhancement: Multi-query and query expansion techniques
  • Reranking: Cross-encoder reranking of retrieved results
  • Contextual Compression: Token optimization through context compression
  • Agentic RAG: Self-reflective retrieval with routing
  • Multi-tenancy: Namespace-based data isolation
  • Metadata Filtering: Advanced filtering on document metadata
  • JSON Indexing: Indexing and filtering on nested JSON fields
  • Cost-Optimized RAG: Token-efficient retrieval strategies

Supported Vector Databases

All Haystack pipelines support these vector databases:
  • Chroma: ChromaSemanticSearchPipeline, ChromaMmrSearchPipeline, etc.
  • Milvus: MilvusSemanticSearchPipeline, MilvusHybridSearchPipeline, etc.
  • Pinecone: PineconeSemanticSearchPipeline, PineconeHybridSearchPipeline, etc.
  • Qdrant: QdrantSemanticSearchPipeline, QdrantMmrSearchPipeline, etc.
  • Weaviate: WeaviateSemanticSearchPipeline, WeaviateHybridSearchPipeline, etc.

Common Pipeline Methods

All Haystack pipelines share common initialization patterns and methods:

Constructor Pattern

str
required
Path to YAML configuration file containing database credentials and settings
str
Override collection name from config
str
Override embedding model from config (e.g., “sentence-transformers/all-MiniLM-L6-v2”)
Any
Additional pipeline-specific parameters
Perform retrieval search.
str
required
Query text to search for
int
default:"10"
Number of results to return
Dict[str, Any]
Metadata filters to apply
Any
Pipeline-specific search parameters
List[Document]
Retrieved Haystack Document objects ordered by relevance

index

Index documents into the vector database.
List[Document]
required
Haystack Document objects to index
str
Namespace for multi-tenant isolation
Any
Pipeline-specific indexing parameters

Example Usage

Multi-tenancy