Overview
DataStax Astra DB is a cloud-native vector database built on Apache Cassandra. It provides serverless vector search with automatic scaling and multi-region support.Installation
Basic Usage
Constructor Options
string
required
Astra DB application token (defaults to
ASTRA_DB_APPLICATION_TOKEN env var)string
required
Astra DB API endpoint (defaults to
ASTRA_DB_API_ENDPOINT env var)string
default:"default_keyspace"
Astra DB namespace/keyspace (defaults to
ASTRA_DB_NAMESPACE env var)string
default:"_id"
Field name for storing document IDs
string
default:"content"
Field name for storing text content
Configuration
Environment Variables
Getting Astra DB Credentials
- Sign up at Astra DB
- Create a new database
- Generate an application token
- Copy the API endpoint from the database overview
Collection Management
Create and Connect
Connect to Existing Collection
Important
You must call eitherconnect() or createAndConnect() before adding, deleting, or querying documents.
Querying
Basic Query
Metadata Filtering
Supported Filter Operators
Astra DB supports:EQ- EqualNE- Not equalGT- Greater thanLT- Less thanGTE- Greater than or equalLTE- Less than or equalIN- Value in arrayNIN- Value not in arrayIS_EMPTY- Array is empty (size = 0)
Managing Data
Add Documents
Delete by Document ID
Access Astra DB Client
Complete Example
Distance Metrics
Astra DB supports different similarity metrics:Multi-Region Support
Astra DB automatically replicates data across multiple regions:Namespaces (Keyspaces)
Organize collections into namespaces:Best Practices
- Use appropriate metric: Cosine for normalized vectors, dot_product for speed
- Organize with namespaces: Separate environments or use cases
- Monitor usage: Track API requests and storage in Astra console
- Handle errors: Implement retry logic for transient failures
- Batch operations: Insert multiple documents at once for efficiency
- Use serverless: Automatic scaling eliminates capacity planning