Skip to main content
GraphRAG provides sensible defaults for all configuration options. This reference documents all default values.

Model defaults

Completion models

str
default:"default_completion_model"
Default identifier for completion model configurations.
str
default:"gpt-4.1"
Default completion model name.
AuthMethod
default:"ApiKey"
Default authentication method for completion models.
str
default:"openai"
Default model provider.

Embedding models

str
default:"default_embedding_model"
Default identifier for embedding model configurations.
str
default:"text-embedding-3-large"
Default embedding model name.
AuthMethod
default:"ApiKey"
Default authentication method for embedding models.

Encoding

str
default:"o200k_base"
Default encoding model for tokenization.

Directory defaults

str
default:"input"
Default base directory for input files.
str
default:"output"
Default base directory for output files.
str
default:"cache"
Default base directory for cache storage.
str
default:"update_output"
Default base directory for incremental update output.

Entity types

list[str]
Default entity types to extract during graph construction.

Configuration class defaults

The following sections document default values for each configuration class.

BasicSearchDefaults

None
default:"None"
Basic search prompt template.
int
default:"10"
Number of results to return.
int
default:"12000"
Maximum context tokens.
str
default:"default_completion_model"
Completion model ID.
str
default:"default_embedding_model"
Embedding model ID.

ChunkingDefaults

str
default:"tokens"
Chunking strategy type (from ChunkerType enum).
int
default:"1200"
Chunk size in tokens.
int
default:"100"
Overlap between chunks in tokens.
str
default:"o200k_base"
Encoding model for tokenization.
None
default:"None"
Metadata to prepend to chunks.

ClusterGraphDefaults

int
default:"10"
Maximum size of clusters.
bool
default:"True"
Whether to use the largest connected component.
int
default:"0xDEADBEEF"
Random seed for clustering (3735928559 in decimal).

CommunityReportDefaults

None
default:"None"
Prompt for graph-based community reports.
None
default:"None"
Prompt for text-based community reports.
int
default:"2000"
Maximum report length in tokens.
int
default:"8000"
Maximum input length in tokens.
str
default:"default_completion_model"
Completion model ID.
str
default:"community_reporting"
Model instance name for caching.

DriftSearchDefaults

None
default:"None"
DRIFT search prompt.
None
default:"None"
Reduce step prompt.
int
default:"12000"
Maximum data tokens.
None
default:"None"
Maximum reduce tokens.
float
default:"0"
Temperature for reduce step.
None
default:"None"
Maximum completion tokens for reduce.
int
default:"32"
Concurrency level for DRIFT operations.
int
default:"20"
Number of followup queries.
int
default:"5"
Number of primer folds.
int
default:"12000"
Maximum tokens for primer LLM.
int
default:"3"
Search depth.
float
default:"0.9"
Text unit proportion for local search component.
float
default:"0.1"
Community proportion for local search component.
int
default:"10"
Top k entities for local search.
int
default:"10"
Top k relationships for local search.
int
default:"12000"
Maximum data tokens for local search.
float
default:"0"
Temperature for local search.
float
default:"1"
Top p for local search.
int
default:"1"
Number of completions for local search.
int | None
default:"None"
Maximum generation tokens for local search.
int | None
default:"None"
Maximum completion tokens for local search.
str
default:"default_completion_model"
Completion model ID.
str
default:"default_embedding_model"
Embedding model ID.

EmbedTextDefaults

str
default:"default_embedding_model"
Embedding model ID.
str
default:"text_embedding"
Model instance name for caching.
int
default:"16"
Batch size for embedding operations.
int
default:"8191"
Maximum tokens per batch.
list[str]
List of embeddings to generate (uses default_embeddings).

ExtractClaimsDefaults

bool
default:"False"
Whether claim extraction is enabled.
None
default:"None"
Claim extraction prompt.
str
Description of claims to extract.
int
default:"1"
Maximum number of gleaning iterations.
str
default:"default_completion_model"
Completion model ID.
str
default:"extract_claims"
Model instance name for caching.

ExtractGraphDefaults

None
default:"None"
Graph extraction prompt.
list[str]
Entity types to extract.
int
default:"1"
Maximum number of gleaning iterations.
str
default:"default_completion_model"
Completion model ID.
str
default:"extract_graph"
Model instance name for caching.

TextAnalyzerDefaults

Used for NLP-based graph extraction.
NounPhraseExtractorType
default:"RegexEnglish"
Noun phrase extractor type.
str
default:"en_core_web_md"
SpaCy model name.
int
default:"15"
Maximum word length to consider.
str
default:"' '"
Delimiter between words.
bool
default:"True"
Whether to include named entities.
list[str]
List of nouns to exclude (uses EN_STOP_WORDS).
list[str]
default:"[\"DATE\"]"
Entity tags to exclude.
list[str]
default:"[\"DET\", \"PRON\", \"INTJ\", \"X\"]"
Part-of-speech tags to exclude.
list[str]
default:"[\"PROPN\", \"NOUNS\"]"
Tags for noun phrases.
dict[str, str]
Grammar rules for noun phrase combination.Default:

ExtractGraphNLPDefaults

bool
default:"True"
Whether to normalize edge weights.
TextAnalyzerDefaults
Text analyzer configuration.
int
default:"25"
Number of concurrent requests.
AsyncType
default:"Threaded"
Async mode to use.

GlobalSearchDefaults

None
default:"None"
Map step prompt.
None
default:"None"
Reduce step prompt.
None
default:"None"
Knowledge generation prompt.
int
default:"12000"
Maximum context tokens.
int
default:"12000"
Maximum data tokens.
int
default:"1000"
Maximum map response length in words.
int
default:"2000"
Maximum reduce response length in words.
int
default:"1"
Community rating threshold for inclusion.
bool
default:"False"
Keep parent community if children are relevant.
int
default:"1"
Number of times to rate each community.
bool
default:"False"
Use community summary instead of full context.
int
default:"2"
Maximum community hierarchy level.
str
default:"default_completion_model"
Completion model ID.

StorageDefaults

str
default:"file"
Storage type (from StorageType enum).
str | None
default:"None"
Text encoding.
str | None
default:"None"
Base directory for file storage.
None
default:"None"
Azure connection string.
None
default:"None"
Azure container name.
None
default:"None"
Azure account URL.
None
default:"None"
Azure CosmosDB account URL.

InputDefaults

InputType
default:"Text"
Input type.
str | None
default:"None"
Text encoding.
None
default:"None"
File pattern for matching input files.
None
default:"None"
Column name for document IDs.
None
default:"None"
Column name for document titles.
None
default:"None"
Column name for document text.

InputStorageDefaults

Extends StorageDefaults.
str
default:"input"
Base directory for input storage.

CacheStorageDefaults

Extends StorageDefaults.
str
default:"cache"
Base directory for cache storage.

CacheDefaults

CacheType
default:"Json"
Cache type.
CacheStorageDefaults
Cache storage configuration.

LocalSearchDefaults

None
default:"None"
Local search prompt.
float
default:"0.5"
Text unit proportion.
float
default:"0.15"
Community proportion.
int
default:"5"
Maximum conversation history turns.
int
default:"10"
Top k entities to retrieve.
int
default:"10"
Top k relationships to retrieve.
int
default:"12000"
Maximum context tokens.
str
default:"default_completion_model"
Completion model ID.
str
default:"default_embedding_model"
Embedding model ID.

OutputStorageDefaults

Extends StorageDefaults.
str
default:"output"
Base directory for output storage.

PruneGraphDefaults

int
default:"2"
Minimum node frequency.
None
default:"None"
Maximum node frequency standard deviation.
int
default:"1"
Minimum node degree.
None
default:"None"
Maximum node degree standard deviation.
float
default:"40.0"
Minimum edge weight percentage.
bool
default:"True"
Whether to remove ego nodes.
bool
default:"False"
Keep only largest connected component.

ReportingDefaults

ReportingType
default:"file"
Reporting type.
str
default:"logs"
Base directory for reporting.
None
default:"None"
Connection string for blob reporting.
None
default:"None"
Container name for blob reporting.
None
default:"None"
Storage account blob URL.

SnapshotsDefaults

bool
default:"False"
Whether to save embedding snapshots.
bool
default:"False"
Whether to save GraphML snapshots.
bool
default:"False"
Whether to save raw graph snapshots.

SummarizeDescriptionsDefaults

None
default:"None"
Summarization prompt.
int
default:"500"
Maximum summary length in tokens.
int
default:"4000"
Maximum input tokens.
str
default:"default_completion_model"
Completion model ID.
str
default:"summarize_descriptions"
Model instance name for caching.

UpdateOutputStorageDefaults

Extends StorageDefaults.
str
default:"update_output"
Base directory for update output storage.

VectorStoreDefaults

str
default:"lancedb"
Vector store type (from VectorStoreType enum).
str
default:"output/lancedb"
Database URI for vector store.

GraphRagConfigDefaults

Root configuration defaults.
dict
default:"{}"
Legacy model configurations.
dict
default:"{}"
Completion model configurations.
dict
default:"{}"
Embedding model configurations.
int
default:"25"
Default concurrent requests.
AsyncType
default:"Threaded"
Default async mode.
ReportingDefaults
Reporting configuration defaults.
InputStorageDefaults
Input storage configuration defaults.
OutputStorageDefaults
Output storage configuration defaults.
UpdateOutputStorageDefaults
Update output storage configuration defaults.
CacheDefaults
Cache configuration defaults.
InputDefaults
Input configuration defaults.
EmbedTextDefaults
Text embedding configuration defaults.
ChunkingDefaults
Chunking configuration defaults.
SnapshotsDefaults
Snapshots configuration defaults.
ExtractGraphDefaults
Graph extraction configuration defaults.
ExtractGraphNLPDefaults
NLP graph extraction configuration defaults.
SummarizeDescriptionsDefaults
Description summarization configuration defaults.
CommunityReportDefaults
Community reports configuration defaults.
ExtractClaimsDefaults
Claims extraction configuration defaults.
PruneGraphDefaults
Graph pruning configuration defaults.
ClusterGraphDefaults
Graph clustering configuration defaults.
Local search configuration defaults.
Global search configuration defaults.
DRIFT search configuration defaults.
Basic search configuration defaults.
VectorStoreDefaults
Vector store configuration defaults.
None
default:"None"
Workflows list.