Model defaults
Completion models
str
default:"default_completion_model"
Default identifier for completion model configurations.
str
default:"gpt-4.1"
Default completion model name.
AuthMethod
default:"ApiKey"
Default authentication method for completion models.
str
default:"openai"
Default model provider.
Embedding models
str
default:"default_embedding_model"
Default identifier for embedding model configurations.
str
default:"text-embedding-3-large"
Default embedding model name.
AuthMethod
default:"ApiKey"
Default authentication method for embedding models.
Encoding
str
default:"o200k_base"
Default encoding model for tokenization.
Directory defaults
str
default:"input"
Default base directory for input files.
str
default:"output"
Default base directory for output files.
str
default:"cache"
Default base directory for cache storage.
str
default:"update_output"
Default base directory for incremental update output.
Entity types
list[str]
Default entity types to extract during graph construction.
Configuration class defaults
The following sections document default values for each configuration class.BasicSearchDefaults
None
default:"None"
Basic search prompt template.
int
default:"10"
Number of results to return.
int
default:"12000"
Maximum context tokens.
str
default:"default_completion_model"
Completion model ID.
str
default:"default_embedding_model"
Embedding model ID.
ChunkingDefaults
str
default:"tokens"
Chunking strategy type (from ChunkerType enum).
int
default:"1200"
Chunk size in tokens.
int
default:"100"
Overlap between chunks in tokens.
str
default:"o200k_base"
Encoding model for tokenization.
None
default:"None"
Metadata to prepend to chunks.
ClusterGraphDefaults
int
default:"10"
Maximum size of clusters.
bool
default:"True"
Whether to use the largest connected component.
int
default:"0xDEADBEEF"
Random seed for clustering (3735928559 in decimal).
CommunityReportDefaults
None
default:"None"
Prompt for graph-based community reports.
None
default:"None"
Prompt for text-based community reports.
int
default:"2000"
Maximum report length in tokens.
int
default:"8000"
Maximum input length in tokens.
str
default:"default_completion_model"
Completion model ID.
str
default:"community_reporting"
Model instance name for caching.
DriftSearchDefaults
None
default:"None"
DRIFT search prompt.
None
default:"None"
Reduce step prompt.
int
default:"12000"
Maximum data tokens.
None
default:"None"
Maximum reduce tokens.
float
default:"0"
Temperature for reduce step.
None
default:"None"
Maximum completion tokens for reduce.
int
default:"32"
Concurrency level for DRIFT operations.
int
default:"20"
Number of followup queries.
int
default:"5"
Number of primer folds.
int
default:"12000"
Maximum tokens for primer LLM.
int
default:"3"
Search depth.
float
default:"0.9"
Text unit proportion for local search component.
float
default:"0.1"
Community proportion for local search component.
int
default:"10"
Top k entities for local search.
int
default:"10"
Top k relationships for local search.
int
default:"12000"
Maximum data tokens for local search.
float
default:"0"
Temperature for local search.
float
default:"1"
Top p for local search.
int
default:"1"
Number of completions for local search.
int | None
default:"None"
Maximum generation tokens for local search.
int | None
default:"None"
Maximum completion tokens for local search.
str
default:"default_completion_model"
Completion model ID.
str
default:"default_embedding_model"
Embedding model ID.
EmbedTextDefaults
str
default:"default_embedding_model"
Embedding model ID.
str
default:"text_embedding"
Model instance name for caching.
int
default:"16"
Batch size for embedding operations.
int
default:"8191"
Maximum tokens per batch.
list[str]
List of embeddings to generate (uses default_embeddings).
ExtractClaimsDefaults
bool
default:"False"
Whether claim extraction is enabled.
None
default:"None"
Claim extraction prompt.
str
Description of claims to extract.
int
default:"1"
Maximum number of gleaning iterations.
str
default:"default_completion_model"
Completion model ID.
str
default:"extract_claims"
Model instance name for caching.
ExtractGraphDefaults
None
default:"None"
Graph extraction prompt.
list[str]
Entity types to extract.
int
default:"1"
Maximum number of gleaning iterations.
str
default:"default_completion_model"
Completion model ID.
str
default:"extract_graph"
Model instance name for caching.
TextAnalyzerDefaults
Used for NLP-based graph extraction.NounPhraseExtractorType
default:"RegexEnglish"
Noun phrase extractor type.
str
default:"en_core_web_md"
SpaCy model name.
int
default:"15"
Maximum word length to consider.
str
default:"' '"
Delimiter between words.
bool
default:"True"
Whether to include named entities.
list[str]
List of nouns to exclude (uses EN_STOP_WORDS).
list[str]
default:"[\"DATE\"]"
Entity tags to exclude.
list[str]
default:"[\"DET\", \"PRON\", \"INTJ\", \"X\"]"
Part-of-speech tags to exclude.
list[str]
default:"[\"PROPN\", \"NOUNS\"]"
Tags for noun phrases.
dict[str, str]
Grammar rules for noun phrase combination.Default:
ExtractGraphNLPDefaults
bool
default:"True"
Whether to normalize edge weights.
TextAnalyzerDefaults
Text analyzer configuration.
int
default:"25"
Number of concurrent requests.
AsyncType
default:"Threaded"
Async mode to use.
GlobalSearchDefaults
None
default:"None"
Map step prompt.
None
default:"None"
Reduce step prompt.
None
default:"None"
Knowledge generation prompt.
int
default:"12000"
Maximum context tokens.
int
default:"12000"
Maximum data tokens.
int
default:"1000"
Maximum map response length in words.
int
default:"2000"
Maximum reduce response length in words.
int
default:"1"
Community rating threshold for inclusion.
bool
default:"False"
Keep parent community if children are relevant.
int
default:"1"
Number of times to rate each community.
bool
default:"False"
Use community summary instead of full context.
int
default:"2"
Maximum community hierarchy level.
str
default:"default_completion_model"
Completion model ID.
StorageDefaults
str
default:"file"
Storage type (from StorageType enum).
str | None
default:"None"
Text encoding.
str | None
default:"None"
Base directory for file storage.
None
default:"None"
Azure connection string.
None
default:"None"
Azure container name.
None
default:"None"
Azure account URL.
None
default:"None"
Azure CosmosDB account URL.
InputDefaults
InputType
default:"Text"
Input type.
str | None
default:"None"
Text encoding.
None
default:"None"
File pattern for matching input files.
None
default:"None"
Column name for document IDs.
None
default:"None"
Column name for document titles.
None
default:"None"
Column name for document text.
InputStorageDefaults
Extends StorageDefaults.str
default:"input"
Base directory for input storage.
CacheStorageDefaults
Extends StorageDefaults.str
default:"cache"
Base directory for cache storage.
CacheDefaults
CacheType
default:"Json"
Cache type.
CacheStorageDefaults
Cache storage configuration.
LocalSearchDefaults
None
default:"None"
Local search prompt.
float
default:"0.5"
Text unit proportion.
float
default:"0.15"
Community proportion.
int
default:"5"
Maximum conversation history turns.
int
default:"10"
Top k entities to retrieve.
int
default:"10"
Top k relationships to retrieve.
int
default:"12000"
Maximum context tokens.
str
default:"default_completion_model"
Completion model ID.
str
default:"default_embedding_model"
Embedding model ID.
OutputStorageDefaults
Extends StorageDefaults.str
default:"output"
Base directory for output storage.
PruneGraphDefaults
int
default:"2"
Minimum node frequency.
None
default:"None"
Maximum node frequency standard deviation.
int
default:"1"
Minimum node degree.
None
default:"None"
Maximum node degree standard deviation.
float
default:"40.0"
Minimum edge weight percentage.
bool
default:"True"
Whether to remove ego nodes.
bool
default:"False"
Keep only largest connected component.
ReportingDefaults
ReportingType
default:"file"
Reporting type.
str
default:"logs"
Base directory for reporting.
None
default:"None"
Connection string for blob reporting.
None
default:"None"
Container name for blob reporting.
None
default:"None"
Storage account blob URL.
SnapshotsDefaults
bool
default:"False"
Whether to save embedding snapshots.
bool
default:"False"
Whether to save GraphML snapshots.
bool
default:"False"
Whether to save raw graph snapshots.
SummarizeDescriptionsDefaults
None
default:"None"
Summarization prompt.
int
default:"500"
Maximum summary length in tokens.
int
default:"4000"
Maximum input tokens.
str
default:"default_completion_model"
Completion model ID.
str
default:"summarize_descriptions"
Model instance name for caching.
UpdateOutputStorageDefaults
Extends StorageDefaults.str
default:"update_output"
Base directory for update output storage.
VectorStoreDefaults
str
default:"lancedb"
Vector store type (from VectorStoreType enum).
str
default:"output/lancedb"
Database URI for vector store.
GraphRagConfigDefaults
Root configuration defaults.dict
default:"{}"
Legacy model configurations.
dict
default:"{}"
Completion model configurations.
dict
default:"{}"
Embedding model configurations.
int
default:"25"
Default concurrent requests.
AsyncType
default:"Threaded"
Default async mode.
ReportingDefaults
Reporting configuration defaults.
InputStorageDefaults
Input storage configuration defaults.
OutputStorageDefaults
Output storage configuration defaults.
UpdateOutputStorageDefaults
Update output storage configuration defaults.
CacheDefaults
Cache configuration defaults.
InputDefaults
Input configuration defaults.
EmbedTextDefaults
Text embedding configuration defaults.
ChunkingDefaults
Chunking configuration defaults.
SnapshotsDefaults
Snapshots configuration defaults.
ExtractGraphDefaults
Graph extraction configuration defaults.
ExtractGraphNLPDefaults
NLP graph extraction configuration defaults.
SummarizeDescriptionsDefaults
Description summarization configuration defaults.
CommunityReportDefaults
Community reports configuration defaults.
ExtractClaimsDefaults
Claims extraction configuration defaults.
PruneGraphDefaults
Graph pruning configuration defaults.
ClusterGraphDefaults
Graph clustering configuration defaults.
LocalSearchDefaults
Local search configuration defaults.
GlobalSearchDefaults
Global search configuration defaults.
DriftSearchDefaults
DRIFT search configuration defaults.
BasicSearchDefaults
Basic search configuration defaults.
VectorStoreDefaults
Vector store configuration defaults.
None
default:"None"
Workflows list.