Chunkers (maticlib.core.text.chunkers)
Splits large documents into optimal TextSegments for embedding.
Available Chunkers
SeparatorChunker: Splits cleanly by characters (e.g.,\n\n).TokenBudgetChunker: Splits strictly by a max LLM token count usingtiktoken.SemanticDifferenceChunker: Splits by detecting large shifts in meaning using vector math.HierarchicalChunker: Groups smaller child chunks into larger parent chunks for broad context retrieval.