Maximum UTF-8 source bytes read across the corpus.
Maximum vocabulary size accepted across the corpus.
Maximum sum of per-document unique-term entries retained in sparse maps.
Maximum emitted tokens accepted across the corpus.
Maximum unique terms accepted from one document.
Maximum UTF-8 source bytes accepted from one document.
Maximum Markdown documents admitted to one corpus.
Maximum emitted tokens accepted from one document.
Maximum directory entries inspected while discovering that corpus.
Explicit resource envelope for one scoped TF-IDF corpus build.