FastText inference optimization with trie-backed n-gram ids, mark-compact vector storage, and mmap-friendly retrieval.
nlp information-retrieval compression word-embeddings trie embeddings mmap chinese-nlp fasttext memory-efficient model-compression model-serving efficient-inference double-array-trie inference-optimization subword-embeddings lexical-search dynamic-memory-management datrie conditional-memory
-
Updated
Sep 21, 2026 - C++