2 ms·
I'd like to know: How the language model-based tokenizers fare on domain-specific documents, since language models don't have context for unknown tokens. Are
by justlexi93 7y ago
I'd like to know:
How the language model-based tokenizers fare on domain-specific documents, since language models don't have context for unknown tokens.
Are language model-based tokenizers any better at identifying abbreviations than rule-based ones?