ICE evaluates per-text perplexity across regional English corpora covering spoken and written language.
unassessed
| Category | generation |
|---|---|
| Subcategory | English language modeling |
| Page status | active |
| Metric | bits_per_byte |
| Direction | lower_is_better |
| Publisher | International Corpus of English |
The International Corpus of English contains written and spoken texts from regional English varieties. HELM evaluates language-model perplexity on texts after removing most corpus markup.
Language-model scoring over corpus texts, optionally filtered by region, speech/writing category, or supported gender metadata.
No model card in ModelSpec reports this benchmark yet.