XLM-R

E435876

XLM-R is a multilingual transformer-based language model (XLM-RoBERTa) designed for cross-lingual understanding and natural language processing across many languages.

All labels observed (3)

Label Occurrences
XLM-R canonical 1
XLM-R-base 1
XLM-R-large 1

How this entity was disambiguated

Statements (48)

Predicate Object
instanceOf XLM-RoBERTa architecture
masked language model
multilingual language model
transformer-based model
architecture Transformer
basedOn RoBERTa
compatibleWith Hugging Face Transformers
designedFor cross-lingual generalization
multilingual NLP
developedBy Facebook AI
linked to: Meta AI

Meta AI
family RoBERTa family
linked to: RoBERTa

XLM family
handlesScriptTypes Arabic
CJK
Cyrillic
Devanagari
linked to: Devanagari script

Latin
hasEncoderLayersApprox 12 (base variant)
24 (large variant)
inputType text
languageModelType encoder-only transformer
pretrainingDataType CommonCrawl
linked to: Common Crawl
pretrainingObjective masked language modeling
primaryUseContext production NLP systems
research
releasedAs open-source model
releasedByOrganizationType industry research lab
supportsLanguages multilingual
supportsLanguagesCountApprox 100+
over 100 languages
supportsTask cross-lingual transfer learning
cross-lingual understanding
multilingual representation learning
named entity recognition
natural language processing
question answering
sentence embedding
sequence labeling
text classification
token-level classification
zero-shot cross-lingual transfer
tokenizationMethod SentencePiece
usesPositionalEncoding true
usesSelfAttention true
usesSubwordTokenization true
variant XLM-R-base
linked to: XLM-R

XLM-R-large
linked to: XLM-R

How these facts were elicited

Referenced by (3)

Full triples — surface form annotated when it differs from this entity's canonical label.

XLM-R variant XLM-R-base
linked to: XLM-R
XLM-R variant XLM-R-large
linked to: XLM-R