Hugging Face's logo Hugging Face
  • Models
  • Datasets
  • Spaces
  • Buckets new
  • Docs
  • Enterprise
  • Pricing
    • Website
      • Tasks
      • HuggingChat
      • Collections
      • Languages
      • Organizations
    • Community
      • Blog
      • Posts
      • Daily Papers
      • Hardware
      • Learn
      • Discord
      • Forum
      • GitHub
    • Solutions
      • Team & Enterprise
      • Hugging Face PRO
      • Enterprise Support
      • Inference Providers
      • Inference Endpoints
      • Storage Buckets

  • Log In
  • Sign Up

sparse-encoder
/
example-splade-distilbert-base-uncased-msmarco-mrl

Feature Extraction
sentence-transformers
Safetensors
English
distilbert
sparse-encoder
sparse
splade
Generated from Trainer
dataset_size:90000
loss:SpladeLoss
loss:SparseMultipleNegativesRankingLoss
loss:FlopsLoss
Eval Results (legacy)
text-embeddings-inference
Model card Files Files and versions
xet
Community

Instructions to use sparse-encoder/example-splade-distilbert-base-uncased-msmarco-mrl with libraries, inference providers, notebooks, and local apps. Follow these links to get started.

  • Libraries
  • sentence-transformers

    How to use sparse-encoder/example-splade-distilbert-base-uncased-msmarco-mrl with sentence-transformers:

    from sentence_transformers import SparseEncoder
    
    model = SparseEncoder("sparse-encoder/example-splade-distilbert-base-uncased-msmarco-mrl")
    
    queries = ["Which planet is known as the Red Planet?"]
    documents = [
    	"Venus is often called Earth's twin because of its similar size and proximity.",
    	"Mars, known for its reddish appearance, is often referred to as the Red Planet.",
    	"Jupiter, the largest planet in our solar system, has a prominent red spot.",
    ]
    
    query_embeddings = model.encode_query(queries)
    document_embeddings = model.encode_document(documents)
    
    similarities = model.similarity(query_embeddings, document_embeddings)
    print(similarities)
  • Notebooks
  • Google Colab
  • Kaggle
example-splade-distilbert-base-uncased-msmarco-mrl
269 MB
Ctrl+K
Ctrl+K
  • 1 contributor
History: 2 commits
arthurbresnu's picture
arthurbresnu
Add new SparseEncoder model
2e04eb9 verified over 1 year ago
  • 1_SpladePooling
    Add new SparseEncoder model over 1 year ago
  • .gitattributes
    1.52 kB
    initial commit over 1 year ago
  • README.md
    89.7 kB
    Add new SparseEncoder model over 1 year ago
  • config.json
    506 Bytes
    Add new SparseEncoder model over 1 year ago
  • config_sentence_transformers.json
    279 Bytes
    Add new SparseEncoder model over 1 year ago
  • model.safetensors
    268 MB
    xet
    Add new SparseEncoder model over 1 year ago
  • modules.json
    274 Bytes
    Add new SparseEncoder model over 1 year ago
  • sentence_bert_config.json
    57 Bytes
    Add new SparseEncoder model over 1 year ago
  • special_tokens_map.json
    125 Bytes
    Add new SparseEncoder model over 1 year ago
  • tokenizer.json
    712 kB
    Add new SparseEncoder model over 1 year ago
  • tokenizer_config.json
    1.23 kB
    Add new SparseEncoder model over 1 year ago
  • vocab.txt
    232 kB
    Add new SparseEncoder model over 1 year ago