Code
Hub
Workspaces
Following
Trending
Connect
MCP
copy
Create free account
hub
/
github.com/huggingface/sentence-transformers
/ types & classes
Types & classes
446 in github.com/huggingface/sentence-transformers
⨍
Functions
3,759
◇
Types & classes
446
↳
Endpoints
48
↓ 205 callers
Class
SentenceTransformer
Loads or creates a SentenceTransformer model that can be used to map text and other inputs to dense embeddings. Args: model_name_or_
sentence_transformers/sentence_transformer/model.py:40
↓ 107 callers
Class
Transformer
Hugging Face AutoModel wrapper that handles loading, preprocessing, and inference. Loads the appropriate model class (e.g. BERT, RoBERTa, CLIP, W
sentence_transformers/base/modules/transformer.py:644
↓ 93 callers
Class
SentenceTransformerTrainer
SentenceTransformerTrainer is a simple but feature-complete training and eval loop for PyTorch based on the 🤗 Transformers :class:`~transform
sentence_transformers/sentence_transformer/trainer.py:36
↓ 91 callers
Class
SentenceTransformerTrainingArguments
r""" SentenceTransformerTrainingArguments extends :class:`~sentence_transformers.base.training_args.BaseTrainingArguments` with additional arg
sentence_transformers/sentence_transformer/training_args.py:10
↓ 85 callers
Class
MultiVectorEncoder
Loads or creates a multi-vector / late-interaction (ColBERT-style) embedding model. Unlike :class:`~sentence_transformers.sentence_transform
sentence_transformers/multi_vector_encoder/model.py:65
↓ 83 callers
Class
CrossEncoder
Loads or creates a CrossEncoder model that takes a sentence pair as input and outputs a score or label. A CrossEncoder does not produce sent
sentence_transformers/cross_encoder/model.py:35
↓ 67 callers
Class
InputFormatter
Handles input parsing, modality detection, and message format conversion. This class manages the complete input preprocessing pipeline: 1. Pa
sentence_transformers/base/modality.py:263
↓ 59 callers
Class
SparseEncoder
Loads or creates a SparseEncoder model that can be used to map text to sparse embeddings. Args: model_name_or_path (str, optional):
sentence_transformers/sparse_encoder/model.py:34
↓ 52 callers
Class
Router
sentence_transformers/base/modules/router.py:29
↓ 49 callers
Class
Pooling
Performs pooling on token embeddings to produce fixed-size sentence embeddings. Generates a fixed-size sentence embedding from variable-length to
sentence_transformers/sentence_transformer/modules/pooling.py:70
↓ 45 callers
Class
MultipleNegativesRankingLoss
sentence_transformers/cross_encoder/losses/multiple_negatives_ranking.py:12
↓ 44 callers
Class
EmbeddingSimilarityEvaluator
Evaluate a model based on the similarity of the embeddings by calculating the Spearman and Pearson rank correlation in comparison to the gold
sentence_transformers/sentence_transformer/evaluation/embedding_similarity.py:27
↓ 37 callers
Class
CrossEncoderTrainer
CrossEncoderTrainer is a simple but feature-complete training and eval loop for PyTorch based on the 🤗 Transformers :class:`~transformers.Tra
sentence_transformers/cross_encoder/trainer.py:34
↓ 37 callers
Class
HierarchicalTokenPooling
Ward-linkage hierarchical clustering on cosine similarity. Keeps the first ``num_protected_tokens`` untouched (typically the ``[CLS]``), clusters
sentence_transformers/multi_vector_encoder/modules/token_pooling.py:223
↓ 34 callers
Class
CachedMultipleNegativesRankingLoss
sentence_transformers/cross_encoder/losses/cached_multiple_negatives_ranking.py:18
↓ 33 callers
Class
CrossEncoderTrainingArguments
r""" CrossEncoderTrainingArguments extends :class:`~sentence_transformers.base.training_args.BaseTrainingArguments` with additional arguments
sentence_transformers/cross_encoder/training_args.py:9
↓ 32 callers
Class
Dense
Applies a linear transformation with an optional activation function. Passes the embedding through a feed-forward layer (``nn.Linear`` + activati
sentence_transformers/base/modules/dense.py:21
↓ 23 callers
Class
CosineSimilarityLoss
sentence_transformers/sentence_transformer/losses/cosine_similarity.py:14
↓ 23 callers
Class
MatryoshkaLoss
sentence_transformers/sentence_transformer/losses/matryoshka.py:116
↓ 21 callers
Class
_PassthroughModel
Stub model that returns the ``token_embeddings`` already placed in the feature dict. The losses call ``self.model(sf, task=...)["token_embeddings
tests/multi_vector_encoder/losses/test_misc.py:28
↓ 20 callers
Class
CrossEncoderNanoBEIREvaluator
This class evaluates a CrossEncoder model on the NanoBEIR collection of Information Retrieval datasets. The collection is a set of datasets
sentence_transformers/cross_encoder/evaluation/nano_beir.py:53
↓ 19 callers
Class
BinaryCrossEntropyLoss
sentence_transformers/cross_encoder/losses/binary_cross_entropy.py:9
↓ 19 callers
Class
SequentialEvaluator
This evaluator allows that multiple sub-evaluators are passed. When the model is evaluated, the data is passed sequentially to all sub-evalua
sentence_transformers/base/evaluation/sequential.py:12
↓ 19 callers
Class
SparseEncoderTrainer
SparseEncoderTrainer is a simple but feature-complete training and eval loop for PyTorch based on the SentenceTransformerTrainer that based o
sentence_transformers/sparse_encoder/trainer.py:35
↓ 19 callers
Class
SparseMultipleNegativesRankingLoss
sentence_transformers/sparse_encoder/losses/sparse_multiple_negatives_ranking.py:13
↓ 18 callers
Class
EmbedDistillLoss
sentence_transformers/sentence_transformer/losses/embed_distill.py:16
↓ 18 callers
Class
Normalize
L2-normalizes the embeddings under one of the feature keys to have unit length. By default operates on the pooled ``sentence_embedding`` produced
sentence_transformers/base/modules/normalize.py:14
↓ 18 callers
Class
SparseEncoderTrainingArguments
r""" SparseEncoderTrainingArguments extends :class:`~sentence_transformers.base.training_args.BaseTrainingArguments` with additional arguments
sentence_transformers/sparse_encoder/training_args.py:9
↓ 18 callers
Class
SpladeLoss
sentence_transformers/sparse_encoder/losses/splade.py:16
↓ 16 callers
Class
NanoBEIREvaluator
This class evaluates the performance of a SentenceTransformer Model on the NanoBEIR collection of Information Retrieval datasets. The NanoBE
sentence_transformers/sentence_transformer/evaluation/nano_beir.py:57
↓ 15 callers
Class
GroupByLabelBatchSampler
Batch sampler that groups samples by label for in-batch triplet mining. Samples are shuffled within each label, then interleaved in round-ro
sentence_transformers/base/sampler.py:228
↓ 15 callers
Class
MultiVectorMask
Module that overwrites ``features["attention_mask"]`` with the per-row *scoring* mask for late-interaction (ColBERT-style) models. Place this
sentence_transformers/multi_vector_encoder/modules/multi_vector_mask.py:18
↓ 14 callers
Class
CrossEncoderRerankingEvaluator
This class evaluates a CrossEncoder model for the task of re-ranking. Given a query and a list of documents, it computes the score [query, d
sentence_transformers/cross_encoder/evaluation/reranking.py:19
↓ 14 callers
Class
FakeProcessor
Minimal stand-in exposing the two attributes the pair-role probe touches.
tests/base/test_modality.py:1570
↓ 14 callers
Class
SparseEncoderModelCardData
A dataclass storing data used in the model card. Args: language (`Optional[Union[str, List[str]]]`): The model language, either a string
sentence_transformers/sparse_encoder/model_card.py:25
↓ 14 callers
Class
_FakeLoss
Minimal stand-in for a loss object in compute_dataset_metrics calls.
tests/base/test_model_card.py:67
↓ 13 callers
Class
InformationRetrievalEvaluator
This class evaluates an Information Retrieval (IR) setting. Given a set of queries and a large corpus set. It will retrieve for each query t
sentence_transformers/sentence_transformer/evaluation/information_retrieval.py:24
↓ 13 callers
Class
MultiVectorEncoderModelCardData
A dataclass storing data used in the model card for :class:`~sentence_transformers.multi_vector_encoder.model.MultiVectorEncoder` models. Args:
sentence_transformers/multi_vector_encoder/model_card.py:24
↓ 13 callers
Class
SentenceTransformerModelCardData
A dataclass storing data used in the model card. Args: language (`Optional[Union[str, List[str]]]`): The model language, either a string
sentence_transformers/sentence_transformer/model_card.py:22
↓ 12 callers
Class
CrossEncoderModelCardData
A dataclass storing data used in the model card. Args: language (`Optional[Union[str, List[str]]]`): The model language, either a string
sentence_transformers/cross_encoder/model_card.py:38
↓ 12 callers
Class
MultiVectorEncoderTrainer
Trainer for :class:`~sentence_transformers.multi_vector_encoder.model.MultiVectorEncoder` (multi-vector / ColBERT-style) models. Inherits all fun
sentence_transformers/multi_vector_encoder/trainer.py:36
↓ 12 callers
Class
MultiVectorEncoderTrainingArguments
Training arguments for :class:`~sentence_transformers.multi_vector_encoder.model.MultiVectorEncoder` training. Inherits all fields from :class:`~
sentence_transformers/multi_vector_encoder/training_args.py:10
↓ 12 callers
Class
MultiVectorInformationRetrievalEvaluator
Evaluates a :class:`~sentence_transformers.multi_vector_encoder.model.MultiVectorEncoder` model on an information-retrieval (IR) task. For each qu
sentence_transformers/multi_vector_encoder/evaluation/information_retrieval.py:26
↓ 11 callers
Class
AdaptiveLayerLoss
sentence_transformers/sentence_transformer/losses/adaptive_layer.py:84
↓ 11 callers
Class
MegaBatchMarginLoss
sentence_transformers/sentence_transformer/losses/mega_batch_margin.py:20
↓ 11 callers
Class
SparseNanoBEIREvaluator
This evaluator extends :class:`~sentence_transformers.sentence_transformer.evaluation.NanoBEIREvaluator` but is specifically designed for sparse
sentence_transformers/sparse_encoder/evaluation/sparse_nano_beir.py:28
↓ 11 callers
Class
_MockVideoDecoder
Minimal mock for ``torchcodec.decoders.VideoDecoder``. When ``fail_batch=True``, :meth:`get_frames_at` always raises. When ``fail_single=True
tests/base/test_model_card.py:999
↓ 11 callers
Class
_MockVideoMetadata
Minimal stand-in for ``torchcodec`` video metadata.
tests/base/test_model_card.py:979
↓ 10 callers
Class
DenoisingAutoEncoderLoss
sentence_transformers/sentence_transformer/losses/denoising_auto_encoder.py:37
↓ 10 callers
Class
LambdaTokenPooling
User-supplied pool function applied per-sample. Cannot be baked into a saved checkpoint (a Python callable isn't serializable), and will not
sentence_transformers/multi_vector_encoder/modules/token_pooling.py:270
↓ 10 callers
Class
MSELoss
sentence_transformers/cross_encoder/losses/mse.py:9
↓ 9 callers
Class
InputExample
Structure for one input example with texts, the label and a unique id
sentence_transformers/sentence_transformer/readers/input_example.py:14
↓ 9 callers
Class
MultiVectorDistillationEvaluator
Distillation evaluator for :class:`~sentence_transformers.multi_vector_encoder.model.MultiVectorEncoder` models. Two data shapes are supported:
sentence_transformers/multi_vector_encoder/evaluation/distillation.py:24
↓ 9 callers
Class
NoDuplicatesBatchSampler
sentence_transformers/base/sampler.py:406
↓ 9 callers
Class
TaskTypesTrackingModuleDict
tests/base/modules/test_router.py:96
↓ 8 callers
Class
DistillKLDivLoss
sentence_transformers/sentence_transformer/losses/distill_kl_div.py:19
↓ 8 callers
Class
MockModuleWithMaxLength
tests/base/modules/test_router.py:70
↓ 8 callers
Class
MultiVectorNanoBEIREvaluator
Evaluates a :class:`~sentence_transformers.multi_vector_encoder.model.MultiVectorEncoder` model on the `NanoBEIR collection <https://huggingface.c
sentence_transformers/multi_vector_encoder/evaluation/nano_beir.py:14
↓ 7 callers
Class
MockModule
tests/base/modules/test_router.py:31
↓ 7 callers
Class
SpladePooling
SPLADE Pooling module for creating the sparse embeddings. This module implements the SPLADE pooling mechanism that: 1. Takes token logi
sentence_transformers/sparse_encoder/modules/splade_pooling.py:14
↓ 6 callers
Class
CachedGISTEmbedLoss
sentence_transformers/sentence_transformer/losses/cached_gist_embed.py:25
↓ 6 callers
Class
CoSENTLoss
sentence_transformers/sentence_transformer/losses/cosent.py:14
↓ 6 callers
Class
GISTEmbedLoss
sentence_transformers/sentence_transformer/losses/gist_embed.py:16
↓ 6 callers
Class
MultiVectorMultipleNegativesRankingLoss
In-batch negatives contrastive loss for :class:`~sentence_transformers.multi_vector_encoder.model.MultiVectorEncoder` models. For each query in t
sentence_transformers/multi_vector_encoder/losses/multiple_negatives_ranking.py:21
↓ 6 callers
Class
RandContext
Snapshot the CPU/CUDA/MPS RNG at init and restore it on enter, so the cached second forward replays the first's randomness (e.g. dropout). Ref: ht
sentence_transformers/base/losses/gradcache.py:31
↓ 6 callers
Class
TripletEvaluator
Evaluate a model based on a triplet: (sentence, positive_example, negative_example). Checks if ``similarity(sentence, positive_example) > sim
sentence_transformers/sentence_transformer/evaluation/triplet.py:28
↓ 5 callers
Class
BinaryClassificationEvaluator
Evaluate a model based on the similarity of the embeddings by calculating the accuracy of identifying similar and dissimilar sentences. T
sentence_transformers/sentence_transformer/evaluation/binary_classification.py:27
↓ 5 callers
Class
CachedSpladeLoss
sentence_transformers/sparse_encoder/losses/cached_splade.py:35
↓ 5 callers
Class
CrossEncoderCorrelationEvaluator
This evaluator can be used with the CrossEncoder class. Given sentence pairs and continuous scores, it compute the pearson & spearman correla
sentence_transformers/cross_encoder/evaluation/correlation.py:19
↓ 5 callers
Class
LambdaLoss
sentence_transformers/cross_encoder/losses/lambda_loss.py:103
↓ 5 callers
Class
MultiVectorEncoderDataCollator
Data collator for :class:`~sentence_transformers.multi_vector_encoder.model.MultiVectorEncoder` training. Differs from :class:`~sentence_transfor
sentence_transformers/multi_vector_encoder/data_collator.py:9
↓ 5 callers
Class
MultiVectorTripletEvaluator
Triplet evaluator for :class:`~sentence_transformers.multi_vector_encoder.model.MultiVectorEncoder` models. Given ``(anchor, positive, negative)`
sentence_transformers/multi_vector_encoder/evaluation/triplet.py:19
↓ 5 callers
Class
RerankingEvaluator
This class evaluates a SentenceTransformer model for the task of re-ranking. Given a query and a list of documents, it computes the score [q
sentence_transformers/sentence_transformer/evaluation/reranking.py:27
↓ 5 callers
Class
SimilarityFunction
Enum class for supported similarity functions. The following functions are supported: - ``SimilarityFunction.COSINE`` (``"cosine"``): Cosine
sentence_transformers/util/similarity.py:814
↓ 5 callers
Class
SoftmaxLoss
sentence_transformers/sentence_transformer/losses/softmax.py:19
↓ 5 callers
Class
StaticEmbedding
sentence_transformers/sentence_transformer/modules/static_embedding.py:28
↓ 5 callers
Class
WhitespaceTokenizer
Simple and fast white-space tokenizer. Splits sentence based on white spaces. Punctuation are stripped from tokens.
sentence_transformers/sentence_transformer/modules/tokenizer/whitespace.py:12
↓ 5 callers
Class
XTRScores
Configured, reusable :func:`xtr_scores` callable for use as a loss ``similarity_fct``. Stores ``top_k`` / ``chunk_elements`` so they don't have t
sentence_transformers/multi_vector_encoder/scoring/xtr.py:189
↓ 5 callers
Class
_EchoModel
tests/sentence_transformer/losses/test_contrastive.py:15
↓ 5 callers
Class
_LegacyStash
Per-checkpoint values recovered from legacy save formats (PyLate v3 top-level config, Stanford-NLP ColBERT ``artifact.metadata``) that downstream
sentence_transformers/multi_vector_encoder/model.py:44
↓ 4 callers
Class
ContrastiveLoss
sentence_transformers/sentence_transformer/losses/contrastive.py:23
↓ 4 callers
Class
MarginMSELoss
sentence_transformers/cross_encoder/losses/margin_mse.py:10
↓ 4 callers
Class
NDCGLoss2PPScheme
Implementation of NDCG Loss2++ weighting scheme. It is a hybrid weighting scheme that combines the NDCGLoss2 and LambdaRank schemes. It was s
sentence_transformers/cross_encoder/losses/lambda_loss.py:84
↓ 4 callers
Class
ParaphraseMiningEvaluator
Given a large set of sentences, this evaluator performs paraphrase (duplicate) mining and identifies the pairs with the highest similarity. I
sentence_transformers/sentence_transformer/evaluation/paraphrase_mining.py:18
↓ 4 callers
Class
ReciprocalRankFusionEvaluator
This class evaluates a hybrid search approach using Reciprocal Rank Fusion (RRF). Given a query and two separate ranked lists of documents f
sentence_transformers/sparse_encoder/evaluation/reciprocal_rank_fusion.py:17
↓ 4 callers
Class
RoundRobinBatchSampler
Batch sampler that yields batches in a round-robin fashion from multiple batch samplers, until one is exhausted. With this sampler, it's unli
sentence_transformers/base/sampler.py:668
↓ 4 callers
Class
SparseEmbeddingSimilarityEvaluator
This evaluator extends :class:`~sentence_transformers.sentence_transformer.evaluation.EmbeddingSimilarityEvaluator` but is specifically designed
sentence_transformers/sparse_encoder/evaluation/sparse_embedding_similarity.py:22
↓ 4 callers
Class
SparseInformationRetrievalEvaluator
This evaluator extends :class:`~sentence_transformers.sentence_transformer.evaluation.InformationRetrievalEvaluator` but is specifically designed
sentence_transformers/sparse_encoder/evaluation/sparse_information_retrieval.py:24
↓ 4 callers
Class
StubQdrantClient
Records the query vector of every search, and answers each one with the same single hit.
tests/sparse_encoder/test_search_engines.py:95
↓ 4 callers
Class
_SortedIdIndex
``id -> row position`` lookup backed by sorted numpy arrays. A python dict retains a hash table plus every key object, and rebuilds that table in
sentence_transformers/util/dataset.py:76
↓ 4 callers
Class
_TokenizingModel
Embeds integer ``input_ids`` as one-hot vectors, mirroring how a real model turns padded token batches into embeddings while the attention mask ma
tests/multi_vector_encoder/losses/test_misc.py:578
↓ 3 callers
Class
CachedMultiVectorMultipleNegativesRankingLoss
A GradCache version of :class:`MultiVectorMultipleNegativesRankingLoss`. Enables much larger effective batch sizes than the non-cached loss at th
sentence_transformers/multi_vector_encoder/losses/cached_multiple_negatives_ranking.py:31
↓ 3 callers
Class
ContrastiveTensionLoss
This loss expects only single inputs, without any labels. Positive and negative pairs are automatically created via random sampling, such tha
sentence_transformers/sentence_transformer/losses/contrastive_tension.py:18
↓ 3 callers
Class
ContrastiveTensionLossInBatchNegatives
sentence_transformers/sentence_transformer/losses/contrastive_tension.py:186
↓ 3 callers
Class
ControlledNegativeScoreModel
Deterministic model whose anchor-positive score is negative, with a candidate negative that is *more* similar to the anchor than the positive (see
tests/util/test_hard_negatives.py:1662
↓ 3 callers
Class
CrossEntropyLoss
sentence_transformers/cross_encoder/losses/cross_entropy.py:9
↓ 3 callers
Class
DefaultBatchSampler
This sampler is the default batch sampler used in the SentenceTransformer library. It is equivalent to the PyTorch BatchSampler. Args:
sentence_transformers/base/sampler.py:195
↓ 3 callers
Class
FakeModel
tests/cross_encoder/test_model_card.py:220
↓ 3 callers
Class
InvertMockModule
tests/base/modules/test_router.py:89
↓ 3 callers
Class
MSEEvaluator
Computes the mean squared error (x100) between the computed sentence embedding and some target sentence embedding. The MSE is computed b
sentence_transformers/sentence_transformer/evaluation/mse.py:18
next →
1–100 of 446, ranked by callers