初始化项目,由ModelHub XC社区提供模型

Model: sentence-transformers/msmarco-distilbert-base-dot-prod-v3
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-07-29 22:19:16 +08:00
commit fa6c7c2839
31 changed files with 49375 additions and 0 deletions

30
.gitattributes vendored Normal file
View File

@@ -0,0 +1,30 @@
*.bin.* filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tar.gz filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
model.safetensors filter=lfs diff=lfs merge=lfs -text
pytorch_model.bin filter=lfs diff=lfs merge=lfs -text
tf_model.h5 filter=lfs diff=lfs merge=lfs -text
onnx/model.onnx filter=lfs diff=lfs merge=lfs -text
onnx/model_O1.onnx filter=lfs diff=lfs merge=lfs -text
onnx/model_O2.onnx filter=lfs diff=lfs merge=lfs -text
onnx/model_O3.onnx filter=lfs diff=lfs merge=lfs -text
onnx/model_O4.onnx filter=lfs diff=lfs merge=lfs -text
onnx/model_qint8_arm64.onnx filter=lfs diff=lfs merge=lfs -text
onnx/model_qint8_avx512.onnx filter=lfs diff=lfs merge=lfs -text
onnx/model_qint8_avx512_vnni.onnx filter=lfs diff=lfs merge=lfs -text
onnx/model_quint8_avx2.onnx filter=lfs diff=lfs merge=lfs -text
openvino/openvino_model.bin filter=lfs diff=lfs merge=lfs -text
openvino/openvino_model_qint8_quantized.bin filter=lfs diff=lfs merge=lfs -text

7
1_Pooling/config.json Normal file
View File

@@ -0,0 +1,7 @@
{
"word_embedding_dimension": 768,
"pooling_mode_cls_token": false,
"pooling_mode_mean_tokens": true,
"pooling_mode_max_tokens": false,
"pooling_mode_mean_sqrt_len_tokens": false
}

1
2_Dense/config.json Normal file
View File

@@ -0,0 +1 @@
{"in_features": 768, "out_features": 768, "bias": false, "activation_function": "torch.nn.modules.linear.Identity"}

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:1af32e91b506d19c6749665e5e4ff3ba2a67e08305807a24c85905c8863c8b8d
size 2359416

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e5365f1d15b18a7ae7d2e500bf404b6d3cf45397afe1a2086641ff56bc5d7d1a
size 2360171

62
README.md Normal file
View File

@@ -0,0 +1,62 @@
---
license: apache-2.0
library_name: sentence-transformers
tags:
- sentence-transformers
- feature-extraction
- sentence-similarity
pipeline_tag: sentence-similarity
---
# sentence-transformers/msmarco-distilbert-base-dot-prod-v3
This is a [sentence-transformers](https://www.SBERT.net) model: It maps sentences & paragraphs to a 768 dimensional dense vector space and can be used for tasks like clustering or semantic search.
## Usage (Sentence-Transformers)
Using this model becomes easy when you have [sentence-transformers](https://www.SBERT.net) installed:
```
pip install -U sentence-transformers
```
Then you can use the model like this:
```python
from sentence_transformers import SentenceTransformer
sentences = ["This is an example sentence", "Each sentence is converted"]
model = SentenceTransformer('sentence-transformers/msmarco-distilbert-base-dot-prod-v3')
embeddings = model.encode(sentences)
print(embeddings)
```
## Full Model Architecture
```
SentenceTransformer(
(0): Transformer({'max_seq_length': 512, 'do_lower_case': False}) with Transformer model: DistilBertModel
(1): Pooling({'word_embedding_dimension': 768, 'pooling_mode_cls_token': False, 'pooling_mode_mean_tokens': True, 'pooling_mode_max_tokens': False, 'pooling_mode_mean_sqrt_len_tokens': False})
(2): Dense({'in_features': 768, 'out_features': 768, 'bias': False, 'activation_function': 'torch.nn.modules.linear.Identity'})
)
```
## Citing & Authors
This model was trained by [sentence-transformers](https://www.sbert.net/).
If you find this model helpful, feel free to cite our publication [Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks](https://arxiv.org/abs/1908.10084):
```bibtex
@inproceedings{reimers-2019-sentence-bert,
title = "Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks",
author = "Reimers, Nils and Gurevych, Iryna",
booktitle = "Proceedings of the 2019 Conference on Empirical Methods in Natural Language Processing",
month = "11",
year = "2019",
publisher = "Association for Computational Linguistics",
url = "http://arxiv.org/abs/1908.10084",
}
```

23
config.json Normal file
View File

@@ -0,0 +1,23 @@
{
"_name_or_path": "old_models/msmarco-distilbert-base-dot-prod-v3/0_Transformer",
"activation": "gelu",
"architectures": [
"DistilBertModel"
],
"attention_dropout": 0.1,
"dim": 768,
"dropout": 0.1,
"hidden_dim": 3072,
"initializer_range": 0.02,
"max_position_embeddings": 512,
"model_type": "distilbert",
"n_heads": 12,
"n_layers": 6,
"pad_token_id": 0,
"qa_dropout": 0.1,
"seq_classif_dropout": 0.2,
"sinusoidal_pos_embds": false,
"tie_weights_": true,
"transformers_version": "4.7.0",
"vocab_size": 30522
}

View File

@@ -0,0 +1,10 @@
{
"__version__": {
"sentence_transformers": "3.0.0.dev0",
"transformers": "4.41.0.dev0",
"pytorch": "2.3.0+cu121"
},
"prompts": {},
"default_prompt_name": null,
"similarity_fn_name": "dot"
}

1
configuration.json Normal file
View File

@@ -0,0 +1 @@
{"framework": "pytorch", "task": "sentence-similarity", "allow_remote": true}

3
model.safetensors Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:cdfa8b33fc0960395777ba7795ceaf41ac6788a128d89e1a457e98b2bc48eb90
size 265462608

20
modules.json Normal file
View File

@@ -0,0 +1,20 @@
[
{
"idx": 0,
"name": "0",
"path": "",
"type": "sentence_transformers.models.Transformer"
},
{
"idx": 1,
"name": "1",
"path": "1_Pooling",
"type": "sentence_transformers.models.Pooling"
},
{
"idx": 2,
"name": "2",
"path": "2_Dense",
"type": "sentence_transformers.models.Dense"
}
]

3
onnx/model.onnx Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:9c565fd903ba067c79aba51859cf1b24148252ea31b152f66500e3ce14eb934c
size 265564612

3
onnx/model_O1.onnx Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:a21542721ddebd094e3fb0da6e909660393c36987da66e06c1146765a7765e3f
size 265548916

3
onnx/model_O2.onnx Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:b5f9be7e23fef4ff26a9fb39114d5c9e54b2577d67dc59dc44d4087fe9428d82
size 265471026

3
onnx/model_O3.onnx Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:5d0380053225ea8af6507ffc1c20e59a8a7b1d37ca7fefa1daf70d3c4cee0dbc
size 265471086

3
onnx/model_O4.onnx Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:41ef7bcb2e39fd6e54a487fa65bd2e6354742ec769de1f640e0b60fcee5948e1
size 132748309

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:afe98794bdc7050e3e61a3d1201330f49b611c42ed4b17dd30adf65447f04edd
size 66965107

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:afe98794bdc7050e3e61a3d1201330f49b611c42ed4b17dd30adf65447f04edd
size 66965107

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:afe98794bdc7050e3e61a3d1201330f49b611c42ed4b17dd30adf65447f04edd
size 66965107

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:ce3ed9901f7e6b510942b82e4bd73c3f474513c2174c92d6cb5baded0cd2341b
size 67006579

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:7acbd72738fd4c99d3857c06d51c43e13cef8fdf7033212c2d7f6a50b900036b
size 265455736

7127
openvino/openvino_model.xml Normal file

File diff suppressed because it is too large Load Diff

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:906133312d30b545c157cef9507534a639bb6a2af797a40e658712af8b0b5218
size 66970752

File diff suppressed because it is too large Load Diff

3
pytorch_model.bin Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e67d89134719a423d5978c8760b259f4e3106dc6b25c6bac4ccb50e7fbbeda38
size 265486777

View File

@@ -0,0 +1,4 @@
{
"max_seq_length": 512,
"do_lower_case": false
}

1
special_tokens_map.json Normal file
View File

@@ -0,0 +1 @@
{"unk_token": "[UNK]", "sep_token": "[SEP]", "pad_token": "[PAD]", "cls_token": "[CLS]", "mask_token": "[MASK]"}

3
tf_model.h5 Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:8279a82eaa54e06ca59eb7f95ccd086159cbfd6e7fe8044de9eeddf0ff5c4122
size 265571968

1
tokenizer.json Normal file

File diff suppressed because one or more lines are too long

1
tokenizer_config.json Normal file
View File

@@ -0,0 +1 @@
{"do_lower_case": true, "unk_token": "[UNK]", "sep_token": "[SEP]", "pad_token": "[PAD]", "cls_token": "[CLS]", "mask_token": "[MASK]", "tokenize_chinese_chars": true, "strip_accents": null, "model_max_length": 512, "special_tokens_map_file": null, "name_or_path": "old_models/msmarco-distilbert-base-dot-prod-v3/0_Transformer", "do_basic_tokenize": true, "never_split": null}

30522
vocab.txt Normal file

File diff suppressed because it is too large Load Diff