Bert's method of processing sentences

戒酒的李白
Commit 4d91f30dd35d6ab6b024ccb23964c7c947da9806 4d91f30d 1 parent 6cf336a7
Showing 10 changed files with 138 additions and 0 deletions
model_pro/sentence_bert_model/1_Pooling/config.json
model_pro/sentence_bert_model/config.json
model_pro/sentence_bert_model/config_sentence_transformers.json
model_pro/sentence_bert_model/modules.json
model_pro/sentence_bert_model/readme.md
model_pro/sentence_bert_model/sentence_bert_config.json
model_pro/sentence_bert_model/special_tokens_map.json
model_pro/sentence_bert_model/tokenizer.json
model_pro/sentence_bert_model/tokenizer_config.json
model_pro/sentence_bert_model/vocab.txt
--- a/model_pro/sentence_bert_model/1_Pooling/config.json 0 → 100644
View file @4d91f30
+++ b/model_pro/sentence_bert_model/1_Pooling/config.json 0 → 100644
View file @4d91f30
+ {
+   "word_embedding_dimension": 768,
+   "pooling_mode_cls_token": false,
+   "pooling_mode_mean_tokens": true,
+   "pooling_mode_max_tokens": false,
+   "pooling_mode_mean_sqrt_len_tokens": false,
+   "pooling_mode_weightedmean_tokens": false,
+   "pooling_mode_lasttoken": false,
+   "include_prompt": true
+ }
\ No newline at end of file
--- a/model_pro/sentence_bert_model/config.json 0 → 100644
View file @4d91f30
+++ b/model_pro/sentence_bert_model/config.json 0 → 100644
View file @4d91f30
+ {
+   "_name_or_path": "./bert_model",
+   "architectures": [
+     "BertModel"
+   ],
+   "attention_probs_dropout_prob": 0.1,
+   "classifier_dropout": null,
+   "directionality": "bidi",
+   "hidden_act": "gelu",
+   "hidden_dropout_prob": 0.1,
+   "hidden_size": 768,
+   "initializer_range": 0.02,
+   "intermediate_size": 3072,
+   "layer_norm_eps": 1e-12,
+   "max_position_embeddings": 512,
+   "model_type": "bert",
+   "num_attention_heads": 12,
+   "num_hidden_layers": 12,
+   "pad_token_id": 0,
+   "pooler_fc_size": 768,
+   "pooler_num_attention_heads": 12,
+   "pooler_num_fc_layers": 3,
+   "pooler_size_per_head": 128,
+   "pooler_type": "first_token_transform",
+   "position_embedding_type": "absolute",
+   "torch_dtype": "float32",
+   "transformers_version": "4.37.2",
+   "type_vocab_size": 2,
+   "use_cache": true,
+   "vocab_size": 21128
+ }
--- a/model_pro/sentence_bert_model/config_sentence_transformers.json 0 → 100644
View file @4d91f30
+++ b/model_pro/sentence_bert_model/config_sentence_transformers.json 0 → 100644
View file @4d91f30
+ {
+   "__version__": {
+     "sentence_transformers": "3.0.1",
+     "transformers": "4.37.2",
+     "pytorch": "2.3.0"
+   },
+   "prompts": {},
+   "default_prompt_name": null,
+   "similarity_fn_name": null
+ }
\ No newline at end of file
--- a/model_pro/sentence_bert_model/modules.json 0 → 100644
View file @4d91f30
+++ b/model_pro/sentence_bert_model/modules.json 0 → 100644
View file @4d91f30
+ [
+   {
+     "idx": 0,
+     "name": "0",
+     "path": "",
+     "type": "sentence_transformers.models.Transformer"
+   },
+   {
+     "idx": 1,
+     "name": "1",
+     "path": "1_Pooling",
+     "type": "sentence_transformers.models.Pooling"
+   }
+ ]
\ No newline at end of file
--- a/model_pro/sentence_bert_model/readme.md 0 → 100644
View file @4d91f30
+++ b/model_pro/sentence_bert_model/readme.md 0 → 100644
View file @4d91f30
+ sentence_bert_model model parameter file:
+ 
+ Link: https://pan.baidu.com/s/1_5J4N6GGDC1BD5iqF2UJ7g?pwd=kzp0
+ 
+ Access code: kzp0
\ No newline at end of file
--- a/model_pro/sentence_bert_model/sentence_bert_config.json 0 → 100644
View file @4d91f30
+++ b/model_pro/sentence_bert_model/sentence_bert_config.json 0 → 100644
View file @4d91f30
+ {
+   "max_seq_length": 512,
+   "do_lower_case": false
+ }
\ No newline at end of file
--- a/model_pro/sentence_bert_model/special_tokens_map.json 0 → 100644
View file @4d91f30
+++ b/model_pro/sentence_bert_model/special_tokens_map.json 0 → 100644
View file @4d91f30
+ {
+   "cls_token": "[CLS]",
+   "mask_token": "[MASK]",
+   "pad_token": "[PAD]",
+   "sep_token": "[SEP]",
+   "unk_token": "[UNK]"
+ }
--- a/model_pro/sentence_bert_model/tokenizer.json 0 → 100644
View file @4d91f30
+++ b/model_pro/sentence_bert_model/tokenizer.json 0 → 100644
View file @4d91f30
--- a/model_pro/sentence_bert_model/tokenizer_config.json 0 → 100644
View file @4d91f30
+++ b/model_pro/sentence_bert_model/tokenizer_config.json 0 → 100644
View file @4d91f30
+ {
+   "added_tokens_decoder": {
+     "0": {
+       "content": "[PAD]",
+       "lstrip": false,
+       "normalized": false,
+       "rstrip": false,
+       "single_word": false,
+       "special": true
+     },
+     "100": {
+       "content": "[UNK]",
+       "lstrip": false,
+       "normalized": false,
+       "rstrip": false,
+       "single_word": false,
+       "special": true
+     },
+     "101": {
+       "content": "[CLS]",
+       "lstrip": false,
+       "normalized": false,
+       "rstrip": false,
+       "single_word": false,
+       "special": true
+     },
+     "102": {
+       "content": "[SEP]",
+       "lstrip": false,
+       "normalized": false,
+       "rstrip": false,
+       "single_word": false,
+       "special": true
+     },
+     "103": {
+       "content": "[MASK]",
+       "lstrip": false,
+       "normalized": false,
+       "rstrip": false,
+       "single_word": false,
+       "special": true
+     }
+   },
+   "clean_up_tokenization_spaces": true,
+   "cls_token": "[CLS]",
+   "do_basic_tokenize": true,
+   "do_lower_case": false,
+   "mask_token": "[MASK]",
+   "model_max_length": 512,
+   "never_split": null,
+   "pad_token": "[PAD]",
+   "sep_token": "[SEP]",
+   "strip_accents": null,
+   "tokenize_chinese_chars": true,
+   "tokenizer_class": "BertTokenizer",
+   "unk_token": "[UNK]"
+ }
--- a/model_pro/sentence_bert_model/vocab.txt 0 → 100644
View file @4d91f30
+++ b/model_pro/sentence_bert_model/vocab.txt 0 → 100644
View file @4d91f30