bigcode
/

astraios-3b-ptuning

Model card Files Files and versions

terryyz commited on Sep 16, 2023

Commit

6c48748

·

1 Parent(s): 72196ae

Upload 3 files

Files changed (3) hide show

README.md +50 -0
adapter_config.json +17 -0
adapter_model.bin +3 -0

README.md ADDED Viewed

	@@ -0,0 +1,50 @@

+---
+library_name: peft
+---
+## Training procedure
+The following `bitsandbytes` quantization config was used during training:
+- quant_method: bitsandbytes
+- load_in_8bit: True
+- load_in_4bit: False
+- llm_int8_threshold: 6.0
+- llm_int8_skip_modules: None
+- llm_int8_enable_fp32_cpu_offload: False
+- llm_int8_has_fp16_weight: False
+- bnb_4bit_quant_type: fp4
+- bnb_4bit_use_double_quant: False
+- bnb_4bit_compute_dtype: float32
+The following `bitsandbytes` quantization config was used during training:
+- quant_method: bitsandbytes
+- load_in_8bit: True
+- load_in_4bit: False
+- llm_int8_threshold: 6.0
+- llm_int8_skip_modules: None
+- llm_int8_enable_fp32_cpu_offload: False
+- llm_int8_has_fp16_weight: False
+- bnb_4bit_quant_type: fp4
+- bnb_4bit_use_double_quant: False
+- bnb_4bit_compute_dtype: float32
+### Framework versions
+- PEFT 0.6.0.dev0
+- PEFT 0.6.0.dev0
+ning:
+- quant_method: bitsandbytes
+- load_in_8bit: True
+- load_in_4bit: False
+- llm_int8_threshold: 6.0
+- llm_int8_skip_modules: None
+- llm_int8_enable_fp32_cpu_offload: False
+- llm_int8_has_fp16_weight: False
+- bnb_4bit_quant_type: fp4
+- bnb_4bit_use_double_quant: False
+- bnb_4bit_compute_dtype: float32
+### Framework versions
+- PEFT 0.6.0.dev0
+- PEFT 0.6.0.dev0

adapter_config.json ADDED Viewed

	@@ -0,0 +1,17 @@

+{
+  "auto_mapping": null,
+  "base_model_name_or_path": "bigcode/starcoderbase-3b",
+  "encoder_dropout": 0.0,
+  "encoder_hidden_size": 2816,
+  "encoder_num_layers": 2,
+  "encoder_reparameterization_type": "MLP",
+  "inference_mode": true,
+  "num_attention_heads": 22,
+  "num_layers": 36,
+  "num_transformer_submodules": 1,
+  "num_virtual_tokens": 30,
+  "peft_type": "P_TUNING",
+  "revision": null,
+  "task_type": "CAUSAL_LM",
+  "token_dim": 2816
+}

adapter_model.bin ADDED Viewed

	@@ -0,0 +1,3 @@

+version https://git-lfs.github.com/spec/v1
+oid sha256:6e07e89b15af0a90ee75521b0c7de995b53f24b20941e4068ac76e37ded283e5
+size 338749