Downloads · 30 days
9
23% of all-time downloads
kh38/my-cool-model1126
my-cool-model1126 is a text generation model from kh38. Use it when you need the model to write or continue text. It is set up for transformers.
This is a merge of pre-trained language models created using mergekit.
Downloads · 30 days
9
23% of all-time downloads
All-time downloads
40
Public
Parameters
8B
16.1 GB on disk
Likes
0
Public
Click a slice to open those files.
.safetensors16.1 GB · 100%
From the Hugging Face model README
This is a merge of pre-trained language models created using mergekit.
This model was merged using the linear merge method.
The following models were included in the merge:
The following YAML configuration was used to produce this model:
dtype: bfloat16
merge_method: linear
parameters:
int8_mask: 1.0
normalize: 1.0
slices:
- sources:
- layer_range: [0, 4]
model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-v0.2_4249862252
parameters:
weight: 0.6682912881042561
- layer_range: [0, 4]
model: ../evol_merge_storage/input_models/Meta-Llama-3-8B-Instruct_fictional_mathqa_Spanish_v1_2935777833
parameters:
weight: 0.8169238866732543
- sources:
- layer_range: [4, 8]
model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-v0.2_4249862252
parameters:
weight: 0.824383032378547
- layer_range: [4, 8]
model: ../evol_merge_storage/input_models/Meta-Llama-3-8B-Instruct_fictional_mathqa_Spanish_v1_2935777833
parameters:
weight: 0.585658209873855
- sources:
- layer_range: [8, 12]
model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-v0.2_4249862252
parameters:
weight: 0.27646115516439407
- layer_range: [8, 12]
model: ../evol_merge_storage/input_models/Meta-Llama-3-8B-Instruct_fictional_mathqa_Spanish_v1_2935777833
parameters:
weight: 0.6421834326611193
- sources:
- layer_range: [12, 16]
model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-v0.2_4249862252
parameters:
weight: 0.19263623796034313
- layer_range: [12, 16]
model: ../evol_merge_storage/input_models/Meta-Llama-3-8B-Instruct_fictional_mathqa_Spanish_v1_2935777833
parameters:
weight: 0.28408471038937055
- sources:
- layer_range: [16, 20]
model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-v0.2_4249862252
parameters:
weight: 0.5452257394072989
- layer_range: [16, 20]
model: ../evol_merge_storage/input_models/Meta-Llama-3-8B-Instruct_fictional_mathqa_Spanish_v1_2935777833
parameters:
weight: 0.5345283738895676
- sources:
- layer_range: [20, 24]
model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-v0.2_4249862252
parameters:
weight: 0.6694408493851071
- layer_range: [20, 24]
model: ../evol_merge_storage/input_models/Meta-Llama-3-8B-Instruct_fictional_mathqa_Spanish_v1_2935777833
parameters:
weight: 0.36909260818773304
- sources:
- layer_range: [24, 28]
model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-v0.2_4249862252
parameters:
weight: 0.5611229475708517
- layer_range: [24, 28]
model: ../evol_merge_storage/input_models/Meta-Llama-3-8B-Instruct_fictional_mathqa_Spanish_v1_2935777833
parameters:
weight: 0.1981276090509695
- sources:
- layer_range: [28, 32]
model: ../evol_merge_storage/input_models/Llama-3.1-Swallow-8B-v0.2_4249862252
parameters:
weight: 0.6876393865290468
- layer_range: [28, 32]
model: ../evol_merge_storage/input_models/Meta-Llama-3-8B-Instruct_fictional_mathqa_Spanish_v1_2935777833
parameters:
weight: 0.15713286244650526