Purpose

Mergefuel experiment.

Models Merged

The following models were included in the merge:

  • bruhzair/ignore-merge-11 (Envoid/Llama-3.05-NT-Storybreaker-Ministral-70B upscaled to 105B)

  • (nbeerbower/llama3.1-kartoffeldes-70B upscaled to 105B)

  • bruhzair/ignore-merge-2 (Doctor-Shotgun/L3.3-70B-Magnum-v4-SE upscaled to 105B)

  • bruhzair/EVA-x-EVA-105b (EVA-UNIT-01/EVA-LLaMA-3.33-70B-v0.1 upscaled to 105B)

  • bruhzair/ignore-merge-1 (Sao10K/L3.3-70B-Euryale-v2.3 upscaled to 105B)

  • BASE: bruhzair/ignore-merge-25 (flammenai/Llama3.1-Flammades-70B upscaled to 105B)

Configuration

The following YAML configuration was used to produce this model:

base_model: /workspace/flam2
dtype: float32
merge_method: sce
modules:
  default:
    slices:
    - sources:
      - layer_range: [0, 120]
        model: /workspace/cache/models--bruhzair--ignore-merge-2/snapshots/e60c43daa0fc7893e7a909d2bae952cffa3831a3
        parameters:
          select_topk: 0.5
      - layer_range: [0, 120]
        model: /workspace/cache/models--bruhzair--ignore-merge-6/snapshots/87658005d40b593ba3e87e92e5fb3f28321266a1
        parameters:
          select_topk: 0.5
      - layer_range: [0, 120]
        model: /workspace/cache/models--bruhzair--ignore-merge-1/snapshots/0994ed36502b7c1942553cae165a5813acfc7f4b
        parameters:
          select_topk: 0.5
      - layer_range: [0, 120]
        model: /workspace/kart2
        parameters:
          select_topk: 0.5
      - layer_range: [0, 120]
        model: /workspace/cache/models--bruhzair--ignore-merge-11/snapshots/8596adc51a6dfabf35c56b6ed28aab24e0356ccf
        parameters:
          select_topk: 0.5
      - layer_range: [0, 120]
        model: /workspace/flam2
        parameters:
          select_topk: 0.5
out_dtype: bfloat16
tokenizer:
  source: base
Downloads last month
10
Safetensors
Model size
105B params
Tensor type
BF16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support