How to use from the
Use from the
Transformers library
# Use a pipeline as a high-level helper
from transformers import pipeline

pipe = pipeline("text-generation", model="bruhzair/Test-Model-8-105b")
messages = [
    {"role": "user", "content": "Who are you?"},
]
pipe(messages)
# Load model directly
from transformers import AutoTokenizer, AutoModelForCausalLM

tokenizer = AutoTokenizer.from_pretrained("bruhzair/Test-Model-8-105b")
model = AutoModelForCausalLM.from_pretrained("bruhzair/Test-Model-8-105b", device_map="auto")
messages = [
    {"role": "user", "content": "Who are you?"},
]
inputs = tokenizer.apply_chat_template(
	messages,
	add_generation_prompt=True,
	tokenize=True,
	return_dict=True,
	return_tensors="pt",
).to(model.device)

outputs = model.generate(**inputs, max_new_tokens=40)
print(tokenizer.decode(outputs[0][inputs["input_ids"].shape[-1]:]))
Quick Links

Purpose

Mergefuel experiment.

Models Merged

The following models were included in the merge:

  • bruhzair/ignore-merge-11 (Envoid/Llama-3.05-NT-Storybreaker-Ministral-70B upscaled to 105B)

  • (nbeerbower/llama3.1-kartoffeldes-70B upscaled to 105B)

  • bruhzair/ignore-merge-2 (Doctor-Shotgun/L3.3-70B-Magnum-v4-SE upscaled to 105B)

  • bruhzair/EVA-x-EVA-105b (EVA-UNIT-01/EVA-LLaMA-3.33-70B-v0.1 upscaled to 105B)

  • bruhzair/ignore-merge-1 (Sao10K/L3.3-70B-Euryale-v2.3 upscaled to 105B)

  • BASE: bruhzair/ignore-merge-25 (flammenai/Llama3.1-Flammades-70B upscaled to 105B)

Configuration

The following YAML configuration was used to produce this model:

base_model: /workspace/flam2
dtype: float32
merge_method: sce
modules:
  default:
    slices:
    - sources:
      - layer_range: [0, 120]
        model: /workspace/cache/models--bruhzair--ignore-merge-2/snapshots/e60c43daa0fc7893e7a909d2bae952cffa3831a3
        parameters:
          select_topk: 0.5
      - layer_range: [0, 120]
        model: /workspace/cache/models--bruhzair--ignore-merge-6/snapshots/87658005d40b593ba3e87e92e5fb3f28321266a1
        parameters:
          select_topk: 0.5
      - layer_range: [0, 120]
        model: /workspace/cache/models--bruhzair--ignore-merge-1/snapshots/0994ed36502b7c1942553cae165a5813acfc7f4b
        parameters:
          select_topk: 0.5
      - layer_range: [0, 120]
        model: /workspace/kart2
        parameters:
          select_topk: 0.5
      - layer_range: [0, 120]
        model: /workspace/cache/models--bruhzair--ignore-merge-11/snapshots/8596adc51a6dfabf35c56b6ed28aab24e0356ccf
        parameters:
          select_topk: 0.5
      - layer_range: [0, 120]
        model: /workspace/flam2
        parameters:
          select_topk: 0.5
out_dtype: bfloat16
tokenizer:
  source: base
Downloads last month
12
Safetensors
Model size
105B params
Tensor type
BF16
·
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support