Darwin-9B-Opus (MLX 4-bit Optimized)

This repository provides an MLX-optimized 4-bit quantized version of FINAL-Bench/Darwin-9B-Opus, an ultra-efficient advanced reasoning model.

진화적 λ¨Έμ§€(Evolutionary Merge) 및 λ ˆμ΄μ–΄λ³„ λ¨Έμ§€(Layer-wise Merge) 기법이 적용된 9B μ²΄κΈ‰μ˜ κ°•λ ₯ν•œ λͺ¨λΈμ„ Apple Silicon(Mac) ν™˜κ²½μ—μ„œ ν•˜λ“œμ›¨μ–΄ λ¦¬μ†ŒμŠ€λ₯Ό μ΅œμ†Œν™”ν•˜λ©° ꡬ동할 수 μžˆλ„λ‘ 4-bit둜 μ–‘μžν™” 및 포맷 λ³€ν™˜μ„ μ™„λ£Œν•œ λ²„μ „μž…λ‹ˆλ‹€.

⚠️ Hugging Face View Note: ν—ˆκΉ…νŽ˜μ΄μŠ€ μ‹œμŠ€ν…œμ΄ MLX 4λΉ„νŠΈ νŒ¨ν‚Ή 포맷(U32/BF16)을 νŒŒμ‹±ν•˜λŠ” κ³Όμ •μ—μ„œ νŒŒλΌλ―Έν„° 수 및 ν…μ„œ νƒ€μž…μ΄ μΌμ‹œμ μœΌλ‘œ λ‹€λ₯΄κ²Œ ν‘œκΈ°λ  수 μžˆμœΌλ‚˜, μ‹€μ œ 4λΉ„νŠΈ μ–‘μžν™” κ°€μ€‘μΉ˜κ°€ 정상 적용된 νŒŒμΌμž…λ‹ˆλ‹€. λ§₯뢁 둜컬 ν™˜κ²½μ—μ„œ 정상적인 λ©”λͺ¨λ¦¬ 점유율둜 κ΅¬λ™λ©λ‹ˆλ‹€.

πŸš€ Key Features

  • Extreme Efficiency (4-bit): 9B μ²΄κΈ‰μ˜ κ°€μ€‘μΉ˜λ₯Ό 4λΉ„νŠΈλ‘œ μ •κ΅ν•˜κ²Œ μ••μΆ•ν•˜μ—¬, VRAM(톡합 λ©”λͺ¨λ¦¬)이 적은 Mac κΈ°κΈ°μ—μ„œλ„ 가볍고 λΉ λ₯΄κ²Œ μΆ”λ‘ (Inference)을 μˆ˜ν–‰ν•©λ‹ˆλ‹€.
  • Top-Tier 9B Reasoning: ν•˜λ“œμ½”μ–΄ 박사급 μΆ”λ‘  ν…ŒμŠ€νŠΈμΈ **GPQA Diamondμ—μ„œ 82.5%**λΌλŠ” 체급 파괴 μˆ˜μ€€μ˜ 고득점을 κΈ°λ‘ν–ˆμŠ΅λ‹ˆλ‹€. κΉŠμ€ 사고 κ³Όμ •(<thought>)을 ν†΅ν•œ κ³ λ‚œλ„ 논리 좔둠이 κ°€λŠ₯ν•©λ‹ˆλ‹€.
  • Agentic Capabilities: μ½”λ”© μ—μ΄μ „νŠΈ(Coding Agent) μ„±λŠ₯κ³Ό μ •κ΅ν•œ 도ꡬ 호좜(Tool Calling) μΈν„°νŽ˜μ΄μŠ€λ₯Ό κΈ°λ³Έ λ‚΄μž₯ν•˜κ³  μžˆμŠ΅λ‹ˆλ‹€.
  • Global Multilingual: ν•œκ΅­μ–΄, μ˜μ–΄, 쀑ꡭ어, 일본어, ν”„λž‘μŠ€μ–΄, 독일어 λ“± 10개 μ΄μƒμ˜ λ‹€κ΅­μ–΄ ν™˜κ²½μ„ μ™„λ²½ν•˜κ²Œ μ§€μ›ν•©λ‹ˆλ‹€.

πŸ› οΈ Installation

이 λͺ¨λΈμ„ 둜컬 ν™˜κ²½μ—μ„œ κ΅¬λ™ν•˜λ €λ©΄ μ΅œμ‹  λ²„μ „μ˜ mlx-lm λΌμ΄λΈŒλŸ¬λ¦¬κ°€ ν•„μš”ν•©λ‹ˆλ‹€.

pip install -U mlx-lm

πŸ’» How to Use

1. Python APIλ₯Ό μ΄μš©ν•œ μΆ”λ‘  μ½”λ“œ

from mlx_lm import load, generate

# 본인의 ν—ˆκΉ…νŽ˜μ΄μŠ€ μ €μž₯μ†Œ 아이디/μ΄λ¦„μœΌλ‘œ μˆ˜μ •ν•˜μ—¬ μ‚¬μš©ν•˜μ„Έμš”.
model, tokenizer = load("cudo528/Darwin-9B-Opus-mlx-4bit")

prompt = "μˆ˜ν•™μ  κ·€λ‚©λ²•μ˜ 원리λ₯Ό 쀑학생도 이해할 수 있게 μ‰¬μš΄ λΉ„μœ λ₯Ό λ“€μ–΄ ν•œκ΅­μ–΄λ‘œ μ„€λͺ…ν•΄μ€˜."

response = generate(
    model, 
    tokenizer, 
    prompt=prompt, 
    max_tokens=2048,
    verbose=True # λͺ¨λΈμ˜ 심측 사고 κ³Όμ •(<thought>)을 ν„°λ―Έλ„μ—μ„œ μ‹€μ‹œκ°„μœΌλ‘œ 보렀면 True
)
print(response)

2. 터미널(CLI) ν™˜κ²½μ—μ„œ μ¦‰μ‹œ μ‹€ν–‰

mlx_lm.generate --model cudo528/Darwin-9B-Opus-mlx-4bit --prompt "Write a Python script for a simple custom neural network layer." --max-tokens 1024

πŸ“‚ Architecture & Lineage

  • Original Base Model: FINAL-Bench/Darwin-9B-Opus
  • Quantization Bit: 4-bit
  • Format: MLX Formatted (.safetensors packed)
  • License: Apache-2.0
Downloads last month

-

Downloads are not tracked for this model. How to track
Inference Providers NEW
This model isn't deployed by any Inference Provider. πŸ™‹ Ask for provider support

Model tree for cudo528/Darwin-9B-Opus-mlx-4bit

Finetuned
(2)
this model

Evaluation results