koiLM 7B (Ninja-RP LoRA, GGUF)

koiLM の「高品質モデル」として配布している、 日本語ロールプレイ特化モデルのGGUF量子化版です。

  • ベースモデル: Aratako/Ninja-v1-RP-expressive-v2
  • ファインチューニング: 恋愛・会話RP用途の独自データセットでLoRAファインチューニング
  • 量子化形式: GGUF, Q4_K_S
  • 推論エンジン: llama.cpp

ファイル

ファイル名 サイズ 説明
koilm-7b-Q4_K_S.gguf 約4.1GB Q4_K_S量子化版

使い方

koiLM (Windows版 / WebUI版) をダウンロードし、models/koilm-7b.gguf という名前で配置してください。 設定画面の「モデルの品質」から「高品質・低速(7B)」を選ぶと、このモデルが使用されます。

詳細な導入手順は koiLMのGitHubリポジトリ を参照してください。

単体で llama.cpp から直接使うことも可能です:

llama-server -m koilm-7b-Q4_K_S.gguf -c 4096

ライセンス

MIT License。ベースモデル(Ninja-v1-RP-expressive-v2)のライセンス条件も併せてご確認ください。

注意事項

このモデルは恋愛・ロールプレイ会話用途にファインチューニングされています。 違法行為・未成年者の搾取・なりすまし・誹謗中傷・差別扇動目的での利用は禁止します。

Downloads last month
122
GGUF
Model size
7B params
Architecture
llama
Hardware compatibility
Log In to add your hardware

We're not able to determine the quantization variants.

Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support

Model tree for kk0518/koiLM-7b-gguf

Adapter
(1)
this model