tapiocaTakeshi's picture
Add model card
3d73b03 verified
|
Raw
History Blame Contribute Delete
1.64 kB
---
license: mit
language: ja
library_name: litert-lm
pipeline_tag: text-generation
tags:
- litertlm
- litert-lm
- on-device
- neuroquantum
- qbnn
---
# Qubit NeuroQuantum (medium) — LiteRT-LM bundle
NeuroQuantum / QBNN モデルを Google LiteRT-LM 互換のバンドル形式
(`.litertlm`) で配布しています。
## ファイル
- `qubit-neuroquantum-medium.litertlm` — モデルバンドル (26.80 MB)
- `TFLITE_MODEL_OR_WEIGHTS` セクション: モデル重み (fp16 NPZ archive)
- `SP_MODEL` セクション: SentencePiece トークナイザ
- `LLM_METADATA_JSON` セクション: モデル / ランタイム設定
- `MODEL_CARD_MD` セクション: モデルカード
## モデル仕様
| Field | Value |
|---|---|
| Architecture | NeuroQuantum |
| Size | `medium` |
| Parameters | 13,550,606 |
| embed_dim | 128 |
| hidden_dim | 256 |
| num_heads | 4 |
| num_layers | 2 |
| max_seq_len | 1024 |
| vocab_size | 32000 |
## 推奨ランタイム設定
```json
{
"n_ctx": 1024,
"n_batch": 64,
"n_threads": 4,
"n_gpu_layers": 0,
"temperature": 0.8,
"top_p": 0.9,
"top_k": 40
}
```
## ロード例
```python
import struct, json
from pathlib import Path
MAGIC = b"LITERTLM"
with open("qubit-neuroquantum-medium.litertlm", "rb") as f:
assert f.read(8) == MAGIC
version, count = struct.unpack("<II", f.read(8))
# ... see generate_litertlm_models.py:read_litertlm_header
```
完全なパーサ実装と生成スクリプトは
[tapiocatakeshi/Qubit](https://github.com/tapiocatakeshi/Qubit) の
`generate_litertlm_models.py` を参照してください。
## License
MIT