File size: 1,325 Bytes
1ca6472
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
{
  "schema_version": 1,
  "published_repository": "TiGa-RCE/gte-Qwen2-1.5B-instruct-MLX-BF16",
  "family": "gte-Qwen2-1.5B-instruct",
  "variant": "bf16",
  "upstream_repository": "Alibaba-NLP/gte-Qwen2-1.5B-instruct",
  "upstream_revision": "a9af15a6372d7d6b25e9fb07c2ccb9e1fe645644",
  "upstream_revision_evidence": "upstream revision verified at publication time; historical local snapshot metadata was not retained",
  "direct_parent": "Alibaba-NLP/gte-Qwen2-1.5B-instruct",
  "direct_parent_weight_hashes": null,
  "conversion": {
    "method": "BF16 MLX conversion",
    "nominal_bits": null,
    "group_size": null,
    "importance_matrix": false,
    "importance_matrix_samples": null,
    "importance_matrix_sequence_length": null,
    "stack": {
      "omlx": "0.5.3",
      "mlx_lm": "0.31.3",
      "mlx": "0.32.0"
    },
    "lossy_parent": false
  },
  "weight_files": [
    {
      "file": "model.safetensors",
      "sha256": "9e9da58bd1371c47a08bc82f58bd29d33a6831094372dd717d68148f061dd11a",
      "bytes": 3552432732
    }
  ],
  "evaluation": {
    "role": "BF16 reference",
    "pair_count": 24,
    "top1": 1.0,
    "mrr": 1.0,
    "gate": "reference"
  },
  "collection": "https://huggingface.co/collections/TiGa-RCE/mlx-embedding-quantization-matrix-q-oq-oqe-at-4-6-8-bit-6a68d11afb238d4fe967d70b"
}