4.13 GB
36 files
Updated about 1 month ago
Name
Size
.gitattributes1.57 kB
xet
README.md1.11 kB
xet
added_tokens.json261 Bytes
xet
config.json71.3 kB
xet
configuration_phi4mm.py11 kB
xet
generation_config.json179 Bytes
xet
hash_record_sha256.json2.51 kB
xet
merges.txt2.42 MB
xet
openvino_audio_embeddings_model.bin640 Bytes
xet
openvino_audio_embeddings_model.xml4.3 kB
xet
openvino_audio_encoder_model.bin432 MB
xet
openvino_audio_encoder_model.xml2.49 MB
xet
openvino_audio_forward_embeddings_model.bin12.6 MB
xet
openvino_audio_forward_embeddings_model.xml32.5 kB
xet
openvino_audio_speech_projection_model.bin12.6 MB
xet
openvino_audio_speech_projection_model.xml11.2 kB
xet
openvino_audio_vision_projection_model.bin12.6 MB
xet
openvino_audio_vision_projection_model.xml11.2 kB
xet
openvino_config.json1.23 kB
xet
openvino_detokenizer.bin3 MB
xet
openvino_detokenizer.xml7.05 kB
xet
openvino_language_model.bin2.6 GB
xet
openvino_language_model.xml5.2 MB
xet
openvino_text_embeddings_model.bin615 MB
xet
openvino_text_embeddings_model.xml5.9 kB
xet
openvino_tokenizer.bin7.59 MB
xet
openvino_tokenizer.xml23.3 kB
xet
openvino_vision_embeddings_model.bin400 MB
xet
openvino_vision_embeddings_model.xml1.09 MB
xet
openvino_vision_projection_model.bin13 MB
xet
openvino_vision_projection_model.xml10.2 kB
xet
preprocessor_config.json547 Bytes
xet
special_tokens_map.json617 Bytes
xet
tokenizer.json15.5 MB
xet
tokenizer_config.json3.44 kB
xet
vocab.json3.91 MB
xet
README.md

phi-4-mm-ov

phi-4-mm-ov is an OpenVino int4 quantized version of phi-4-mm, providing a very fast, very small inference implementation, optimized for AI PCs using Intel GPU, CPU and NPU.

This is a vision-to-text model from the Microsoft phi 4 series and is a very high-quality innovative small model that accepts multi-modal inputs (image/video, text).

Model Description

  • Developed by: Microsoft
  • Quantized by: llmware
  • Model type: phi-4
  • Parameters: 6 billion
  • Model Parent: microsoft/Phi-4-multimodal-instruct
  • Language(s) (NLP): English
  • License: Apache 2.0
  • Uses: Multimodal LLM
  • Quantization: int4

Model Card Contact

llmware on github

llmware on hf

llmware website

Total size
4.13 GB
Files
36
Last updated
Jun 10
Pre-warmed CDN
US EU US EU

Contributors