Buckets:

download
raw
6.34 kB
# Optimum.Neuron
## Docs
- [๐Ÿค— Optimum Neuron](https://huggingface.co/docs/optimum.neuron/pr_1113/index.md)
- [EC2 Setup](https://huggingface.co/docs/optimum.neuron/pr_1113/ec2-setup.md)
- [Supported architectures](https://huggingface.co/docs/optimum.neuron/pr_1113/supported_architectures.md)
- [Quickstart](https://huggingface.co/docs/optimum.neuron/pr_1113/quickstart.md)
- [Optimum Neuron Container](https://huggingface.co/docs/optimum.neuron/pr_1113/containers.md)
- [Notebooks](https://huggingface.co/docs/optimum.neuron/pr_1113/notebooks.md)
- [Llama-3.3-70b performance on AWS Inferentia2 (Latency & Throughput)](https://huggingface.co/docs/optimum.neuron/pr_1113/benchmarks/inferentia-llama3.3-70b.md)
- [Llama-3.1-8b performance on AWS Inferentia2 (Latency & Throughput)](https://huggingface.co/docs/optimum.neuron/pr_1113/benchmarks/inferentia-llama3.1-8b.md)
- [NeuronTrainer](https://huggingface.co/docs/optimum.neuron/pr_1113/training_api/trainer.md)
- [Neuron TRL Trainers](https://huggingface.co/docs/optimum.neuron/pr_1113/training_api/trl_trainers.md)
- [LoRA for Neuron](https://huggingface.co/docs/optimum.neuron/pr_1113/training_api/lora.md)
- [Model Weight Transformation Specs](https://huggingface.co/docs/optimum.neuron/pr_1113/training_api/transformations.md)
- [Comparing Book Translations using Embeddings](https://huggingface.co/docs/optimum.neuron/pr_1113/inference_tutorials/compare-book-translations.md)
- [Stable Diffusion XL with Neuronx: Text to image](https://huggingface.co/docs/optimum.neuron/pr_1113/inference_tutorials/stable-diffusion-xl-txt2img.md)
- [Deploy Llama 3.3 70B on AWS Inferentia2](https://huggingface.co/docs/optimum.neuron/pr_1113/inference_tutorials/deploy-llama-3-3-70b.md)
- [Stable Diffusion with Neuronx: Text to image](https://huggingface.co/docs/optimum.neuron/pr_1113/inference_tutorials/stable-diffusion-txt2img.md)
- [Run `codellama/CodeLlama-7b-hf` from Hugging Face on Inf2 & Trn1](https://huggingface.co/docs/optimum.neuron/pr_1113/inference_tutorials/CodeLlama-7B-Compilation.md)
- [Qwen3 Embedding on AWS Trainium with Optimum Neuron](https://huggingface.co/docs/optimum.neuron/pr_1113/inference_tutorials/qwen_embedding.md)
- [Create your own chatbot with llama-2-13B on AWS Inferentia](https://huggingface.co/docs/optimum.neuron/pr_1113/inference_tutorials/llama2-13b-chatbot.md)
- [Deploy Mixtral 8x7B on AWS Inferentia2](https://huggingface.co/docs/optimum.neuron/pr_1113/inference_tutorials/deploy-mixtral-8x7b.md)
- [Sentence Transformers on AWS Inferentia with Optimum Neuron](https://huggingface.co/docs/optimum.neuron/pr_1113/inference_tutorials/sentence-transformers.md)
- [Adding support for new architectures](https://huggingface.co/docs/optimum.neuron/pr_1113/contribute/contribute_for_inference.md)
- [Contributing Custom Models for Training](https://huggingface.co/docs/optimum.neuron/pr_1113/contribute/contribute_for_training.md)
- [Setting up your development environment](https://huggingface.co/docs/optimum.neuron/pr_1113/contribute/dev_environment.md)
- [Export a model to Neuron](https://huggingface.co/docs/optimum.neuron/pr_1113/guides/export_model.md)
- [Deploying a LLM Model with Inference Endpoints](https://huggingface.co/docs/optimum.neuron/pr_1113/guides/vllm_on_ie.md)
- [optimum-neuron plugin for vLLM](https://huggingface.co/docs/optimum.neuron/pr_1113/guides/vllm_plugin.md)
- [Distributed Training with `optimum-neuron`](https://huggingface.co/docs/optimum.neuron/pr_1113/guides/distributed_training.md)
- [Inference pipelines with AWS Neuron (Inf2/Trn1)](https://huggingface.co/docs/optimum.neuron/pr_1113/guides/pipelines.md)
- [Neuron Model Cache](https://huggingface.co/docs/optimum.neuron/pr_1113/guides/cache_system.md)
- [Introduction](https://huggingface.co/docs/optimum.neuron/pr_1113/guides/benchmark.md)
- [Models](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/modeling_auto.md)
- [๐Ÿš€ Instruction Fine-Tuning of Llama 3.1 8B with LoRA](https://huggingface.co/docs/optimum.neuron/pr_1113/training_tutorials/finetune_llama.md)
- [๐Ÿš€ Tutorials: How To Fine-tune & Run LLMs](https://huggingface.co/docs/optimum.neuron/pr_1113/training_tutorials/finetune_llms_overview.md)
- [๐Ÿš€ Continuous Pretraining of Llama 3.2 1B on SageMaker Hyperpod with Pre-built Containers](https://huggingface.co/docs/optimum.neuron/pr_1113/training_tutorials/pretraining_hyperpod_llm.md)
- [Getting started with AWS Trainium and Hugging Face Transformers](https://huggingface.co/docs/optimum.neuron/pr_1113/training_tutorials/fine_tune_bert.md)
- [๐Ÿš€ Fine-Tune Qwen3 8B with LoRA](https://huggingface.co/docs/optimum.neuron/pr_1113/training_tutorials/finetune_qwen3.md)
- [Stable Diffusion](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/stable_diffusion.md)
- [PixArt-ฮฑ](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/pixart_alpha.md)
- [Latent Consistency Models](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/lcm.md)
- [PixArt-ฮฃ](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/pixart_sigma.md)
- [Stable Diffusion XL Turbo](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/sdxl_turbo.md)
- [IP-Adapter](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/ip_adapter.md)
- [Stable Diffusion XL](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/stable_diffusion_xl.md)
- [InstructPix2Pix](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/pix2pix.md)
- [ControlNet](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/controlnet.md)
- [Flux](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/flux.md)
- [Load adapters](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/lora.md)
- [Whisper](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/transformers/whisper.md)
- [YOLOS](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/transformers/yolos.md)
- [BERT](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/transformers/bert.md)
- [CLIP](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/transformers/clip.md)
- [Sentence Transformers ๐Ÿค—](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/sentence_transformers/overview.md)

Xet Storage Details

Size:
6.34 kB
ยท
Xet hash:
b3091b784c0cc4f2949162ab8f8f56227b8c89591b028dfa3fc8a8d434572b90

Xet efficiently stores files, intelligently splitting them into unique chunks and accelerating uploads and downloads. More info.