Buckets:
| # Optimum.Neuron | |
| ## Docs | |
| - [๐ค Optimum Neuron](https://huggingface.co/docs/optimum.neuron/pr_1113/index.md) | |
| - [EC2 Setup](https://huggingface.co/docs/optimum.neuron/pr_1113/ec2-setup.md) | |
| - [Supported architectures](https://huggingface.co/docs/optimum.neuron/pr_1113/supported_architectures.md) | |
| - [Quickstart](https://huggingface.co/docs/optimum.neuron/pr_1113/quickstart.md) | |
| - [Optimum Neuron Container](https://huggingface.co/docs/optimum.neuron/pr_1113/containers.md) | |
| - [Notebooks](https://huggingface.co/docs/optimum.neuron/pr_1113/notebooks.md) | |
| - [Llama-3.3-70b performance on AWS Inferentia2 (Latency & Throughput)](https://huggingface.co/docs/optimum.neuron/pr_1113/benchmarks/inferentia-llama3.3-70b.md) | |
| - [Llama-3.1-8b performance on AWS Inferentia2 (Latency & Throughput)](https://huggingface.co/docs/optimum.neuron/pr_1113/benchmarks/inferentia-llama3.1-8b.md) | |
| - [NeuronTrainer](https://huggingface.co/docs/optimum.neuron/pr_1113/training_api/trainer.md) | |
| - [Neuron TRL Trainers](https://huggingface.co/docs/optimum.neuron/pr_1113/training_api/trl_trainers.md) | |
| - [LoRA for Neuron](https://huggingface.co/docs/optimum.neuron/pr_1113/training_api/lora.md) | |
| - [Model Weight Transformation Specs](https://huggingface.co/docs/optimum.neuron/pr_1113/training_api/transformations.md) | |
| - [Comparing Book Translations using Embeddings](https://huggingface.co/docs/optimum.neuron/pr_1113/inference_tutorials/compare-book-translations.md) | |
| - [Stable Diffusion XL with Neuronx: Text to image](https://huggingface.co/docs/optimum.neuron/pr_1113/inference_tutorials/stable-diffusion-xl-txt2img.md) | |
| - [Deploy Llama 3.3 70B on AWS Inferentia2](https://huggingface.co/docs/optimum.neuron/pr_1113/inference_tutorials/deploy-llama-3-3-70b.md) | |
| - [Stable Diffusion with Neuronx: Text to image](https://huggingface.co/docs/optimum.neuron/pr_1113/inference_tutorials/stable-diffusion-txt2img.md) | |
| - [Run `codellama/CodeLlama-7b-hf` from Hugging Face on Inf2 & Trn1](https://huggingface.co/docs/optimum.neuron/pr_1113/inference_tutorials/CodeLlama-7B-Compilation.md) | |
| - [Qwen3 Embedding on AWS Trainium with Optimum Neuron](https://huggingface.co/docs/optimum.neuron/pr_1113/inference_tutorials/qwen_embedding.md) | |
| - [Create your own chatbot with llama-2-13B on AWS Inferentia](https://huggingface.co/docs/optimum.neuron/pr_1113/inference_tutorials/llama2-13b-chatbot.md) | |
| - [Deploy Mixtral 8x7B on AWS Inferentia2](https://huggingface.co/docs/optimum.neuron/pr_1113/inference_tutorials/deploy-mixtral-8x7b.md) | |
| - [Sentence Transformers on AWS Inferentia with Optimum Neuron](https://huggingface.co/docs/optimum.neuron/pr_1113/inference_tutorials/sentence-transformers.md) | |
| - [Adding support for new architectures](https://huggingface.co/docs/optimum.neuron/pr_1113/contribute/contribute_for_inference.md) | |
| - [Contributing Custom Models for Training](https://huggingface.co/docs/optimum.neuron/pr_1113/contribute/contribute_for_training.md) | |
| - [Setting up your development environment](https://huggingface.co/docs/optimum.neuron/pr_1113/contribute/dev_environment.md) | |
| - [Export a model to Neuron](https://huggingface.co/docs/optimum.neuron/pr_1113/guides/export_model.md) | |
| - [Deploying a LLM Model with Inference Endpoints](https://huggingface.co/docs/optimum.neuron/pr_1113/guides/vllm_on_ie.md) | |
| - [optimum-neuron plugin for vLLM](https://huggingface.co/docs/optimum.neuron/pr_1113/guides/vllm_plugin.md) | |
| - [Distributed Training with `optimum-neuron`](https://huggingface.co/docs/optimum.neuron/pr_1113/guides/distributed_training.md) | |
| - [Inference pipelines with AWS Neuron (Inf2/Trn1)](https://huggingface.co/docs/optimum.neuron/pr_1113/guides/pipelines.md) | |
| - [Neuron Model Cache](https://huggingface.co/docs/optimum.neuron/pr_1113/guides/cache_system.md) | |
| - [Introduction](https://huggingface.co/docs/optimum.neuron/pr_1113/guides/benchmark.md) | |
| - [Models](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/modeling_auto.md) | |
| - [๐ Instruction Fine-Tuning of Llama 3.1 8B with LoRA](https://huggingface.co/docs/optimum.neuron/pr_1113/training_tutorials/finetune_llama.md) | |
| - [๐ Tutorials: How To Fine-tune & Run LLMs](https://huggingface.co/docs/optimum.neuron/pr_1113/training_tutorials/finetune_llms_overview.md) | |
| - [๐ Continuous Pretraining of Llama 3.2 1B on SageMaker Hyperpod with Pre-built Containers](https://huggingface.co/docs/optimum.neuron/pr_1113/training_tutorials/pretraining_hyperpod_llm.md) | |
| - [Getting started with AWS Trainium and Hugging Face Transformers](https://huggingface.co/docs/optimum.neuron/pr_1113/training_tutorials/fine_tune_bert.md) | |
| - [๐ Fine-Tune Qwen3 8B with LoRA](https://huggingface.co/docs/optimum.neuron/pr_1113/training_tutorials/finetune_qwen3.md) | |
| - [Stable Diffusion](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/stable_diffusion.md) | |
| - [PixArt-ฮฑ](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/pixart_alpha.md) | |
| - [Latent Consistency Models](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/lcm.md) | |
| - [PixArt-ฮฃ](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/pixart_sigma.md) | |
| - [Stable Diffusion XL Turbo](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/sdxl_turbo.md) | |
| - [IP-Adapter](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/ip_adapter.md) | |
| - [Stable Diffusion XL](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/stable_diffusion_xl.md) | |
| - [InstructPix2Pix](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/pix2pix.md) | |
| - [ControlNet](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/controlnet.md) | |
| - [Flux](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/flux.md) | |
| - [Load adapters](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/diffusers/lora.md) | |
| - [Whisper](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/transformers/whisper.md) | |
| - [YOLOS](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/transformers/yolos.md) | |
| - [BERT](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/transformers/bert.md) | |
| - [CLIP](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/transformers/clip.md) | |
| - [Sentence Transformers ๐ค](https://huggingface.co/docs/optimum.neuron/pr_1113/model_doc/sentence_transformers/overview.md) | |
Xet Storage Details
- Size:
- 6.34 kB
- Xet hash:
- b3091b784c0cc4f2949162ab8f8f56227b8c89591b028dfa3fc8a8d434572b90
ยท
Xet efficiently stores files, intelligently splitting them into unique chunks and accelerating uploads and downloads. More info.