Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
Wei Huang
AaronHuangWei
11
28
8
Follow
wwwjc's profile picture
jliu-ac's profile picture
TanZhangyao's profile picture
17 followers
·
25 following
AaronWeiHuang
Aaronhuang-778
AI & ML interests
Deep Learning; Efficient AI; Quantization; LLMs
Recent Activity
authored
a paper
4 days ago
JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion
authored
a paper
4 days ago
Reinforcing Dual-Path Reasoning in Spatial Vision Language Models
authored
a paper
4 days ago
OmniGameArena: A Unified UE5 Benchmark for VLM Game Agents with Improvement Dynamics
View all activity
Organizations
AaronHuangWei
's models
52
Sort: Recently updated
AaronHuangWei/Qwen2.5-7B-Instruct-GRPO-MATH500-qlora32
Updated
Aug 14, 2025
AaronHuangWei/Qwen2.5-14B-GRPO-MATH500-lora32
Updated
Aug 14, 2025
AaronHuangWei/Qwen2.5-14B-GRPO-MATH500-lora64
Updated
Aug 14, 2025
AaronHuangWei/Qwen3-14B-GRPO-MATH500-lora64
Updated
Aug 14, 2025
AaronHuangWei/Qwen2.5-7B-GRPO-MATH500-qlora64
Updated
Aug 14, 2025
AaronHuangWei/Qwen2.5-7B-GRPO-MATH500-lora64
Updated
Aug 14, 2025
AaronHuangWei/Qwen2.5-7B-GRPO-MATH500
Text Generation
•
8B
•
Updated
Aug 14, 2025
•
7
AaronHuangWei/Qwen2.5-7B-GRPO-GSM8K
Updated
Aug 14, 2025
AaronHuangWei/Qwen2.5-7B-GRPO
Text Generation
•
8B
•
Updated
Aug 14, 2025
•
6
AaronHuangWei/Qwen2.5-7B-DAPO
Text Generation
•
8B
•
Updated
Aug 13, 2025
•
5
AaronHuangWei/Qwen3-8B-DAPO
Updated
Aug 13, 2025
AaronHuangWei/Qwen2.5-7B-GSM8k
Updated
Aug 13, 2025
AaronHuangWei/Qwen3-8B-GSM8k
Updated
Aug 13, 2025
AaronHuangWei/Qwen2.5-7B-GRPO-GSM8k-GRPO
Updated
Aug 13, 2025
AaronHuangWei/Qwen2.5-7B-DAPO-Math-GRPO
Updated
Aug 10, 2025
AaronHuangWei/Qwen2.5-3B-Open-R1-Math-GRPO
Updated
Jun 11, 2025
AaronHuangWei/Qwen2.5-7B-Open-R1-Math-GRPO
Updated
Jun 10, 2025
AaronHuangWei/Qwen2.5-7B-Open-R1-Code-GRPO
Updated
Jun 10, 2025
AaronHuangWei/Qwen2.5-1.5B-Open-R1-GRPO
Text Generation
•
3B
•
Updated
Feb 21, 2025
•
4
AaronHuangWei/Qwen2.5-3B-Open-R1-Distill
Text Generation
•
3B
•
Updated
Feb 13, 2025
•
5
•
1
AaronHuangWei/SliM-LLM-plus_parameters
Updated
May 27, 2024
AaronHuangWei/SliM-LLM_group-precision
Updated
May 27, 2024
•
2
Previous
1
2
Next