Hugging Face
Models
Datasets
Spaces
Buckets
new
Docs
Enterprise
Pricing
Website
Tasks
HuggingChat
Collections
Languages
Organizations
Community
Blog
Posts
Daily Papers
Hardware
Learn
Discord
Forum
GitHub
Solutions
Team & Enterprise
Hugging Face PRO
Enterprise Support
Inference Providers
Inference Endpoints
Storage Buckets
Log In
Sign Up
Masayuki Yamada
PRO
beachcities
1
Follow
0 followers
·
1 following
beachcities
masayukiyamada
AI & ML interests
None yet
Organizations
None yet
beachcities
's models
47
Sort: Recently updated
beachcities/qwen3-4b-sft-v3b-emptythink-merged
4B
•
Updated
Feb 10
•
3
beachcities/qwen3-4b-sft-v3a-lr5e5
Text Generation
•
Updated
Feb 10
•
2
beachcities/qwen3-4b-sft-dpo-v25mix-structeval
Text Generation
•
4B
•
Updated
Feb 8
•
10
beachcities/qwen3-4b-sft-v25mix-structeval
Text Generation
•
Updated
Feb 8
•
1
beachcities/qwen3-4b-sft-dpo-v3-structeval
Text Generation
•
4B
•
Updated
Feb 8
•
5
beachcities/qwen3-4b-sft-dpo-v2mix-structeval
Text Generation
•
4B
•
Updated
Feb 7
•
5
beachcities/qwen3-4b-sft-v2mix-structeval
Text Generation
•
Updated
Feb 7
•
1
beachcities/qwen3-4b-sft-dpo-v2-structeval
Text Generation
•
4B
•
Updated
Feb 7
•
8
beachcities/qwen3-4b-sft-v4-structeval
Text Generation
•
Updated
Feb 7
•
1
beachcities/qwen3-4b-sft-dpo-structeval
Text Generation
•
4B
•
Updated
Feb 7
•
6
beachcities/qwen3-4b-sft-structeval
Text Generation
•
Updated
Feb 5
•
1
beachcities/Qwen3-4B-DPO-Final-Day3
Text Generation
•
4B
•
Updated
Feb 4
•
7
beachcities/planB-merged-qwen3-4b-2507
4B
•
Updated
Feb 4
•
4
beachcities/ppo-BipedalWalker-v3-A100-SOTA
Reinforcement Learning
•
Updated
Dec 19, 2025
•
2
beachcities/ppo-LunarLander-v3-A100-SOTA
Reinforcement Learning
•
Updated
Dec 18, 2025
•
4
beachcities/ppo-LunarLander-v2-expert
Reinforcement Learning
•
Updated
Dec 18, 2025
•
6
beachcities/ppo-LunarLander-v3
Reinforcement Learning
•
Updated
Dec 18, 2025
•
3
Previous
1
2
Next