Zhihe Yang
zhyang2226
AI & ML interests
Trustworthy RL & Offline RL
Recent Activity
liked a model 5 days ago
MiniMaxAI/MiniMax-H3 upvoted a paper 5 months ago
Exploratory Memory-Augmented LLM Agent via Hybrid On- and Off-Policy Optimization liked a model 8 months ago
NbAiLabArchive/whisper-large-v2-nob