arxiv:2505.12929
Zhihe Yang
zhyang2226
AI & ML interests
Trustworthy RL & Offline RL
Recent Activity
liked a model 3 days ago
MiniMaxAI/MiniMax-H3 upvoted a paper 5 months ago
Exploratory Memory-Augmented LLM Agent via Hybrid On- and Off-Policy Optimization liked a model 7 months ago
NbAiLabArchive/whisper-large-v2-nob