NVIDIA Research Taiwan
NVIDIA Research Taiwan
Home
News
Members
Research
Publications
Contact
Light
Dark
Automatic
Kwang-Ting Cheng
Latest
GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization
EoRA: Fine-tuning-free Compensation for Compressed LLM with Eigenspace Low-Rank Approximation
DoRA: Weight-Decomposed Low-Rank Adaptation
Cite
×