Submitted by
Phi Nguyen
AI & ML interests
None defined yet.
Recent Activity
View all activity
Papers
Flattening Every Memory Peak in Long-Context Mixture-of-Experts Training
RISE: Recursive Improvement via Self-Extrapolating Policy Distillation