Test-time calibration learning for large language model reasoning
Zizhuo Zhang PRO
resistz
AI & ML interests
None yet
Recent Activity
updated a model about 9 hours ago
resistz/SFT-Llama-3.1-8B-Instruct-FactQA2K-DAPO17k2K-1Epoch published a model about 10 hours ago
resistz/SFT-Llama-3.1-8B-Instruct-FactQA2K-DAPO17k2K-1Epoch updated a model about 16 hours ago
resistz/RLCR-Calibrated-Qwen3-8B-DAPO-Math14k-3Epoch-330Step