ReadGlim
Metacognition as Reward: Reinforcing LLM Reasoning via Knowledge and Regulation Signals — ReadGlim