https://tldr.takara.ai/p/2508.20722
rStar2-Agent: Agentic Reasoning Technical Report | Takara TLDR
We introduce rStar2-Agent, a 14B math reasoning model trained with agentic reinforcement learning to achieve frontier-level performance. Beyond current long ...
technical reportagentreasoningtakaratldr