Robuta

https://tldr.takara.ai/p/2508.20722 rStar2-Agent: Agentic Reasoning Technical Report | Takara TLDR We introduce rStar2-Agent, a 14B math reasoning model trained with agentic reinforcement learning to achieve frontier-level performance. Beyond current long ... technical reportagentreasoningtakaratldr