"Doing More with Less Tokens: Hierarchical Reinforcement Learning for Efficient Coding Agents". Official 4B, 9B, and 35B-A3B models.
XLearning-SCU
XLearning-SCU
AI & ML interests
None yet
Recent Activity
upvoted a collection 2 days ago
HERO published a dataset 3 days ago
XLearning-SCU/HERO-Trajectories updated a collection 4 days ago
HEROOrganizations
None yet