mindlab-research/Macaron-V1-Tall
Text Generation • 36B • Updated • 604 • 39
agent model, continual learning
LongStraw: Long-Context RL Beyond 2M Tokens under a Fixed GPU Budget
On the Scaling of PEFT: Towards Million Personal Models of Trillion Parameters