mindlab-research/Macaron-V1-Tall
Text Generation • 36B • Updated • 114 • 9
agent model, continual learning
LongStraw: Long-Context RL Beyond 2M Tokens under a Fixed GPU Budget
On the Scaling of PEFT: Towards Million Personal Models of Trillion Parameters