Unsloth AI é um toolkit open-source para treinamento e fine-tuning mais rápidos de grandes modelos de linguagem.
Fine-tuning e RL mais rápidos para LLMs
Unsloth AI foca em otimização de computação para reduzir o tempo de treinamento e o uso de memória. Ele oferece suporte a configurações modernas de treinamento e famílias de modelos, incluindo:
gpt-oss
Llama 4
DeepSeek-R1
Qwen3
modelos de TTS
modelos no estilo BERT
Principais recursos incluem:
suporte a aprendizado por reforço (RL, GRPO)
treinamento de longo contexto com centenas de milhares de tokens
suporte a formatos numéricos modernos, como FP8
Feito para desenvolvedores e equipes
Unsloth AI é voltado para engenheiros que querem adaptar rapidamente um modelo para uma tarefa específica, como um chatbot, assistente ou ferramenta interna. Para ajudar na implementação e na colaboração, ele oferece:
imagens Docker
documentação e um blog com atualizações
uma comunidade ativa no Discord
Para experimentos e produção
O projeto pode ser usado tanto em experimentos de pesquisa quanto em cargas de trabalho de produção. O código open-source facilita auditar, personalizar e adaptar o fluxo de treinamento à infraestrutura da sua empresa.

