Vou fazer ajuste fino no seu LLM com dados personalizados usando lora e qlora
Engenheiro de aprendizado de máquina
Sobre este Serviço
O ajuste fino vale a pena quando um modelo precisa falar no seu domínio, seguir seu formato ou lidar com sua terminologia de forma consistente. Não vale a pena quando você só precisa que o modelo pesquise informações. Eu te direi qual você realmente precisa antes de você gastar qualquer coisa.
O que eu faço:
Fine-tuning com LoRA e QLoRA de modelos abertos: Llama, Mistral, Qwen, Gemma, Phi
Fine-tuning completo e ajuste de instruções quando seus dados justificarem
Fine-tuning na OpenAI através da API deles
Adaptação de domínio para textos médicos, jurídicos, financeiros e técnicos
Sistemas RAG quando a recuperação é a melhor resposta
Preparação de dados de treinamento, que geralmente é onde os projetos têm sucesso ou fracasso
Pilha: Hugging Face Transformers, PEFT, Unsloth, Axolotl, PyTorch, Weights and Biases para acompanhamento.
Você recebe os pesos treinados hospedados onde desejar, o script de treinamento com documentação completa, resultados de avaliação comparando seu modelo ajustado com o modelo base para que você possa ver o que mudou, um script de inferência e um guia para re-treinamento quando seus dados crescerem.
Você precisa de aproximadamente 50 a 100 exemplos para um ajuste fino leve na OpenAI, ou 500 ou mais para modelos abertos. Qualidade supera quantidade, e eu vou te ajudar a montar o conjunto.
Outros serviços de Ciência de dados e ML que eu ofereço
Perguntas frequentes
Tradução automática
Quanto de dado de treinamento eu preciso?\nA:
Para o fine-tuning na OpenAI, de 50 a 100 exemplos de alta qualidade já mostram melhora. Para modelos de código aberto, de 500 a 5.000 exemplos oferecem os melhores resultados. A qualidade importa mais que a quantidade — vou te ajudar a montar o melhor conjunto de treinamento.
Qual modelo eu devo fazer o fine-tuning?\nA
Depende das suas necessidades. Para uma implementação fácil e alta qualidade, o GPT-3.5 da OpenAI é ótimo. Para privacidade e controle total, modelos de código aberto como LLaMA 3 ou Mistral são melhores. Me manda uma mensagem e vou recomendar a melhor opção para seu caso de uso e seu orçamento.
