Vou ajustar fino o llama, qwen ou mistral llms com lora

S
sidharth1
S
sidharth1
Sidharth P
Algumas informações foram traduzidas automaticamente.

Sobre este Serviço

Tradução automática

Precisa de um LLM de código aberto que realmente conheça seu domínio, formato ou estilo? Eu ajusto ele com seus dados e mostro, com números, o quanto ele melhorou.


Sou pesquisador de IA (ICML 2026, IJCNLP-AACL 2025) e ajusto e avalio modelos abertos em setups multi-GPU H100 como parte da minha pesquisa.


O que você recebe:

  • Recomendação de modelo base e método (LoRA, QLoRA, SFT completo ou GRPO)
  • Limpeza de dados e formatação em templates de chat ou instruções
  • Código de treinamento limpo, reprodutível e configuração
  • Adaptador LoRA treinado ou pesos mesclados em pacotes superiores
  • Avaliação antes e depois em um conjunto reservado
  • Configuração opcional de serving rápido com vLLM ou SGLang


Modelos: Llama, Qwen, Mistral, Gemma, DeepSeek e outros modelos Hugging Face.


Envie sua dataset e objetivo antes de fazer o pedido e eu sugerirei o modelo base, método e pacote adequados.

Conheça mais sobre Sidharth P

Sidharth P

AI Safety Researcher and LLM Fine Tuning Expert

  • A partir deÍndia
  • Membro desdeabr. de 2017
  • Idiomas

    Telugu, Inglês, Hindi
AI researcher in LLM safety and NLP. Research Intern at AI4Bharat (first author of IndicBERT-v3, open multilingual encoder LLMs) and Research Fellow at SPAR. Papers at ICML 2026 and IJCNLP-AACL 2025, plus arXiv work on memory attacks against LLM agents. Hands-on with LoRA/QLoRA and full fine-tuning (SFT, GRPO), multi-GPU training on H100s, vLLM/SGLang inference and LLM-as-judge evaluation. I help teams fine-tune open-source LLMs, build evaluation pipelines, red-team LLM agents and reproduce ML papers. Message me your goal and I will reply with a clear plan.

Tradução automática

Meu portfólio

Outros serviços de Desenvolvimento de IA que eu ofereço