Vou criar agentes de aprendizado por reforço
Analista de informações
Nível 1
Atendeu a determinados critérios de desempenho e demonstra forte potencial no marketplace.
Sobre este Serviço
Precisa de uma solução personalizada de Aprendizado por Reforço para controle, otimização, simulação ou tomada de decisão inteligente?
Ajudo clientes a projetar e desenvolver agentes de RL sob medida para o problema deles, usando os métodos certos para a tarefa. Com mais de 4 anos de experiência em Aprendizado por Reforço, trabalhei com uma variedade de algoritmos, incluindo DQN, PPO, A3C, TRPO, Actor-Critic, Decision Transformers, RL Hierárquico e RL Multi-Agente.
Posso ajudar com:
- Formulação de problemas de RL e design de MDP
- Desenvolvimento de ambientes personalizados
- Modelagem de recompensas e design de políticas
- Treinamento, teste e otimização de agentes
- Ajuste de hiperparâmetros e análise de resultados
- Implementação em PyTorch ou TensorFlow
- Pipeline de RL de ponta a ponta e soluções prontas para implantação
Minha experiência abrange sistemas de agente único, autojogo e multi-agentes em aplicações como controle de enxame de drones, otimização de HVAC e ambientes de RL baseados em jogos.
Se você procura um desenvolvedor de RL confiável para construir, testar e entregar uma solução técnica para seu projeto, sinta-se à vontade para me enviar uma mensagem e podemos discutir o escopo.
