Vou desenvolver modelos de aprendizado por reforço para jogos de robótica e automação em python

Algumas informações foram traduzidas automaticamente.

Paquistão

Eu falo Inglês, Urdu

Engenheiro de IA, Pesquisador publicado, YOLO, Visão computacional, Aprendizado de máquina

Sou Abdullah — Engenheiro de IA, pesquisador publicado (Sensors, MDPI), Expert em Kaggle e Expert em Roboflow, do Paquistão. Criei e publiquei o YOLO-OcuLite, uma arquitetura leve de YOLO para diagnó...
Sobre este Serviço

Eu crio agentes de aprendizado por reforço estáveis, otimizados e prontos para produção, para tarefas de robótica, automação, IA de jogos e simulação.


Sou Abdullah, um pesquisador de IA publicado (Sensors, MDPI), especialista em Kaggle. Implemento PPO, DQN, SAC, TD3 usando Stable Baselines3 e RLlib, não apenas tutoriais, mas sistemas reais e implantáveis.


Serviços

  • Desenvolvimento personalizado de agentes de RL: PPO, DQN, SAC, TD3, A3C
  • Simulação de robótica: PyBullet, MuJoCo, Gazebo, Isaac Gym
  • Modelagem de recompensas e design de ambientes personalizados
  • Sistemas de RL multi-agente
  • Implantação na nuvem e na borda via FastAPI ou Flask


Você recebe

  • Um agente de RL treinado com um pipeline completo de treinamento
  • Curva de recompensa e relatório de desempenho
  • Código Python limpo e documentado
  • Modelo pronto para implantação


Envie os detalhes do seu ambiente e seu objetivo antes de fazer o pedido.


"A maioria dos agentes de RL falha no mundo real. Os meus são feitos para isso."

Especialidade:

processamento de imagem

Classificação

agrupamento

Linguagem de programação:

Python

MATLAB

SQL

Colab

Amazon SageMaker

APIs:

IA de Visão Computacional da Microsoft

Amazon Rekognition

Ferramentas:

caderno Jupyter

opencv

fluxo tensor

Amazon SageMaker

Frameworks:

Scikit-learn

DeepPy

Google ML Kit

keras

PyTorch

Meu portfólio

Outros serviços de Ciência de dados e ML que eu ofereço