Vou otimizar e acelerar seu modelo de IA com onnx e tensorrt

R
riticpathania
R
riticpathania
Ricky
Algumas informações foram traduzidas automaticamente.

Sobre este Serviço

Tradução automática

Seu modelo de IA é preciso, mas está muito lento para uso real?


Eu otimizo pipelines de inferência de aprendizado de máquina e visão computacional para reduzir a latência, melhorar o throughput e simplificar a implantação do modelo em GPUs NVIDIA, dispositivos edge, APIs e sistemas de produção.


Posso ajudar com:


Perfil de modelos PyTorch e análise de gargalos na inferência

Exportação de PyTorch para ONNX

Otimização do ONNX Runtime

Conversão de engine para NVIDIA TensorRT

Otimizações FP16 e INT8 onde suportado

Benchmarking de latência, throughput e FPS

Validação de saída em relação ao modelo original

Otimização de pré-processamento e pós-processamento

Manipulação dinâmica de entrada e tamanho de batch

Ambientes de inferência Dockerizados

Integração de model-serving com FastAPI

Workflows de implantação em NVIDIA Jetson / GPU

Otimização de inferência YOLO e visão computacional


Meu foco não é apenas converter um formato de arquivo. Verifico se o modelo otimizado ainda produz saídas corretas e meço a melhora de desempenho real.


Entregas típicas podem incluir:

Arquivos de modelo / engine otimizados

Scripts de inferência em Python

Resultados de benchmark antes/depois

Resultados de validação de saída

Instruções de configuração


Por favor, envie uma mensagem antes de fazer o pedido.

Conheça mais sobre Ricky

Ricky

High Performance Python and AI Engineer, APIs, Vision, Optimization

4,9(6)
  • A partir deÍndia
  • Membro desdejul. de 2023
  • Última entrega2 semanas
  • Idiomas

    Hindi, Inglês
I'm a Python and AI engineer focused on performance and production machine learning. I help clients solve technical problems such as slow Python/Pandas code, broken or incomplete FastAPI backends, custom YOLO computer-vision pipelines, and slow AI inference workflows. My work includes: - Python, Pandas, NumPy, Cython and C/C++ performance optimization - FastAPI and Flask backend development and debugging - REST APIs, databases, Docker and production deployment - YOLO object detection, tracking and computer-vision pipelines - PyTorch, ONNX and TensorRT inference optimization

Tradução automática

Meu portfólio