Ik optimaliseer tensorrt, cuda, fp16 en int8 inference voor jetson edge ai apparaten

Sommige informatie is automatisch vertaald.

Verenigde Staten

Ik spreek Engels, Spaans, Frans

Computer vision specialist

Ik bouw computer vision systemen die ruwe visuele informatie omzetten in gestructureerde, bruikbare intelligence. Mijn werk combineert beeldverwerking, deep learning en software engineering om complex...
Over deze dienst

Werkt jouw computer vision model te langzaam op een edge apparaat? Ik kan compatibele AI-modellen optimaliseren met TensorRT, CUDA, FP16 en INT8 technieken om de inference-prestaties te verbeteren en beter gebruik te maken van de beschikbare GPU-bronnen.


Ik kan je bestaande deployment profileren, prestatieknelpunten identificeren, ondersteunde modellen converteren, geoptimaliseerde inference configureren en de resultaten benchmarken. De workflow kan worden afgestemd op NVIDIA Jetson en andere compatibele CUDA-compatibele edge platforms, met aandacht voor nauwkeurigheid, latency, geheugengebruik en FPS-vereisten.


Inbegrepen diensten

  • TensorRT optimalisatie
  • CUDA optimalisatie
  • FP16 inference
  • INT8 inference
  • Jetson optimalisatie
  • AI model profilering
  • Inference benchmarking
  • FPS optimalisatie
  • Latency vermindering
  • GPU gebruik
  • Geheugen optimalisatie
  • ONNX conversie
  • TensorRT engine bouwen
  • YOLO optimalisatie
  • CUDA configuratie
  • Model kwantisatie
  • Kalibratie ondersteuning
  • Realtime inference
  • Camera pipeline optimalisatie
  • Python integratie


Stuur me je model, hardware specificaties, huidige benchmark, software omgeving en target prestaties om te beginnen.


API's:

Microsoft Computer Vision AI

•

Amazon Rekognition

Expertise:

Afbeeldingenverwerking

•

Representatieleren

Programmeertaal:

Python

•

R

•

MATLAB

•

Colab

•

Java

Tools:

opencv

•

tensorflow

•

MLflow

•

SimpleCV

•

CVAT

•

Colab

•

PyTorch

Frameworks:

DeepPy

•

Google ML Kit

•

SimpleCV

•

keras

•

PyTorch