Ik ontwikkel reinforcement learning en rlhf-oplossingen voor ai-agenten
Niveau 2
Voldoet aan hoge prestatiecriteria en heeft een bewezen staat van dienst in het voldoen aan de verwachtingen van de klant.
Over deze dienst
Ik help bedrijven en onderzoekers bij het ontwerpen, trainen en inzetten van Reinforcement
Learning (RL) systemen, van klassieke RL-agenten tot moderne RLHF-pijplijnen
gebruikt om LLM's af te stemmen en fijn te tunen.
WAT IK VOOR JE KAN BOUWEN:
Aangepaste RL-agenten voor games, robotica, handel of simulaties
RLHF / RLAIF-pijplijnen voor het fijn afstemmen en afstemmen van taalmodellen
Reward model ontwerp en reward shaping
Multi-agent systemen (MARL) en zelfspelomgevingen
Autonome controlesystemen (drones, HVAC, robotica)
Trainingspijplijnen met Gymnasium, Unity ML-Agents of aangepaste omgevingen
Volledige evaluatie, benchmarking en prestatieverslagen
WAAROM MET MIJ WERKEN:
Ik ben een Machine Learning Engineer (M.S. in AI & Autonomous Systems) met meer dan 5 jaar praktische RL-ervaring, waaronder DQN, PPO, Decision Transformers en hiërarchisch RL. Ik heb meer dan 100 projecten op Fiverr afgerond met een 5.0 beoordeling, variërend van dronezwermcontrole tot bordspel-AI en multi-agent handelssystemen.
Omdat AI-systemen steeds meer afhankelijk worden van menselijke feedback om te verbeteren (RLHF/RLAIF),
is dit precies de expertise die de meest geavanceerde AI-producten van vandaag aandrijft.
Programmeertaal:
Python
•
MATLAB
•
Colab
Tools:
Jupyter-notitieboek
•
opencv
•
tensorflow
•
MLflow
•
Colab
Frameworks:
keras
•
PyTorch
•
tensorflow
•
Overige
Mijn portfolio
Veelgestelde vragen
Automatische vertaling
Werk je met LLMs en RLHF, niet alleen met classic RL?
Ja — ik bouw RLHF/RLAIF-pijplijnen voor het finetunen en afstemmen van language models, naast classic RL (spellen, robotica, besturingssystemen).
Welke frameworks gebruiken jullie?
PyTorch, TensorFlow, Stable-Baselines3, Gymnasium, Unity ML-Agents en aangepaste omgevingen afhankelijk van jouw project.
Ik weet niet zeker welke package bij mijn project past — wat doe ik?
Stuur me eerst een korte beschrijving van je doel en eventuele data/omgeving die je hebt. Ik adviseer je over de juiste scope voordat je bestelt.
Kun je het model implementeren, niet alleen code leveren?
Ja — cloud deployment en API-integratie zijn beschikbaar in de Standard en Premium pakketten.
14 reviews van deze dienst
| (14) | ||
| (0) | ||
| (0) | ||
| (0) | ||
| (0) |
Specificering van de beoordeling
- Communicatieniveau van de freelancer
- Kwaliteit van de levering
- Waarde van de levering
Sorteer op
R rajib_alam_

Finland
Lopende samenwerkingThis was the 3rd time I worked with him. He exceeds the expectations every time. I am very satisfied with his work. He has very deep expertise on ML topics.
US$ 100-US$ 200
Prijs
2 weken geleden
Looptijd
E 
Reactie van de freelancer
Nuttig?K kennyldc

Verenigde Staten
Lopende samenwerkingWorking with Ali is always a great experience. He has strong expertise in the topics and shows a high level of dedication to his deliverables, paying close attention to detail. I highly recommend him for any reinforcement learning project, as he can easily adapt to the specific needs you may have.
US$ 100-US$ 200
Prijs
13 dagen
Looptijd
Nuttig?K kennyldc

Verenigde Staten
Lopende samenwerkingA pleasure to work with Ali in topics related to Reinforcement Learning. He is very knowledgeable about the subject. I would recommend him to anyone without a doubt.
US$ 100-US$ 200
Prijs
8 dagen
Looptijd
Nuttig?R rajib_alam_

Finland
Lopende samenwerkingthis is my second project with him. He exceeded all expectations. Will definitely work with him again. He goes above and beyond in each project.
US$ 50-US$ 100
Prijs
5 dagen
Looptijd
Nuttig?R rajib_alam_

Finland
Lopende samenwerkingHe was very professional and went beyond the required effort to give a good output. I would definitely work with him again. amazing communication skills and very friendly and cooperative.
US$ 100-US$ 200
Prijs
5 dagen
Looptijd

E 
Reactie van de freelancer
Nuttig?
14 reviews van deze dienst
| (14) | ||
| (0) | ||
| (0) | ||
| (0) | ||
| (0) |
Specificering van de beoordeling
- Communicatieniveau van de freelancer
- Kwaliteit van de levering
- Waarde van de levering
Sorteer op
R rajib_alam_

Finland
Lopende samenwerkingThis was the 3rd time I worked with him. He exceeds the expectations every time. I am very satisfied with his work. He has very deep expertise on ML topics.
US$ 100-US$ 200
Prijs
2 weken geleden
Looptijd
E 
Reactie van de freelancer
Nuttig?K kennyldc

Verenigde Staten
Lopende samenwerkingWorking with Ali is always a great experience. He has strong expertise in the topics and shows a high level of dedication to his deliverables, paying close attention to detail. I highly recommend him for any reinforcement learning project, as he can easily adapt to the specific needs you may have.
US$ 100-US$ 200
Prijs
13 dagen
Looptijd
Nuttig?K kennyldc

Verenigde Staten
Lopende samenwerkingA pleasure to work with Ali in topics related to Reinforcement Learning. He is very knowledgeable about the subject. I would recommend him to anyone without a doubt.
US$ 100-US$ 200
Prijs
8 dagen
Looptijd
Nuttig?R rajib_alam_

Finland
Lopende samenwerkingthis is my second project with him. He exceeded all expectations. Will definitely work with him again. He goes above and beyond in each project.
US$ 50-US$ 100
Prijs
5 dagen
Looptijd
Nuttig?R rajib_alam_

Finland
Lopende samenwerkingHe was very professional and went beyond the required effort to give a good output. I would definitely work with him again. amazing communication skills and very friendly and cooperative.
US$ 100-US$ 200
Prijs
5 dagen
Looptijd

E 
Reactie van de freelancer
Nuttig?

