Ik evalueer AI en llm schrijven
Over deze dienst
Een AI-antwoord kan zelfverzekerd klinken en toch de feiten verkeerd hebben, instructies missen of de taak niet voltooien. Ik beoordeel de outputs van jouw model en laat je zien waar het tekortschiet.
Ik heb drie jaar ervaring in AI-training en evaluatie, inclusief werk met Mercor en andere AI-platforms. Mijn ervaring omvat response scoring, rubric ontwikkeling, vergelijken van modeloutputs en het controleren van zakelijke en boekhoudkundige taken.
Voor elk antwoord controleer ik:
Correctheid en onbewezen claims
Volgen van instructies
Relevantie en volledigheid
Je ontvangt een spreadsheet met scores en duidelijke uitleg gekoppeld aan specifieke delen van elk antwoord. Standaard- en Premium-pakketten bevatten ook terugkerende problemen, met verbeteringsaanbevelingen inbegrepen in Premium.
Elk item bevat één prompt en één antwoord, elk tot 500 woorden. Ik kan jouw rubric gebruiken met maximaal vijf criteria. Eén revisie is inbegrepen voor aanpassingen aan de oorspronkelijke evaluatie.
Heb je een aangepaste rubric nodig, herschreven antwoorden of reviews die uitgebreid onderzoek vereisen? Stuur me eerst een bericht zodat we de scope kunnen afspreken.
Techniek:
Geautomatiseerd
Type tagging:
Tekst
•
Afbeelding
•
Video
