Ik transcribeer en annoteren mandarin audio voor ai datasets
Over deze dienst
Bereid Mandarin audio voor AI datasets voor met door mensen gecontroleerde transcripts en gestructureerde labels.
Ik ben een native Mandarin spreker en een Big Data en AI Engineer, die Chinese taalbegrip combineert met gestructureerde data voorbereiding.
Ik transcribeer duidelijk Mandarin, label tot 2 sprekers, voeg turn-level timestamps toe en markeer onduidelijke of overlappende spraak zonder te raden. Leveringen: TXT en CSV; JSON in Standaard en Premium.
Basis: 2 audio minuten, tot 100 segmenten. Standaard: 5 minuten, tot 200 segmenten, plus tot 5 door de klant gedefinieerde intentie labels. Premium: 10 minuten, tot 300 segmenten, plus waarneembare AI dialoogproblemen zoals irrelevante antwoorden of duidelijke transcriptfouten. Zowel duur- als segmentlimieten gelden.
Lever audio, labeling richtlijnen en terminologie. Stuur eerst een voorbeeld voor ruis, accenten of specialistische onderwerpen. Woord-voor-woord afstemming, vertaling, voice recording en commerciële dubbing zijn niet inbegrepen.
Revisies corrigeren werk binnen de originele audio en afgesproken regels. Nieuwe bestanden of gewijzigde labels vereisen een nieuwe scope. Deel alleen geautoriseerde audio en verwijder vertrouwelijke details.
Techniek:
Handleiding
Type tagging:
Tekst
•
Audio
Veelgestelde vragen
Automatische vertaling
Neem je op of doe je voice-over?
Deze dienst annoteren je bestaande audio. Opnemen van menselijke stemmen en commerciële dubbing zijn niet inbegrepen.
Hoe precies zijn de timestamps?
Timestamps markeren sprekerswissels. Woord-voor-woord geforceerde afstemming is niet inbegrepen. Zowel audio duur als segmentlimieten gelden.
Kun je intentie labelen of AI antwoorden reviewen?
Standaard en Premium ondersteunen tot 5 afgesproken intentie labels. Premium voegt problemen toe die waarneembaar zijn uit de aangeleverde audio en context; het garandeert geen volledige feitelijke verificatie.
Kun je omgaan met lawaaierige opnames of dialecten?
Stuur eerst een korte sample. Pakketten dekken duidelijke Mandarin met tot 2 sprekers. Onduidelijke delen worden gemarkeerd in plaats van verzonnen.
