Trust & Safety Evaluator with English from USAI 6- months project
Håll muspekaren över eller tryck på en rad för fullständig statistik (EUR / månad i detta diagram).
| \n\n---\n\n Marknad | Nedre gräns (25:e percentilen) | \n\n---\n\n Median | \n\n---\n\n Övre gräns (75:e percentilen) |
|---|---|---|---|
| Lön i vår data — anges ej i annonsen (Medelnivå) | €225/per månad | €246/per månad | €267/per månad |
**Beskrivning** Trust & Safety-utvärderare utför adversariell testning och säkerhetsutvärdering av generativa AI-funktioner. Huvuduppgifterna är att utforma frågor, utvärdera säkerheten i det genererade innehållet och ge kritisk feedback. Denna roll kräver kreativt tänkande kring potentiellt missbruk, djup kulturell och språklig kunskap samt förmågan att identifiera subtila säkerhetsrisker. **Projekttid: 6 månader** **HUVUDANSVAR** - Skriva, granska och utvärdera varierande och utmanande frågor utformade för att testa systemets gränser och exponera problematiska utdata. Frågorna kommer att rikta sig till specifika riskämnen inklusive explicit och/eller stötande innehåll - Designa och utföra sekvenser av frågor som simulerar realistiska, pågående konversationer. - Utforma attackscenarier med tekniker som crescendo-attacker och kontextmanipulering för att testa systemet - Åldersanpassad säkerhetsutvärdering: för att vägleda adversariell frågeutformning och säkerhetsutvärdering. - Tilldela riskbetyg till AI-genererat innehåll baserat på säkerhetsriktlinjer. - Upptäcka och artikulera potentiella fördomar i systemgenererat innehåll - Identifiera subtila osäkra element, inkonsekvenser eller problematiska implikationer - Utvärdera specifik kulturell och språklig kunskap i olika kulturella sammanhang. - Utnyttja bekantskap med relevanta domäner, genrer, kulturella referenser och branschkontext. - Slutföra adversariella testuppgifter inom tidsramarna - Upprätthålla hög noggrannhet och uppmärksamhet på detaljer under högt tempo. **KRAV** - Minst 6 års studier/boende eller arbete i USA - Språkkunskaper: Engelska från USA som primärspråk krävs - Djup kulturell medvetenhet om det amerikanska engelska språket: kontext, sociala normer och värderingar - Förståelse för kulturella referenser och branschkontext - Kunskap om hur olika kulturella grupper tolkar innehåll - Bekantskap med beteendemönster hos yngre målgrupper - Förmåga att utvärdera innehåll i olika kulturella sammanhang - Frågeutformning och scenariodesign - Tekniker som crescendo-attacker och kontextmanipulering - Tilldelning av riskbetyg baserat på riktlinjer - Detektering av partiskhet i AI-utdata - Uppmärksamhet på detaljer + förmåga att arbeta snabbt under tidspress - Förmåga att producera kreativt innehåll - Förståelse för slang och ungdomsspråk **FÖRETRÄDANDE BAKGRUND** Kreativt skrivande, sociala medier-hantering, community-hantering, innehållsmoderering, digital marknadsföring, kommunikation, journalistik, PR, copywriting eller relaterade områden. **FÖRETRÄDANDE KUNSKAPER** - Trust & Safety-bakgrund: Tidigare erfarenhet av trust and safety eller liknande roller. - Förståelse för hur säkerhetssystem fungerar i stor skala och vanliga feltyper. - Flyt i ytterligare språk utöver engelska är en fördel i denna roll. - Bekantskap med maskininlärningskoncept **INNEHÅLLSVARNING & VALFRIVILLIG DELTAGANDE** Denna roll innebär exponering för känsligt och potentiellt störande innehåll, inklusive exempel på toxiskt och vulgärt språk, sexuellt explicit innehåll, beskrivningar av våld och självskada, barnmissbruk, exploatering och annat skadligt material. Du kommer att möta detta innehåll som en del av den adversariella testningen och säkerhetsutvärderingen. **VI ERBJUDER** - Företagshälsovård på Terveystalo privata klinik - Lunchförmån med ePassi - Efter 4 månader, behörighet till Pohjola omfattande sjukförsäkring - Omfattande fritidsolycksfallsförsäkring via Pohjola - Sport-, kultur- och hälsoförmåner via Epassi, årlig skattefri maxvärde 400€ - Multikulturell miljö/mångfald och inkludering - Välgörenhets- och välmåendeaktiviteter - Företagsevenemang - Rekryteringsbonusar för anställda & erkännandeprogram _Endast utvalda kandidater kommer att kontaktas/intervjuas._ Vänligen bifoga en uppdaterad kopia av ditt CV på engelska.
Jobbdetaljer
Ansvarsområden
- Utföra adversariell testning och säkerhetsutvärdering av generativa AI-funktioner
- Utforma och granska utmanande frågor för att exponera problematiska AI-utdata
- Designa attackscenarier med hjälp av kontextmanipulering och crescendo-attacker
- Tilldela riskbetyg till AI-genererat innehåll baserat på säkerhetsriktlinjer
- Upptäcka och artikulera potentiella fördomar i systemgenererat innehåll
- Utvärdera kulturell och språklig kunskap i olika sammanhang
- Upprätthålla hög noggrannhet och uppmärksamhet på detaljer under högt tempo
Krav
- Minst 6 års studier, boende eller arbete i USA
- Modersmålsnivå i amerikansk engelska
- Djup kulturell medvetenhet om amerikanska sociala normer, värderingar och kontext
- Förmåga att utforma adversariella frågor och attackscenarier (t.ex. crescendo-attacker)
- Förmåga att upptäcka partiskhet och tilldela riskbetyg till AI-innehåll
- Uppmärksamhet på detaljer och förmåga att arbeta snabbt under tidspress
- Förmåga att producera kreativt innehåll och förstå ungdomsslang
Kompetenser & tekniker
Förmåner & Perks
Rekryteringsprocess
- 1Inlämning av CV på engelska
- 2Urval
- 3Intervju

Relaterade möjligheter
Hitta fler möjligheter som matchar dina intressen och färdigheter