Varje lönesiffra på JobCrawls — medianer, intervall och statistik per roll eller stad — går igenom samma process. Här är exakt vad den processen gör.
Skrivet av John Spina
Vi samlar in löner som anges i annonsen
Vår extraheringsprocess hämtar lönesiffror direkt från annonstexten. Den är uttryckligen instruerad att inte gissa en siffra från vaga fraser som ”konkurrenskraftig lön” — om annonsen inte anger en siffra hittar vi inte på en här.
Vi uppskattar när inget anges — och flaggar det
När en annons saknar angiven lön uppskattar vi en utifrån en trovärdighetsviktad blandning av jämförbara annonser för samma titel, plats, rollnivå och företag — viktat mer mot bredare, större urval när ett smalt urval är tunt. Uppskattade siffror märks som uppskattningar överallt där de visas bredvid en jobbannons, så du alltid kan skilja en angiven lön från en härledd.
Vi normaliserar varje siffra till EUR/månad
Annonser anger lön på olika sätt — timme, månad, år — och perioder är ibland felmärkta. Vi omvandlar varje siffra till EUR/månad och gör en rimlighetskontroll (ungefär 500–30 000 EUR/månad, med intervallets topp högst 5 gånger botten) för att fånga platshållar- eller felaktig data innan den når någon statistik.
Vi trimmar avvikare baserat på urvalsstorlek
Med färre än 5 annonser tillämpar vi ingen trimning — det finns inte tillräckligt med data för att säkert utesluta något. Vid 5–24 annonser trimmar vi med en kvartilbaserad kontroll. Vid 25 eller fler annonser tillämpar vi en striktare trimning mellan 10:e och 90:e percentilen innan median, medelvärde och percentiler beräknas.
Det visade intervallet är inte det råa min- och maxvärdet
En enskild ovanlig annons skulle annars kunna sätta hela det publicerade intervallet. De låg- och högvärden vi visar är 10:e percentilen av minimivärden och 90:e percentilen av maxvärden i urvalet — inte den enskilt lägsta eller högsta siffran vi såg.