
Site Reliability Engineer
Håll muspekaren över eller tryck på en rad för fullständig statistik (EUR / månad i detta diagram).
Löneanalys
Löneerbjudandet i den här annonsen jämfört med referensen "Marknadsgenomsnitt: Medelnivå-nivå": mittpunkten ligger cirka 92 % under referensnivån. Samtidigt ligger erbjudandet under marknadsintervallet (€7 668–€12 307). Intervallbredden är i stort sett i linje med marknaden. Referensen bygger på 1 jämförbara annonser.
| \n\n---\n\n Marknad | Nedre gräns (25:e percentilen) | \n\n---\n\n Median | \n\n---\n\n Övre gräns (75:e percentilen) |
|---|---|---|---|
| Marknadssnitt: Site Reliability Engineer | €6 006/per månad | €7 294/per månad | €11 397/per månad |
| Lön i vår data — anges ej i annonsen (Medelnivå) | €639/per månad | €832/per månad | €1 026/per månad |
Site Reliability Engineer inom nätverksinfrastruktur Amsterdam, Nederländerna; Distans - Europa Om Nebius: Nebius leder en ny era av molninfrastruktur för den globala AI-ekonomin. Vi bygger en full-stack AI-molnplattform som stöder utvecklare och företag från data- och modellträning till produktionsdriftsättning, utan kostnaden och komplexiteten av att bygga stor intern AI/ML-infrastruktur. Byggd av ingenjörer, för ingenjörer. Från storskalig GPU-orkestrering till inferensoptimering äger vi de svåra problemen inom beräkning, lagring, nätverk och tillämpad AI. Noterad på Nasdaq (NBIS) med huvudkontor i Amsterdam, vi har ett globalt fotavtryck med FoU-center i Europa, Storbritannien, Nordamerika och Israel. Vårt team på 1 500+ inkluderar hundratals ingenjörer med djup expertis inom hårdvara, mjukvara och AI-FoU. Rollen Vi söker en Site Reliability Engineer som hjälper till att bygga och driva den fundamentala delen av Nebius - nätverket - infrastrukturen som allt annat beror på. Detta är en ingenjörsfokuserad SRE-roll: du kommer att fastställa tydliga tillförlitlighetsmål, bygga verktygen och automatiseringen för att uppnå dem, och göra nätverket säkrare att driva när vi skalar snabbt. Dina ansvarsområden kommer att inkludera: - Definiera och äga tillförlitlighetsmål för nätverkstjänster och kritiska vägar (SLI/SLO, tillgänglighetsmål, felbudgetar där det är lämpligt) - Driva tillförlitlighetsförbättringar i hela nätverket: inte bara tjänster, utan även platsberedskap, anslutning mellan platser (DCI) och operativa standarder - Äga incidenthanteringen för dina områden, leda utredningar/postmortems och omvandla fel till hållbara lösningar (inte upprepad brandbekämpning) - Bygga och utveckla observerbarhet: åtgärdbara mätvärden/loggar/spår, larm och snabbare felsökningsloopar under och efter incidenter - Designa säkrare arbetsflöden för ändringar: automatisering, CI/CD, test-/stagingmiljöer, canary-utrullningar, återställningar och granskningsbarhet för nätverksändringar - Arbeta nära nätverksingenjörer och plattformsteam för att bygga in operabilitet i designen och hålla driften praktisk och snabb Vi förväntar oss att du har: - Starka produktionsgrundkunskaper i Linux och ett strukturerat tillvägagångssätt för att felsöka komplexa system - Solid förståelse för nätverksgrunder och hur riktiga nätverk fallerar (kontrollplan mot dataplan, latens/förlust, feldomäner, etc.) - Praktisk erfarenhet av att driva system med hög tillgänglighet och förbättra dem över tid (inte bara "hålla lamporna tända") - Förmåga att skriva och underhålla mjukvara/automatisering (Go är vanligt hos oss; Python är också välkommet) - Erfarenhet av moderna infrastrukturverktyg (t.ex. IaC, CI/CD, containerplattformar) och vana vid att automatisera operativa arbetsflöden Det är en bonus om du har: - Erfarenhet av trafikbehandling med hög genomströmning: lastbalanserare, tunneling/decap, NAT64 eller liknande datavägsintensiva system - Bakgrund inom nätverksprestanda/felsökning på låg nivå (eBPF/XDP, DPDK, perf/ftrace, kernel-nätverksinterna) - Erfarenhet av att bygga nätverkssäkra leveranspipeliner (testlab, stegvisa utrullningar, automatiserad verifiering, drift detektering) - Bakgrund med storskalig nätverksobservabilitet/telemetri (t.ex. routing/flödestelemetri, regressionsdetektering i skala)
Jobbdetaljer
Ansvarsområden
- Definiera och äga tillförlitlighetsmål för nätverkstjänster (SLI/SLO, tillgänglighetsmål)
- Driva tillförlitlighetsförbättringar för platsberedskap och anslutning mellan platser (DCI)
- Leda incidenthantering, utredningar och postmortems
- Bygga och utveckla observerbarhet med mätvärden, loggar och spårning
- Designa säkrare arbetsflöden för ändringar inklusive automatisering, CI/CD och canary-utrullningar
- Samarbeta med nätverksingenjörer och plattformsteam för att bygga in operabilitet i designen
Krav
- Starka produktionsgrundkunskaper i Linux
- Strukturerat tillvägagångssätt för att felsöka komplexa system
- Solid förståelse för nätverksgrunder (kontrollplan mot dataplan, latens/förlust, feldomäner)
- Praktisk erfarenhet av att driva system med hög tillgänglighet
- Förmåga att skriva och underhålla mjukvara/automatisering i Go eller Python
- Erfarenhet av moderna infrastrukturverktyg (IaC, CI/CD, containerplattformar)
Kompetenser & tekniker

Relaterade möjligheter
Hitta fler möjligheter som matchar dina intressen och färdigheter