
IT-infrastrukturtekniker
Vi söker en IT-infrastrukturtekniker – RMA och hårdvarudiagnostik för att ansvara för avancerad felsökning av hårdvara och hantering av RMA-livscykeln i våra produktionsmiljöer för datacenter. Denna roll fungerar som eskaleringspunkt för komplexa server- och firmware-relaterade problem som påverkar systemtillförlitlighet och flottans tillgänglighet. Du kommer att vara ansvarig för djupdiagnostik på företagsserverplattformar, utföra strukturerad rotorsaksanalys, validera felaktiga komponenter och hantera hela garantiprocessen med OEM-leverantörer. Detta är en praktisk teknisk roll med direkt inverkan på hårdvarutillförlitlighet, SLA-prestanda och operativ skalbarhet. Du kommer att arbeta på plats i ett av våra datacenter och samarbeta nära med L1/L2-tekniker, infrastrukturtekniker och leverantörer för att minska upprepade fel och förbättra den övergripande hårdvarukvaliteten i flottan. Du kommer att arbeta från vår datacenterplats i Kansas City, Missouri. Dina ansvarsområden kommer att inkludera: - Utföra avancerad firmware- och hårdvarudiagnostik på företagsserverplattformar, inklusive CPU, minne, PCIe-enheter, GPU:er, lagringssubsystem och strömkomponenter - Felsöka komplexa hårdvarufel med hjälp av systemloggar, BMC/IPMI-gränssnitt, BIOS-diagnostik och leverantörsspecifika verktyg - Fungera som primär eskaleringspunkt för L1- och L2-tekniker vid hårdvaruincidenter med stor påverkan - Genomföra strukturerad rotorsaksanalys och dokumentera fynd för att förhindra upprepade fel - Äga hela RMA-livscykeln, inklusive validering av felaktiga komponenter, skapande av garantianspråk, leverantörssamordning, spårning och lösning - Interagera direkt med OEM-leverantörer för att eskalera återkommande hårdvarudefekter och driva korrigerande åtgärder - Analysera trender för hårdvarufel och rapportera mätvärden som upprepade RMA-nivåer och komponenttillförlitlighet - Utveckla och standardisera diagnostikmanualer, arbetsflöden för felsökning och procedurer för hårdvaruvalidering - Validera ersättningskomponenter innan de återinförs i produktionsmiljöer - Samarbeta tvärfunktionellt med datacenterdrift, inköp och ingenjörsteam för att förbättra processer för hårdvarans livscykel - Bidra till att minska MTTR och förbättra tillförlitligheten i hela flottan genom processförbättringar och kunskapsdelning Vi förväntar oss att du har: - 5+ års praktisk erfarenhet av arbete med företagsserversystem i en produktionsmiljö för datacenter - Djup förståelse för x86-serverarkitektur, inklusive CPU:er, minne, PCIe-enheter, lagringskontroller, GPU:er och strömsubsystem - Stark erfarenhet av att utföra firmware- och BIOS/BMC-diagnostik och uppgraderingar - Avancerade färdigheter i felsökning via Linux-kommandoraden, inklusive logganalys och diagnostik på hårdvarunivå - Erfarenhet av att arbeta med fjärrstyrningsgränssnitt som IPMI, iDRAC, iLO eller motsvarande - Bevisad erfarenhet av att hantera RMA-processer för hårdvara och arbeta direkt med OEM-leverantörer - Förmåga att genomföra strukturerad rotorsaksanalys och dokumentera tekniska fynd tydligt - Bekantskap med hårdvaruövervakningssystem och analys av feltrender - Starkt ägarskap och förmåga att arbeta självständigt i affärskritiska miljöer - Högt kunnande i talad och skriven engelska Det är en bonus om du har: - Erfarenhet av att utföra diagnostik på kortnivå och reparation av komponenter (SMD-omarbete) - Bekantskap med nätverksutrustning för datacenter och grundläggande nätverksfelsökning - Erfarenhet av att stödja GPU-täta eller högpresterande beräkningsmiljöer - Giltigt körkort
Jobbdetaljer
Ansvarsområden
- Utföra avancerad firmware- och hårdvarudiagnostik på företagsserverplattformar
- Felsöka komplexa hårdvarufel med hjälp av systemloggar och BMC/IPMI-gränssnitt
- Fungera som primär eskaleringspunkt för L1/L2-tekniker
- Genomföra strukturerad rotorsaksanalys för att förhindra upprepade fel
- Hantera hela RMA-livscykeln inklusive validering, anspråk och leverantörssamordning
- Interagera med OEM-leverantörer för att driva korrigerande åtgärder för återkommande defekter
- Analysera trender för hårdvarufel och rapportera tillförlitlighetsmätvärden
- Utveckla standardiserade diagnostikmanualer och arbetsflöden för felsökning
- Validera ersättningskomponenter före återinförande i produktion
- Samarbeta med drift, inköp och ingenjörsteam för att förbättra livscykelprocesser
- Minska MTTR och förbättra flottans tillförlitlighet genom kunskapsdelning
Krav
- 5+ års erfarenhet av företagsserversystem i produktionsdatacenter
- Djup förståelse för x86-serverarkitektur (CPU, minne, PCIe, lagring, GPU, ström)
- Erfarenhet av firmware- och BIOS/BMC-diagnostik och uppgraderingar
- Avancerad felsökning via Linux-kommandoraden och logganalys
- Erfarenhet av fjärrstyrningsgränssnitt (IPMI, iDRAC, iLO)
- Bevisad erfarenhet av att hantera RMA-processer för hårdvara och relationer med OEM-leverantörer
- Förmåga att genomföra strukturerad rotorsaksanalys
- Bekantskap med hårdvaruövervakning och analys av feltrender
- Högt kunnande i talad och skriven engelska
Kompetenser & tekniker

Relaterade möjligheter
Hitta fler möjligheter som matchar dina intressen och färdigheter