AI Observability Engineer | Budujte spolehlivou monitoring platformu
Máte hluboké zkušenosti s monitoringem, observability a provozem kritických systémů? Pro významnou organizaci hledáme zkušeného specialistu/specialistku, který/á převezme odpovědnost za oblast AI observability a bude formovat způsob, jakým jsou monitorovány a provozovány moderní AI, datové a cloudové platformy.
Jedná se o strategickou technickou roli s vysokou mírou samostatnosti, kde budete navrhovat standardy, optimalizovat provozní spolehlivost a spolupracovat s odborníky napříč cloudovými, platformními i vývojovými týmy.
POPIS POZICE
- Návrh observability strategií: Budete navrhovat a implementovat monitoring a observability pro AI a datové platformy.
- Monitoring a alerting: Zajistíte efektivní sběr metrik, logů a telemetrických dat včetně nastavení alertingu.
- Analýza výkonnosti a dostupnosti: Budete sledovat stabilitu, výkon a provozní spolehlivost kritických systémů.
- Troubleshooting incidentů: Identifikujete příčiny problémů a navrhnete preventivní opatření pro jejich eliminaci.
- Spolupráce napříč týmy: Budete úzce spolupracovat s cloudovými, platformními a vývojovými týmy.
- Definice standardů: Pomůžete nastavovat best practices v oblasti monitoringu, logování a observability.
- Automatizace: Budete automatizovat monitoring, sběr dat a provozní procesy.
- Podpora AI řešení: Zajistíte provoz a dohled nad AI službami v produkčním prostředí.
PROFIL KANDIDÁTA
- Observability a monitoring: Máte pokročilé zkušenosti s logováním, monitoringem a observability nástroji.
- Metriky, logy a tracing: Rozumíte sběru, analýze a interpretaci provozních dat v distribuovaných systémech.
- Cloud i on-premise prostředí: Máte zkušenosti s provozem systémů v hybridních technologických ekosystémech.
- Distribuované architektury: Orientujete se v moderních aplikacích, mikroservisních řešeních a komplexních platformách.
- Troubleshooting: Dokážete efektivně analyzovat a řešit problémy v produkčních prostředích.
- Technické vedení: Umíte navrhovat a prosazovat technická řešení napříč organizací.
- Prometheus, Grafana, Elastic, Datadog nebo Splunk: Praktická zkušenost s některou z předních observability platforem je velkou výhodou.
- Kubernetes a kontejnery: Znalost kontejnerových technologií a orchestrace je výhodou.
- AI/ML prostředí: Výhodou jsou zkušenosti s provozem AI nebo generativních AI řešení.
- Python, Bash nebo PowerShell: Schopnost automatizace prostřednictvím skriptování je vítaná.
- Samostatnost a iniciativa: Jste osobnost, která dokáže převzít odpovědnost za celou oblast a aktivně ji rozvíjet.
NABÍZÍME
- Klíčová technická role: Možnost významně ovlivnit podobu observability a provozní spolehlivosti AI a cloudových platforem.
- Technologický dopad: Přímý vliv na fungování kritických systémů a moderních AI řešení.
- Prostor pro vlastní návrhy: Vysoká míra autonomie při hledání a implementaci technických řešení.
- Spolupráce s experty: Úzká spolupráce s cloudovými, platformními a vývojovými týmy.
NABÍRÁME MUŽE I ŽENY
Naše inzeráty jsou v některých případech psány v ženském nebo mužském rodě. Tento postup byl zvolen výhradně proto, aby bylo dosaženo co nejvyšší plynulosti textu. V žádném případě se nevyjadřuje genderově podmíněný nebo diskriminační přístup naší společnosti k uchazečům a uchazečkám o volná pracovní místa.
LOKALITA
- Praha
Typ úvazku
- Plný úvazek
Obor
- Development & Engineering
- Infrastructure
- Data Science & Analytics