AI Observability Engineer | Budujte spolehlivou monitoring platformu

Odpovědět na pozici

Máte hluboké zkušenosti s monitoringem, observability a provozem kritických systémů? Pro významnou organizaci hledáme zkušeného specialistu/specialistku, který/á převezme odpovědnost za oblast AI observability a bude formovat způsob, jakým jsou monitorovány a provozovány moderní AI, datové a cloudové platformy. 

Jedná se o strategickou technickou roli s vysokou mírou samostatnosti, kde budete navrhovat standardy, optimalizovat provozní spolehlivost a spolupracovat s odborníky napříč cloudovými, platformními i vývojovými týmy. 

POPIS POZICE

  • Návrh observability strategií: Budete navrhovat a implementovat monitoring a observability pro AI a datové platformy. 
  • Monitoring a alerting: Zajistíte efektivní sběr metrik, logů a telemetrických dat včetně nastavení alertingu. 
  • Analýza výkonnosti a dostupnosti: Budete sledovat stabilitu, výkon a provozní spolehlivost kritických systémů. 
  • Troubleshooting incidentů: Identifikujete příčiny problémů a navrhnete preventivní opatření pro jejich eliminaci. 
  • Spolupráce napříč týmy: Budete úzce spolupracovat s cloudovými, platformními a vývojovými týmy. 
  • Definice standardů: Pomůžete nastavovat best practices v oblasti monitoringu, logování a observability. 
  • Automatizace: Budete automatizovat monitoring, sběr dat a provozní procesy. 
  • Podpora AI řešení: Zajistíte provoz a dohled nad AI službami v produkčním prostředí. 

PROFIL KANDIDÁTA

  • Observability a monitoring: Máte pokročilé zkušenosti s logováním, monitoringem a observability nástroji. 
  • Metriky, logy a tracing: Rozumíte sběru, analýze a interpretaci provozních dat v distribuovaných systémech. 
  • Cloud i on-premise prostředí: Máte zkušenosti s provozem systémů v hybridních technologických ekosystémech. 
  • Distribuované architektury: Orientujete se v moderních aplikacích, mikroservisních řešeních a komplexních platformách. 
  • Troubleshooting: Dokážete efektivně analyzovat a řešit problémy v produkčních prostředích. 
  • Technické vedení: Umíte navrhovat a prosazovat technická řešení napříč organizací. 
  • Prometheus, Grafana, Elastic, Datadog nebo Splunk: Praktická zkušenost s některou z předních observability platforem je velkou výhodou. 
  • Kubernetes a kontejnery: Znalost kontejnerových technologií a orchestrace je výhodou. 
  • AI/ML prostředí: Výhodou jsou zkušenosti s provozem AI nebo generativních AI řešení. 
  • Python, Bash nebo PowerShell: Schopnost automatizace prostřednictvím skriptování je vítaná. 
  • Samostatnost a iniciativa: Jste osobnost, která dokáže převzít odpovědnost za celou oblast a aktivně ji rozvíjet. 

NABÍZÍME

  • Klíčová technická role: Možnost významně ovlivnit podobu observability a provozní spolehlivosti AI a cloudových platforem. 
  • Technologický dopad: Přímý vliv na fungování kritických systémů a moderních AI řešení. 
  • Prostor pro vlastní návrhy: Vysoká míra autonomie při hledání a implementaci technických řešení. 
  • Spolupráce s experty: Úzká spolupráce s cloudovými, platformními a vývojovými týmy. 

NABÍRÁME MUŽE I ŽENY

V tomto inzerátu jsou psány osoby v mužském rodě tedy v tzv. generickém maskulinu. Tento postup byl zvolen výhradně proto, aby bylo dosaženo co nejvyšší plynulosti textu. V žádném případě se nevyjadřuje genderově podmíněný nebo diskriminační přístup naší společnosti k uchazečům a uchazečkám o volná pracovní místa.

LOKALITA

  • Praha

Typ úvazku

  • Plný úvazek

Obor

  • Development & Engineering
  • Infrastructure
  • Data Science & Analytics

Váš konzultant

Josef Cabalka