Live opening · Posted 9 hours ago

Senior Principal Observability Engineer

Dell Technologies · ELDORADO DO SUL, RS, Brazil | SAO PAULO, SP, Brazil
Oracle No
JobBeeper subscribers received an alert for this role.

At a glance

The key details from the original listing.

Posted 9 hours ago
CompanyDell Technologies
LocationELDORADO DO SUL, RS, Brazil | SAO PAULO, SP, Brazil
Work modeNo
SkillsTerraform
SourceOracle
ListedPosted 9 hours ago

Your early-applicant advantage

Live timing from JobBeeper.

Live data
2 min from Oracle publishing this role to us finding it
11 min median time from a role going live to a subscriber being told
6 hours subscribers had this role before this page existed
61,587 roles found in the last 24 hours — the newest are not on this site yet
Start your free trial →

About the role

Description supplied by the original job listing.

Senior Principal Observability Engineer
Faça parte de uma equipe que garante a integridade dos produtos e a satisfação dos clientes da Dell Technologies. Nossa equipe de Engenharia de Software de TI transforma requisitos de negócios em soluções tecnológicas por meio do design, desenvolvimento, testes e depuração de aplicações, além da documentação de procedimentos de uso e da busca contínua por melhorias de qualidade.
Junte-se a nós como Senior Principal Observability Engineer na equipe de Engenharia de Software em Eldorado do Sul/RS para realizar o melhor trabalho da sua carreira e gerar um impacto social significativo.
O que você irá conquistar
Como Senior Principal Observability Engineer, você será responsável por implementar, implantar e otimizar soluções corporativas de observabilidade que proporcionem visibilidade de ponta a ponta em sistemas distribuídos, aplicações e infraestrutura. Você trabalhará em parceria com equipes de engenharia, plataformas, operações e cloud para entregar plataformas escaláveis de observabilidade, estabelecer padrões de telemetria e garantir monitoramento confiável e excelência operacional em toda a organização.
Você irá:
Implantar, configurar, manter e otimizar plataformas de observabilidade que abrangem métricas, logs, rastreamento distribuído e eventos em ambientes produtivos, incluindo troubleshooting de problemas de desempenho e otimização do uso de recursos da plataforma.
Implementar padrões de observabilidade e soluções de telemetria em toda a organização, incluindo instrumentação OpenTelemetry, configuração de collectors, integração de SDKs, convenções semânticas e desenvolvimento de pipelines de dados de telemetria para coleta e roteamento confiáveis.
Monitorar a ingestão e o armazenamento de dados de telemetria, implementar estratégias de amostragem e retenção para equilibrar visibilidade e custos operacionais, além de automatizar instrumentação, configuração e implantação de agentes por meio de práticas de Infrastructure as Code (IaC) e pipelines de CI/CD.
Investigar e resolver problemas complexos em produção relacionados a plataformas de observabilidade e pipelines de telemetria, além de integrar soluções de observabilidade com sistemas corporativos, provedores de identidade e fluxos de monitoramento existentes.
Implementar capacidades de observabilidade para aplicações baseadas em Large Language Models (LLMs), incluindo monitoramento de desempenho de modelos, métricas de avaliação de prompts, acompanhamento do consumo de tokens, medição de latência de inferência e execução de padrões e melhores práticas de observabilidade em toda a organização.
Dê o primeiro passo rumo à carreira dos seus sonhos
Cada membro da Dell Technologies traz algo único para a equipe. Veja o que procuramos para esta função:
Requisitos Essenciais
Inglês avançado/fluente
Experiência avançada em Site Reliability Engineering (SRE), DevOps, Infraestrutura em Nuvem ou Engenharia de Software, com forte foco em implementação de observabilidade e telemetria.
Experiência prática na implantação, operação e suporte de plataformas modernas de observabilidade, como Dynatrace, Splunk, Grafana, Datadog e Elastic/ELK, bem como tecnologias de pipelines de telemetria, incluindo Fluent Bit, Vector e Cribl.
Proficiência em ferramentas de Infrastructure as Code (IaC), como Terraform, Ansible ou Helm, incluindo provisionamento automatizado e gerenciamento de configuração.
Experiência aprofundada na implementação de instrumentação OpenTelemetry, collectors e convenções semânticas em ambientes produtivos.
Forte capacidade analítica e de troubleshooting para diagnosticar sistemas distribuídos complexos e pipelines de telemetria.
Requisitos Desejáveis
Conhecimento de estratégias de observabilidade nativas para IA em ambientes produtivos, incluindo plataformas como Langfuse, LangSmith e Arize.
Graduação completa

Work arrangement
No

Get JobBeeper Mobile App

Never miss a job opening! Get instant job alerts on your phone.

Subscribers see fresh openings within minutes. Download the JobBeeper App on Google Play to get real-time push notifications and apply before anyone else.

⚡ Instant Push Alerts 🎯 Tailored Filters 🚀 Direct Employer Links
GET IT ON Google Play

More openings worth a look

Recently tracked roles with full details and direct application links.

6 roles
Good roles move before most people even see them. Tell JobBeeper what you want and get fresh matches delivered in minutes.
Start your free trial →
⚡ Get fresh job alerts 📱 Get App