← WorkMundi · 1 milhão+ de vagas do mundo, ao vivoEntrarCriar conta grátis

Cloud FinOps Sênior

Inmetrics · Remoto

🌐 Remoto📅 07/08/2026
🔔 Avise-me sobre vagas como esta
Sem senha, sem cadastro. É só o e-mail — e você sai da lista quando quiser.
🔓 Candidatar-se — grátis →
Abre esta vaga no WorkMundi. A conta é grátis e leva menos de um minuto.

Ver e candidatar-se na WorkMundi →

🎁 Antes de se candidatar, treine esta entrevista. Crie sua conta grátis no WorkMundi e ganhe um Treinamento de Entrevista no HelpsYouSpeak — sem custo, sem cartão. Quero meu treinamento →
A Inmetrics busca um Cloud FinOps Engineer Sênior com perfil consultivo e alta capacidade técnica para atuar como elo estratégico entre os times de Engenharia, IA/Data Labs, SRE e Liderança Executiva/Finanças. O profissional será responsável por mapear ambientes, diagnosticar oportunidades de eficiência técnica e arquitetar a governança financeira da plataforma de IA Generativa da empresa na Google Cloud Platform (GCP). Além de dominar práticas clássicas de FinOps e resiliência cloud, este membro liderará a modelagem de chargeback por tokens, limites de consumo de LLMs e a otimização do custo de inferência em produção. Responsabilidades Operar e evoluir Gateways de LLM (ex: LiteLLM, Apigee ou proxies proprietários), gerenciando roteamento de modelos, rate limits, orçamentos por time e failover. Estruturar e manter modelos de Chargeback e Showback detalhados por consumo de Input/Output Tokens, divididos por aplicação, squad, projeto e caso de uso. Definir e monitorar métricas de Unit Economics de IA (calculando custo por requisição, custo por usuário ativo e custo por funcionalidade baseada em LLM). Atuar na otimização contínua de custos de inferência, aplicando trade-offs inteligentes entre preço, latência e qualidade do modelo (ex: otimização de prompts, estratégias de caching semântico, escolha entre Pay-As-You-Go vs. Provisioned Throughput). Implementar guardrails, alertas dinâmicos no GCP Billing e kill-switches automatizados para evitar picos orçamentários decorrentes de loops ou consumo descontrolado de tokens no Vertex AI. Apoiar o estabelecimento de observabilidade de LLMs integrando ferramentas de rastreio (tracing) de consumo e custo (ex: Langfuse, Traceloop ou similares). Realizar diagnósticos abrangentes de ambientes cloud (GCP/AWS), identificando desperdícios e oportunidades de otimização financeira e técnica. Implementar ações contínuas de rightsizing, gestão de compromissos (Committed Use Discounts / CUDs), políticas de ciclo de vida de dados e eliminação de recursos ociosos. Criar e manter dashboards operacionais e executivos no Looker Studio, traduzindo dados complexos de bilhetagem em recomendações acionáveis para engenharia e produto. Atuar diretamente com clientes internos e stakeholders técnicos, comunicando impactos financeiros com clareza e autoridade técnica. Atuar como referência técnica na avaliação da resiliência, disponibilidade e performance de aplicações em produção. Administrar e otimizar custos de clusters Kubernetes (GKE), ajustando Autoscalers (HPA/VPA), Node Pools e alocação de workloads. Garantir a automação de infraestrutura via Terraform (IaC) e manter/evoluir esteiras de CI/CD. Apoiar a engenharia na implementação de padrões de observabilidade de infraestrutura (Prometheus, Grafana, Cloud Logging, OpenTelemetry).
Ler o resto da vaga →

Vagas parecidas

Vaga no WorkMundi — o maior portal de vagas do mundo. Veja mais vagas de todos os continentes, atualizadas ao vivo.

📢
🎁

Antes de se candidatar, treine esta entrevista.

Crie sua conta grátis no WorkMundi e ganhe um Treinamento de Entrevista no HelpsYouSpeak — sem custo, sem cartão.

Quero meu treinamento →