🎁 Antes de se candidatar, treine esta entrevista. Crie sua conta grátis no WorkMundi e ganhe um Treinamento de Entrevista no HelpsYouSpeak — sem custo, sem cartão. Quero meu treinamento →
A Inmetrics busca um Cloud FinOps Engineer Sênior com perfil consultivo e alta capacidade técnica para atuar como elo estratégico entre os times de Engenharia, IA/Data Labs, SRE e Liderança Executiva/Finanças. O profissional será responsável por mapear ambientes, diagnosticar oportunidades de eficiência técnica e arquitetar a governança financeira da plataforma de IA Generativa da empresa na Google Cloud Platform (GCP). Além de dominar práticas clássicas de FinOps e resiliência cloud, este membro liderará a modelagem de chargeback por tokens, limites de consumo de LLMs e a otimização do custo de inferência em produção. Responsabilidades Operar e evoluir Gateways de LLM (ex: LiteLLM, Apigee ou proxies proprietários), gerenciando roteamento de modelos, rate limits, orçamentos por time e failover. Estruturar e manter modelos de Chargeback e Showback detalhados por consumo de Input/Output Tokens, divididos por aplicação, squad, projeto e caso de uso. Definir e monitorar métricas de Unit Economics de IA (calculando custo por requisição, custo por usuário ativo e custo por funcionalidade baseada em LLM). Atuar na otimização contínua de custos de inferência, aplicando trade-offs inteligentes entre preço, latência e qualidade do modelo (ex: otimização de prompts, estratégias de caching semântico, escolha entre Pay-As-You-Go vs. Provisioned Throughput). Implementar guardrails, alertas dinâmicos no GCP Billing e kill-switches automatizados para evitar picos orçamentários decorrentes de loops ou consumo descontrolado de tokens no Vertex AI. Apoiar o estabelecimento de observabilidade de LLMs integrando ferramentas de rastreio (tracing) de consumo e custo (ex: Langfuse, Traceloop ou similares). Realizar diagnósticos abrangentes de ambientes cloud (GCP/AWS), identificando desperdícios e oportunidades de otimização financeira e técnica. Implementar ações contínuas de rightsizing, gestão de compromissos (Committed Use Discounts / CUDs), políticas de ciclo de vida de dados e eliminação de recursos ociosos. Criar e manter dashboards operacionais e executivos no Looker Studio, traduzindo dados complexos de bilhetagem em recomendações acionáveis para engenharia e produto. Atuar diretamente com clientes internos e stakeholders técnicos, comunicando impactos financeiros com clareza e autoridade técnica. Atuar como referência técnica na avaliação da resiliência, disponibilidade e performance de aplicações em produção. Administrar e otimizar custos de clusters Kubernetes (GKE), ajustando Autoscalers (HPA/VPA), Node Pools e alocação de workloads. Garantir a automação de infraestrutura via Terraform (IaC) e manter/evoluir esteiras de CI/CD. Apoiar a engenharia na implementação de padrões de observabilidade de infraestrutura (Prometheus, Grafana, Cloud Logging, OpenTelemetry).