Contrato: CLT (Efetivo) Vagas: 1 Carga horária: 8h/dia
Local
São Paulo - SP
Presencial
Responsabilidades
- Projetar, desenvolver e operar o microsserviço de IA em Python/FastAPI que viabiliza respostas automáticas, redação de comunicações assistida por IA e comportamento de IA configurável pela concessionária.
- Gerenciar o desempenho do serviço de ponta a ponta: tratamento de requisições assíncronas, concorrência, cache, pool de conexões e limitação de taxa (rate limiting) sob carga de produção.
- Projetar e manter pipelines de dados e contexto que agregam informações de leads, conversas e da concessionária para cada requisição de IA.
- Desenvolver e manter APIs internas e servidores MCP (Model Context Protocol) que disponibilizam as capacidades da plataforma para clientes de IA e outras equipes de engenharia.
- Integrar e otimizar provedores de LLM (OpenAI, Anthropic ou equivalentes) em produção, incluindo montagem de prompts, tentativas de reexecução (retries), timeouts e degradação graciosa.
- Implementar estratégias de recuperação de informações e contexto, como RAG, embeddings e busca vetorial, onde tragam melhorias mensuráveis à qualidade das respostas.
- Monitorar e controlar o uso de tokens, a seleção de modelos e o cache para manter o custo unitário previsível à medida que o volume aumenta.
- Criar estruturas de avaliação e testes de regressão para garantir que alterações em prompts e modelos sejam implementadas com base em evidências
- Monitorar serviços de IA em produção utilizando New Relic, acompanhando latência, taxa de erro, vazão (throughput) e custo por requisição.
- Diagnosticar e resolver problemas em produção, desde timeouts de provedores e acúmulo de filas (backpressure) até contenção de banco de dados.
- Contribuir para fluxos de trabalho de CI/CD utilizando Bitbucket Pipelines e AWS CodeBuild.
- Dar suporte a uma arquitetura baseada em microsserviços conteinerizados implantada na AWS (ECS, ECR, CodeDeploy).
- Colaborar com o Líder Técnico de IA para transformar projetos técnicos em marcos entregues.
- Trabalhar com gerentes de produto para traduzir oportunidades de IA em funcionalidades bem definidas e mensuráveis.
- Colaborar com as equipes de CRM e Plataforma para garantir que as funcionalidades de IA se integrem perfeitamente às APIs, modelos de dados e fluxos de trabalho das concessionárias existentes.
- Participar de revisões de código, discussões técnicas e planejamento de sprints, além de oferecer mentoria a engenheiros de nível pleno.
Requisitos
- Graduação - Concluído - Obrigatório; Inglês avançado para conversação.
- Experiência robusta em engenharia de software backend.
- Sólida proficiência em Python, incluindo programação assíncrona e desenvolvimento de serviços em produção.
- Experiência na integração de APIs de LLM em aplicações de produção, incluindo construção de prompts, tratamento de erros e gerenciamento de latência.
- Sólida experiência com MySQL ou bancos de dados relacionais equivalentes, incluindo otimização de consultas e modelagem de esquemas (schema design).
- Experiência no projeto e operação de microsserviços, incluindo design de APIs, conteinerização e implantação na nuvem.
- Familiaridade com serviços de nuvem da AWS (ECS, S3, CloudWatch ou similares).
- Experiência com Docker e implantação de aplicações conteinerizadas.
- Experiência com camadas de cache como Memcached ou Redis, e compreensão de seus modos de falha.
- Experiência com fluxos de trabalho baseados em Git e testes automatizados (pytest ou similares).
- Fortes habilidades de resolução de problemas, com foco em qualidade de código, observabilidade e confiabilidade do sistema.
- Capacidade de trabalhar em fusos horários distintos, em um ambiente que prioriza a comunicação assíncrona.
Diferenciais
- Experiência no uso de ferramentas de desenvolvimento impulsionadas por IA, como Claude Code, Cursor ou similares, no dia a dia da engenharia.
- Experiência com bancos de dados vetoriais, busca por embeddings ou RAG (Retrieval-Augmented Generation) em escala de produção.
- Experiência na criação ou consumo de servidores MCP (Model Context Protocol).
- Familiaridade com práticas de MLOps, como versionamento de prompts, avaliação de modelos, detecção de drift e testes A/B de comportamento de IA.
- Experiência com otimização de custos para cargas de trabalho de IA: contabilação de tokens, roteamento de modelos e estratégias de caching.
- Experiência com PHP (CakePHP) ou Node.js como linguagens de backend secundárias, visto que a plataforma utiliza ambas.
- Familiaridade com ferramentas de monitoramento e observabilidade (New Relic, Datadog ou similares).
- Experiência de trabalho em plataformas SaaS multi-tenant em grande escala.
- Experiência com CRM, automação de vendas ou plataformas de comunicação com o cliente.
- Compreensão de práticas de IA responsável, incluindo privacidade de dados e transparência em decisões orientadas por IA.
Benefícios
- VA e VR (Swile): R$1.600,00/mês; Assistência médica; Assistência odontológica; Seguro de vida.
Carga horária
8h/dia
Tipo de contrato
CLT