Projeto 22
Detalhes da vaga
- Cargo
- Engenheiro de Software IA Sênior
- Contrato
- CLT
- Vagas
- 1
- Modelo
- Híbrido
- Publicada
- 02/09/2026
Localização
Descrição da vaga
Responsabilidades e atribuições:
Engenharia de Plataforma e Serviços – Integração de LLM: Projetar, desenvolver e operar o microsserviço de IA em Python/FastAPI que viabiliza respostas automáticas, redação de comunicações assistida por IA e comportamento de IA configurável pela concessionária. Gerenciar o desempenho do serviço de ponta a ponta: tratamento de requisições assíncronas, concorrência, cache, pool de conexões e limitação de taxa (rate limiting) sob carga de produção. Projetar e manter pipelines de dados e contexto que agregam informações de leads, conversas e da concessionária para cada requisição de IA. Desenvolver e manter APIs internas e servidores MCP (Model Context Protocol) que disponibilizam as capacidades da plataforma para clientes de IA e outras equipes de engenharia. Integrar e otimizar provedores de LLM (OpenAI, Anthropic ou equivalentes) em produção, incluindo montagem de prompts, tentativas de reexecução (retries), timeouts e degradação graciosa. Implementar estratégias de recuperação de informações e contexto, como RAG, embeddings e busca vetorial, onde tragam melhorias mensuráveis à qualidade das respostas. Monitorar e controlar o uso de tokens, a seleção de modelos e o cache para manter o custo unitário previsível à medida que o volume aumenta. Criar estruturas de avaliação e testes de regressão para garantir que alterações em prompts e modelos sejam implementadas com base em evidências Confiabilidade e Operações: Monitorar serviços de IA em produção utilizando New Relic, acompanhando latência, taxa de erro, vazão (throughput) e custo por requisição. Diagnosticar e resolver problemas em produção, desde timeouts de provedores e acúmulo de filas (backpressure) até contenção de banco de dados. Contribuir para fluxos de trabalho de CI/CD utilizando Bitbucket Pipelines e AWS CodeBuild. Dar suporte a uma arquitetura baseada em microsserviços conteinerizados implantada na AWS (ECS, ECR, CodeDeploy). Colaboração e Mentoria: Colaborar com o Líder Técnico de IA para transformar projetos técnicos em marcos entregues. Trabalhar com gerentes de produto para traduzir oportunidades de IA em funcionalidades bem definidas e mensuráveis. Colaborar com as equipes de CRM e Plataforma para garantir que as funcionalidades de IA se integrem perfeitamente às APIs, modelos de dados e fluxos de trabalho das concessionárias existentes. Participar de revisões de código, discussões técnicas e planejamento de sprints, além de oferecer mentoria a engenheiros de nível pleno.
Requisitos e qualificações:
Graduação - Concluído - Obrigatório; Inglês avançado para conversação. Experiência robusta em engenharia de software backend. Sólida proficiência em Python, incluindo programação assíncrona e desenvolvimento de serviços em produção. Experiência prática na criação e operação de serviços utilizando FastAPI ou frameworks equivalentes, como Flask ou Django. Experiência na integração de APIs de LLM em aplicações de produção, incluindo construção de prompts, tratamento de erros e gerenciamento de latência. Sólida experiência com MySQL ou bancos de dados relacionais equivalentes, incluindo otimização de consultas e modelagem de esquemas (schema design). Experiência no projeto e operação de microsserviços, incluindo design de APIs, conteinerização e implantação na nuvem. Familiaridade com serviços de nuvem da AWS (ECS, S3, CloudWatch ou similares). Experiência com Docker e implantação de aplicações conteinerizadas. Experiência com camadas de cache como Memcached ou Redis, e compreensão de seus modos de falha. Experiência com fluxos de trabalho baseados em Git e testes automatizados (pytest ou similares). Fortes habilidades de resolução de problemas, com foco em qualidade de código, observabilidade e confiabilidade do sistema. Capacidade de trabalhar em fusos horários distintos, em um ambiente que prioriza a comunicação assíncrona. Desejáveis: Experiência no uso de ferramentas de desenvolvimento impulsionadas por IA, como Claude Code, Cursor ou similares, no dia a dia da engenharia. Experiência com bancos de dados vetoriais, busca por embeddings ou RAG (Retrieval-Augmented Generation) em escala de produção. Experiência na criação ou consumo de servidores MCP (Model Context Protocol). Familiaridade com práticas de MLOps, como versionamento de prompts, avaliação de modelos, detecção de drift e testes A/B de comportamento de IA. Experiência com otimização de custos para cargas de trabalho de IA: contabilização de tokens, roteamento de modelos e estratégias de caching. Experiência com PHP (CakePHP) ou Node.js como linguagens de backend secundárias, visto que a plataforma utiliza ambas. Familiaridade com ferramentas de monitoramento e observabilidade (New Relic, Datadog ou similares). Experiência de trabalho em plataformas SaaS multi-tenant em grande escala. Experiência com CRM, automação de vendas ou plataformas de comunicação com o cliente. Compreensão de práticas de IA responsável, incluindo privacidade de dados e transparência em decisões orientadas por IA.
Benefícios:
VA e VR (Swile): R$1.600,00/mês; Assistência médica; Assistência odontológica; Seguro de vida.
Fonte: selecty