Analista de Inteligência Artificial PL
INSTITUTO HARDWARE BR - HBRCampinas - SP
1 posição
Não informado
Elegível para PCD
Integral
O Instituto Hardware BR - HBR é uma organização brasileira de tecnologia, dedicada a impulsionar a inovação nos segmentos de hardware, semicondutores, sistemas embarcados, robótica e inteligência artificial. O HBR atua com desenvolvimento tecnológico, conectando talentos, pesquisa aplicada e mercado. Nosso compromisso é oferecer um ambiente colaborativo, dinâmico e de alto impacto.
Buscamos um(a) Analista de Inteligência Artificial Pleno que atuará no desenvolvimento, implementação e manutenção de soluções de Inteligência Artificial. Será responsável por desenvolver e aprimorar modelos e aplicações de IA, realizar análises e testes, contribuir para a resolução de problemas e apoiar a evolução contínua das soluções.
Responsabilidades e Atribuições
· Pipelines RAG: projetar, desenvolver e evoluir pipelines ponta a ponta — ingestão, chunking, tokenização, embeddings, busca semântica/híbrida, reranking e geração de respostas.
· Dados para IA: construir processos de ETL/ELT para fontes estruturadas e não estruturadas (documentos, PDFs, bancos, APIs), com atualização incremental, validação de qualidade e anonimização/mascaramento de dados sensíveis.
· Embeddings e bancos vetoriais: gerenciar geração, armazenamento, atualização e versionamento de embeddings, integrando bancos vetoriais, relacionais e NoSQL.
· Avaliação: implementar avaliação contínua de LLMs e RAG — qualidade da recuperação, groundedness, alucinações, latência e custo — e medir o impacto de mudanças em prompts, modelos e contexto.
· Monitoramento e LLMOps: monitorar qualidade, latência, disponibilidade, custo e consumo de recursos em produção; detectar degradação e mudanças nos dados; automatizar deployment, versionamento e rollback via CI/CD.
· Rastreabilidade e governança: versionar prompts, modelos, datasets, embeddings e pipelines, garantindo data lineage, auditoria e observabilidade.
· Contexto e integração: projetar prompts versionados, system prompts, structured outputs e tool calling; disponibilizar serviços via APIs REST/gRPC e microsserviços em Docker e Kubernetes.
Requisitos e Qualificações
· Ensino superior completo em Ciência/Engenharia da Computação, Engenharia de Software, Ciência de Dados, Sistemas de Informação, Engenharia Elétrica ou áreas correlatas.
· Experiência prática na construção e manutenção de aplicações baseadas em LLMs e arquiteturas RAG em ambiente produtivo.
· Python e SQL; frameworks como Hugging Face Transformers, PyTorch ou equivalentes; NLP e embeddings.
· Bancos vetoriais, busca semântica, bancos SQL/NoSQL e ETL/ELT (Apache Spark ou equivalentes é um plus).
· MLOps/LLMOps, Git, CI/CD, Docker, Kubernetes e ao menos uma nuvem (AWS, GCP ou Azure).
· Governança de dados, data lineage, anonimização, autenticação/autorização e LGPD.
· Inglês intermediário (leitura de documentação técnica e artigos científicos).
Diferenciais
Avaliação automatizada de LLMs e observabilidade de IA; agentes de IA; fine-tuning (LoRA, QLoRA, PEFT) e quantização; modelos open-source/on-premises e inferência em GPU; Mestrado ou Doutorado (cursando ou concluído).
Modelo de Trabalho
Regime: CLT (Consolidação das Leis do Trabalho).
Modalidade: Vaga 100% remoto.
Requisitos
Escolaridade
- Graduação
Benefícios
- Assistência médica
- Assistência odontológica
- Horário flexível
- Seguro de vida
- Vale alimentação
- Vale combustível
- Day Off de aniversário
- Benefício Maternidade e Paternidade
- Benefício Matrimonial
- Wellhub (Gympass)
- Conexa Saúde - Caju Mais