About this role
Job title: Cientista de Dados Sênior com foco em IA
A Senior Data Scientist com foco em IA ajudará a construir e operacionalizar soluções escaláveis de IA, possibilitando modelos generativos para geração de código, personalização de conteúdo e engajamento do usuário nos produtos digitais da Globo. Este papel faz parte da área de Dados & IA que apoia plataformas de dados, experimentação, ML, recomendação e segmentação de audiência para os produtos da Globo.
O que você fará:
- Criar e treinar modelos de IA generativa para apoiar o time de desenvolvedores na geração de código, documentação e otimização de processos
- Explorar e implementar LLMs (Large Language Models) customizados para as necessidades da equipe
- Desenvolver pipelines eficientes para treinamento, fine-tuning e deployment de modelos de IA
- Construir, produtizar e monitorar modelos de Machine Learning para personalização de conteúdo e engajamento dos usuários
- Explorar novas arquiteturas e técnicas avançadas de aprendizado de máquina aplicadas à geração e otimização de código
- Trabalhar em um time multidisciplinar, colaborando com engenheiros de machine learning, engenheiros de dados, desenvolvedores e POs para criar soluções orientadas a dados
O que estamos buscando:
- Experiência comprovada como Cientista de Dados
- Proficiência em Python e SQL para análise e modelagem de dados
- Conhecimento de frameworks de Machine Learning (TensorFlow, Keras, Scikit Learn, PyTorch)
- Experiência em computação em nuvem (preferencialmente GCP)
- Conhecimento sobre melhores práticas de desenvolvimento de software e arquitetura de dados
- Experiência com manipulação de grandes volumes de dados
- Familiaridade com CI/CD e versionamento de código (Git)
- Boa capacidade de comunicação e colaboração em equipe
- Ensino superior completo em Ciência de Dados, Estatística, Matemática, Ciência da Computação ou áreas correlatas
Conhecimentos que te destacam:
- Experiência com arquiteturas de Deep Learning (Transformers, CNNs, RNNs, AutoEncoders, LLMs)
- Conhecimento sobre pipelines envolvendo RAG (Retrieval-Augmented Generation)
- Experiência com bancos de dados vetoriais
- Experiência com APIs focadas em predição online
- Familiaridade com ferramentas e práticas de MLOps (Docker, Kubernetes, Vertex Pipelines, Model Monitoring, Continuous Training)
- Inglês intermediário ou avançado
Nice to Have:
- Experiência com estratégias de personalização e engajamento de usuários em plataformas digitais
- Experiência prática com deployment de modelos em produção e monitoramento
Compensation & Benefits:
- Processos seletivos 100% remotos
- Vacinação contra Covid-19 é requisito para contratação, conforme política da empresa
- Modelo de trabalho híbrido com base no Rio de Janeiro (RJ)
- Ambiente diverso e inclusivo, com foco em inovação e transformação digital