Skills
Sobre a Vaga
Na Speechify, você ajudará a construir a base de dados que sustenta o treinamento de modelos de IA. Somos uma equipe focada em aquisição e ingestão de áudio, criando datasets em escala massiva com foco em qualidade, custo e eficiência.
Responsabilidades
- Buscar novas fontes de dados de áudio e integrá-las ao pipeline de ingestão
- Operar e evoluir a infraestrutura em nuvem do pipeline, atualmente em GCP com Terraform
- Trabalhar em conjunto com cientistas para otimizar o equilíbrio entre custo, throughput e qualidade
- Contribuir com o time de IA e com a liderança para definir o roadmap de datasets
Requisitos
- Graduação completa (BS/MS/PhD) em Ciência da Computação ou área relacionada
- Experiência profissional de 5+ anos com desenvolvimento de software
- Proficiência com scripts em Bash/Python em ambientes Linux
- Experiência com Docker e conceitos de Infrastructure-as-Code
- Vivência prática com pelo menos um provedor de cloud (atuamos com GCP)
- Desejável: experiência com web crawlers e workflows de processamento de dados em grande escala
- Boa comunicação e capacidade de priorizar e lidar com múltiplas demandas
Beneficios
- Ambiente de crescimento rápido, com espaço para influenciar produto e estratégia
- Cultura assíncrona e gestão com autonomia (hands-off)
- Remuneração competitiva e equipe colaborativa
- Impacto direto em um produto usado por milhões e voltado a pessoas com diferenças de aprendizagem