City Restaurant Data Scraper
Budget: $30 – $250 USD
I want a robust crawler that automatically gathers a complete, up-to-date catalogue of every restaurant in the city—no exceptions. For cada estabelecimento, preciso receber três itens obrigatórios: fotos em boa resolução que representem o local, o cardápio completo (com preços quando disponíveis) e o endereço físico correto. O projeto cobre toda a cidade, do centro às áreas periféricas, portanto espero que o código percorra todos os sites, marketplaces de delivery, redes sociais públicas ou quaisquer outras fontes online relevantes que contenham essas informações.
Aceito qualquer stack sólida, mas Python com BeautifulSoup, Scrapy ou Selenium costuma funcionar bem aqui; basta que o resultado final seja confiável, reproduzível e documentado. Entrego a você a liberdade de lidar com desafios de paginação, lazy-loading de imagens, ou eventuais CAPTCHAs, desde que o script finalize sem intervenção manual.
Entrego como critério de aceite:
• Um arquivo CSV ou banco SQLite contendo, para cada restaurante, nome, URL de origem, endereço, link(s) ou path das fotos baixadas e o cardápio em texto estruturado.
• Código fonte organizado, comentado e pronto para reexecução.
• Pequeno README explicando dependências e modo de uso.
Se precisar validar algum ponto sobre políticas de uso de dados de plataformas, avise antes de rodar em produção. Estou disponível para esclarecer dúvidas rápidas durante o desenvolvimento.
Aceito qualquer stack sólida, mas Python com BeautifulSoup, Scrapy ou Selenium costuma funcionar bem aqui; basta que o resultado final seja confiável, reproduzível e documentado. Entrego a você a liberdade de lidar com desafios de paginação, lazy-loading de imagens, ou eventuais CAPTCHAs, desde que o script finalize sem intervenção manual.
Entrego como critério de aceite:
• Um arquivo CSV ou banco SQLite contendo, para cada restaurante, nome, URL de origem, endereço, link(s) ou path das fotos baixadas e o cardápio em texto estruturado.
• Código fonte organizado, comentado e pronto para reexecução.
• Pequeno README explicando dependências e modo de uso.
Se precisar validar algum ponto sobre políticas de uso de dados de plataformas, avise antes de rodar em produção. Estou disponível para esclarecer dúvidas rápidas durante o desenvolvimento.
Related categories:
JavaScript
Python
Web Scraping
Software Architecture
Scrapy
Data Extraction
BeautifulSoup
Selenium