IA Offline para Triagem Semântica

Job ID: 39876575

Budget: $30 – $250 USD

Preciso implantar, no meu próprio servidor e totalmente desconectado da internet, um modelo de linguagem que trabalhe em português brasileiro e realize diariamente a seguinte rotina: receber cerca de 10 novos textos (1 000 – 1 500 caracteres cada), compará-los com uma base já existente de 5 000 – 8 000 textos de tamanho semelhante e, para cada entrada, retornar um score de similaridade junto com os cinco registros mais próximos encontrados na base. O objetivo é detectar descrições semanticamente equivalentes e bloquear qualquer texto que não seja realmente único.

Ferramenta: estou aberto a Ollama, spaCy ou qualquer solução equivalente, desde que rode offline e ofereça suporte completo ao idioma português brasileiro.

Metodologia de treinamento: podemos escolher entre ajuste de modelos pré-treinados, aprendizado supervisionado ou não supervisionado; quero decidir isso com você ponderando custo, tempo e qualidade. Quero que me passe estes parametros eventualmente sem e com pre-processamentos variados.

Critério principal: precisão da similaridade. A velocidade deve ser suficiente para concluir o lote diário sem gargalos, mas nunca às custas da exatidão.

Entrego acesso SSH ao servidor (Linux x86-64 com GPU disponível) e a base de textos anonimizada. Espero receber:
• modelo treinado e otimizado para inferência offline;
• script ou microserviço que automatize a comparação diária e gere um relatório JSON/CSV com o score e os top 5 textos similares;
• instruções de instalação e uso, tudo documentado em português claro;
• benchmark mostrando recall/precision em um pequeno conjunto de validação fornecido por mim.

Se você domina embeddings semânticos, fine-tuning em português e tem experiência em implantações on-premise, vamos conversar para alinhar detalhes e iniciar o projeto.