Poda estática para índices invertidos baseada em logs
AUTOR(ES)
Charles Ornelas Almeida
DATA DE PUBLICAÇÃO
2005
RESUMO
O crescimento inexorável do volume de documentos na World Wide Web coloca um grande desafio para as máquinas de busca, não apenas com relação a eficácia as também com relação a eficiência de espaço e de tempo. Esta dissertação apresenta um novo método de compressão com perda (poda) para arquivos invertidos que considera o aspecto eficiência sem desconsiderar a eficácia. O método proposto é baseado na análise de logs de consultas passadas para obter uma grande redução no espaço ocupado pelo índice. O método pode ser utilizado em qualquer máquina de busca para melhorar sua eficiência em termos de tempo de processamento e espaço ocupado pelo índice, praticamente sem perdas na qualidade dos resultados da consulta. Experimentos utilizando uma máquina de busca real mostram que a técnica apresentada reduz os custos de armazenamento do índice em até 50% com relação ao índice sem compressão. Uma consequência dessa redução no tamanho do índice é que o tempo de processamento de uma consulta pode ser reduzido a aproximadamente 45% do tempo original, sem perda na precisão média. Considerando a qualidade do ranking produzido, o espaço ocupado pelo índice e o tempo de resposta a consultas, estudos comparativos com os dois melhores algoritmos de compressão de índices conhecidos na literatura mostram que o algoritmo proposto é bastante competitivo. Por exemplo, tanto a curva de similaridade entre os rankings quanto a precisão média das respostas do algoritmo proposto e o melhor algoritmo dentre os dois considerados na comparação se mantêm aproximadamente iguais para os diferentes níveis de poda. Quanto ao tempo de resposta o algoritmo proposto é mais rápido do que o melhor algoritmo dentre os dois considerados na comparação.
ASSUNTO(S)
recuperação da informação teses. computação teses. sistema de recuperação da informação teses. world wide web (sistema de recuperação da informação) teses.
ACESSO AO ARTIGO
http://hdl.handle.net/1843/RVMR-6EAG2LDocumentos Relacionados
- PeripatÃcnica: uma tÃcnica para avaliaÃÃo estÃtica em design
- CASAMENTOS INVERTIDOS: ACUSAÇÕES E PRECONCEITOS EM ARRANJOS CONJUGAIS DESVIANTES
- Determinação de índices biometeorológicos da videira 'Niagara Rosada' (Vitis labrusca L.) poda, em diferentes épocas
- Selection of soybean pre-cultivars based on indices.
- Caracterização morfométrica de fêmeas, garanhões e castrados da raça Campolina baseada em índices