The paper evaluates different vector space models for text similarity.
problem Measuring semantic text similarity in natural language processing.
method Comparison of TFIDF, topic models, and neural models for patent-to-patent similarity.
result TFIDF performs well for longer, technical texts or finer distinctions.