Similarity Open Source Projects
Browse 272 Similarity open source projects, ranked by GitHub stars. Find the most popular Similarity tools and libraries.
milvus-io/milvus
Milvus is a high-performance, cloud-native vector database built for scalable vector ANN search
Metrics details
| Stars | 45,274 |
facebookresearch/faiss
A library for efficient similarity search and clustering of dense vectors.
Metrics details
| Stars | 40,547 |
qdrant/qdrant
Qdrant - High-performance, massive-scale Vector Database and Vector Search Engine for the next generation of AI. Also available in the cloud https://cloud.qdrant.io/
Metrics details
| Stars | 33,410 |
apple/turicreate
Turi Create simplifies the development of custom machine learning models.
Metrics details
| Stars | 11,163 |
microsoft/computervision-recipes
Best Practices, code samples, and documentation for Computer Vision.
Metrics details
| Stars | 9,866 |
shibing624/text2vec
text2vec, text to vector. 文本向量表征工具,把文本转化为向量矩阵,实现了Word2Vec、RankBM25、Sentence-BERT、CoSENT等文本表征、文本相似度计算模型,开箱即用。
Metrics details
| Stars | 4,974 |
richzhang/PerceptualSimilarity
LPIPS metric. pip install lpips
Metrics details
| Stars | 4,254 |
MaartenGr/KeyBERT
Minimal keyword extraction with BERT
Metrics details
| Stars | 4,203 |
resemble-ai/Resemblyzer
A python package to analyze and compare voices with deep learning
Metrics details
| Stars | 3,286 |
jm199504/Financial-Knowledge-Graphs
小型金融知识图谱构建流程(neo4j / python / cypher / KG)
Metrics details
| Stars | 3,110 |
tdebatty/java-string-similarity
Implementation of various string similarity and distance algorithms: Levenshtein, Jaro-winkler, n-Gram, Q-Gram, Jaccard index, Longest Common Subsequence edit distance, cosine similarity ...
Metrics details
| Stars | 2,744 |
aceakash/string-similarity
Finds degree of similarity between two strings, based on Dice's Coefficient, which is mostly better than Levenshtein distance.
Metrics details
| Stars | 2,532 |
facebookresearch/SentEval
A python tool for evaluating the quality of sentence embeddings.
Metrics details
| Stars | 2,110 |
Po-Hsun-Su/pytorch-ssim
pytorch structural similarity (SSIM) loss
Metrics details
| Stars | 1,948 |
msgi/nlp-journey
Documents, papers and codes related to Natural Language Processing, including Topic Model, Word Embedding, Named Entity Recognition, Text Classificatin, Text Generation, Text Similarity, Machine Translation),etc.
Metrics details
| Stars | 1,629 |
shibing624/similarity
similarity: Text similarity calculation Toolkit for Java. 文本相似度计算工具包,java编写,可用于文本相似度计算、情感分析等任务,开箱即用。
Metrics details
| Stars | 1,582 |
photosynthesis-team/piq
Measures and metrics for image2image tasks. PyTorch.
Metrics details
| Stars | 1,571 |
Jack000/fontjoy
font vectors used for fontjoy.com
Metrics details
| Stars | 1,427 |
anvaka/sayit
Visualization of related subreddits
Metrics details
| Stars | 1,425 |
dhwajraj/deep-siamese-text-similarity
Tensorflow based implementation of deep siamese LSTM network to capture phrase/sentence similarity using character/word embeddings
Metrics details
| Stars | 1,414 |
kornelski/dssim
Image similarity comparison simulating human perception (multiscale SSIM in Rust)
Metrics details
| Stars | 1,189 |
J535D165/recordlinkage
A powerful and modular toolkit for record linkage and duplicate detection in Python
Metrics details
| Stars | 1,055 |
luozhouyang/python-string-similarity
A library implementing different string similarity and distance measures using Python.
Metrics details
| Stars | 1,018 |
nlptown/nlp-notebooks
A collection of notebooks for Natural Language Processing from NLP Town
Metrics details
| Stars | 1,015 |
harveyslash/Facial-Similarity-with-Siamese-Networks-in-Pytorch
Implementing Siamese networks with a contrastive loss for similarity learning
Metrics details
| Stars | 990 |
google/visqol
Perceptual Quality Estimator for speech and audio
Metrics details
| Stars | 911 |
shibing624/similarities
Similarities: a toolkit for similarity calculation and semantic search. 相似度计算、匹配搜索工具包,支持亿级数据文搜文、文搜图、图搜图,python3开发,开箱即用。
Metrics details
| Stars | 902 |
trendmicro/tlsh
Metrics details
| Stars | 836 |
benedekrozemberczki/SimGNN
A PyTorch implementation of "SimGNN: A Neural Network Approach to Fast Graph Similarity Computation" (WSDM 2019).
Metrics details
| Stars | 814 |
MaartenGr/PolyFuzz
Fuzzy string matching, grouping, and evaluation.
Metrics details
| Stars | 800 |
jpmckinney/tf-idf-similarity
Ruby gem to calculate the similarity between texts using tf*idf
Metrics details
| Stars | 783 |
angeloskath/php-nlp-tools
Natural Language Processing Tools in PHP
Metrics details
| Stars | 765 |
paucarre/tiefvision
End-to-end deep learning image-similarity search engine
Metrics details
| Stars | 759 |
yaleimeng/Final_word_Similarity
综合了同义词词林扩展版与知网(Hownet)的词语相似度计算方法,词汇覆盖更多、结果更准确。
Metrics details
| Stars | 744 |
aizvorski/video-quality
Video quality metrics, reference implementation in python: VIF, SSIM, PSNR, ...
Metrics details
| Stars | 732 |
brmson/dataset-sts
Semantic Text Similarity Dataset Hub
Metrics details
| Stars | 730 |
oreillymedia/t-SNE-tutorial
A tutorial on the t-SNE learning algorithm
Metrics details
| Stars | 721 |
seamusabshere/fuzzy_match
Find a needle (a document or record) in a haystack using string similarity and (optionally) regular expression rules. Uses Dice's Coefficient (aka Pair Similiarity) and Levenshtein Distance internally.
Metrics details
| Stars | 685 |
nforest/awesome-decompilation
A curated list of awesome decompilation resources and projects.
Metrics details
| Stars | 661 |
yongzhuo/Macropodus
自然语言处理工具Macropodus,基于Albert+BiLSTM+CRF深度学习网络架构,中文分词,词性标注,命名实体识别,新词发现,关键词,文本摘要,文本相似度,科学计算器,中文数字阿拉伯数字(罗马数字)转换,中文繁简转换,拼音转换。tookit(tool) of NLP,CWS(chinese word segnment),POS(Part-Of-Speech Tagging),NER(name entity recognition),Find(new words discovery),Keyword(keyword extraction),Summarize(text summarization),Sim(text similarity),Calculate(scientific calculator),Chi2num(chinese number to arabic number)
Metrics details
| Stars | 660 |
up42/image-similarity-measures
:chart_with_upwards_trend: Implementation of eight evaluation metrics to access the similarity between two images. The eight metrics are as follows: RMSE, PSNR, SSIM, ISSM, FSIM, SRE, SAM, and UIQ.
Metrics details
| Stars | 645 |
google/svcca
Metrics details
| Stars | 644 |
aetilius/pHash
pHash - the open source perceptual hash library
Metrics details
| Stars | 642 |
liufengyun/hashdiff
Hashdiff is a ruby library to to compute the smallest difference between two hashes
Metrics details
| Stars | 630 |
andrewekhalel/sewar
All image quality metrics you need in one package.
Metrics details
| Stars | 613 |
SystemSecurityStorm/Awesome-Binary-Similarity
An awesome & curated list of binary code similarity papers
Metrics details
| Stars | 611 |
kishan0725/AJAX-Movie-Recommendation-System-with-Sentiment-Analysis
A content-based recommender system that recommends movies similar to the movie the user likes and analyses the sentiments of the reviews given by the user
Metrics details
| Stars | 608 |
hbollon/go-edlib
📚 String comparison and edit distance algorithms library, featuring : Levenshtein, LCS, Hamming, Damerau levenshtein (OSA and Adjacent transpositions algorithms), Jaro-Winkler, Cosine, etc...
Metrics details
| Stars | 605 |
ekzhu/SetSimilaritySearch
All-pair set similarity search on millions of sets in Python and on a laptop
Metrics details
| Stars | 603 |
colinmorris/SongSim
React web app for drawing self-similarity matrices from text
Metrics details
| Stars | 553 |
elisemercury/Duplicate-Image-Finder
difPy - Python package for finding duplicate and similar images
Metrics details
| Stars | 549 |
groveco/content-engine
A very simple content-based recommendation engine. Great for learning, but also ready for real-world use.
Metrics details
| Stars | 536 |
airalcorn2/Deep-Semantic-Similarity-Model
My Keras implementation of the Deep Semantic Similarity Model (DSSM)/Convolutional Latent Semantic Model (CLSM) described here: http://research.microsoft.com/pubs/226585/cikm2014_cdssm_final.pdf.
Metrics details
| Stars | 521 |
Brokenwind/BertSimilarity
Computing similarity of two sentences with google's BERT algorithm。利用Bert计算句子相似度。语义相似度计算。文本相似度计算。
Metrics details
| Stars | 510 |
feature23/StringSimilarity.NET
A .NET port of java-string-similarity
Metrics details
| Stars | 509 |
msracver/Deep-Exemplar-based-Colorization
The source code of "Deep Exemplar-based Colorization".
Metrics details
| Stars | 506 |
rockymadden/stringmetric
:dart: String metrics and phonetic algorithms for Scala (e.g. Dice/Sorensen, Hamming, Jaccard, Jaro, Jaro-Winkler, Levenshtein, Metaphone, N-Gram, NYSIIS, Overlap, Ratcliff/Obershelp, Refined NYSIIS, Refined Soundex, Soundex, Weighted Levenshtein).
Metrics details
| Stars | 492 |
dingkeyan93/DISTS
IQA: Deep Image Structure and Texture Similarity Metric
Metrics details
| Stars | 486 |
CogComp/cogcomp-nlp
CogComp's Natural Language Processing Libraries and Demos: Modules include lemmatizer, ner, pos, prep-srl, quantifier, question type, relation-extraction, similarity, temporal normalizer, tokenizer, transliteration, verb-sense, and more.
Metrics details
| Stars | 479 |
IAdmireu/ChineseSTS
中文文本语义相似度(Chinese Semantic Text Similarity)语料库建设
Metrics details
| Stars | 478 |
