from sklearn.feature_extraction.text import CountVectorizer data = ['I love dogs', 'I hate cats', 'Dogs are cute'] vectorizer = CountVectorizer(ngram_range=(1, 2)) ngram_features = vectorizer.fit_transform(data) __ __