# define df column names column_names = ["embedding_" + str(i) for i in range(len(text_embedding_list[0]))] # store text embeddings in dataframe df_train = pd.DataFrame(text_embedding_list, columns=column_names) # create target variable df_train['is_data_scientist'] = df_resume['role']=="Data Scientist"