Skip to content

Commit ad6d5f5

Browse files
committed
chore: apply security quarantine patch
1 parent 167de7e commit ad6d5f5

5 files changed

Lines changed: 27 additions & 20 deletions

File tree

lib/pages/page.py

Lines changed: 17 additions & 10 deletions
Original file line numberDiff line numberDiff line change
@@ -74,6 +74,7 @@ def write():
7474
column_name = column_select.selectbox(
7575
"columns", options=["-"] + dataset.columns.tolist()
7676
)
77+
7778
sample_data = column_select.checkbox("Sample a smaller dataset")
7879
remove_stopwords = column_select.checkbox("Remove stopwords")
7980
column_select.info(
@@ -145,16 +146,6 @@ def write():
145146
else:
146147
xi_value = 0.01
147148

148-
##############################
149-
# VARIOUS BUTTONS #
150-
##############################
151-
152-
space = streamlit.sidebar.text("")
153-
compute = streamlit.sidebar.button("Compute embeddings")
154-
show_labeled = streamlit.sidebar.checkbox("Show labeled data")
155-
clear_cache_button = streamlit.sidebar.button("Clear cache")
156-
clear_labels_button = streamlit.sidebar.button("Clear labels")
157-
generate_sample_wordcloud = streamlit.sidebar.checkbox("Generate wordcloud")
158149

159150
##################################
160151
# EXPORTING DATA #
@@ -172,6 +163,20 @@ def write():
172163
"Exported data is saved by default to data/labeled_data/your_name.csv. modify this in the config file"
173164
)
174165

166+
##############################
167+
# VARIOUS BUTTONS #
168+
##############################
169+
170+
space = streamlit.sidebar.text("")
171+
compute = streamlit.sidebar.button("Compute embeddings")
172+
clear_cache_button = streamlit.sidebar.button("Clear cache")
173+
clear_labels_button = streamlit.sidebar.button("Clear labels")
174+
175+
show_labeled = streamlit.sidebar.checkbox("Show labeled data")
176+
177+
generate_sample_wordcloud = streamlit.sidebar.checkbox("Generate wordcloud")
178+
179+
175180
if clear_cache_button:
176181
clear_cache()
177182

@@ -194,6 +199,8 @@ def write():
194199
#####################################
195200

196201
if column_name != "-":
202+
203+
dataset[column_name]=dataset[column_name].astype(str)
197204
embedding_df = compute_cache(
198205
progress_bar,
199206
embedding_language,

lib/utils/cache.py

Lines changed: 7 additions & 8 deletions
Original file line numberDiff line numberDiff line change
@@ -16,12 +16,14 @@
1616
def compute_stopwords(
1717
remove_stopwords, sampled_data, column_name, dataset_language, custom_stopwords
1818
):
19+
1920
if remove_stopwords:
20-
dataset_to_filter = sampled_data.copy()
21-
22-
dataset_to_filter[column_name] = remove_stopwords_from_column(
23-
dataset_to_filter[column_name], dataset_language, custom_stopwords
24-
)
21+
with streamlit.spinner(':hourglass: Filtering Stopwords...'):
22+
dataset_to_filter = sampled_data.copy()
23+
24+
dataset_to_filter[column_name] = remove_stopwords_from_column(
25+
dataset_to_filter[column_name], dataset_language, custom_stopwords
26+
)
2527
return dataset_to_filter
2628
else:
2729
return sampled_data
@@ -107,15 +109,12 @@ def compute_all(
107109
):
108110
df = compute_samples(sample_data, df)
109111
# write_cache("sampled_cache.csv", df)
110-
streamlit.write(df)
111112
df = compute_stopwords(remove_stopwords, df, column_name,dataset_language,custom_stopwords)
112113
# write_cache("stopwords_cache.csv", df)
113-
streamlit.write(df)
114114
df = compute_embeddings(
115115
df, embedding_language, languages_dict, progress_bar, column_name
116116
)
117117
# write_cache("embedding_cache.csv", df)
118-
streamlit.write(df)
119118
df = compute_dimension_reduction(df, transformer_option, transformers_dict)
120119
# write_cache("cache.csv",df)
121120
return df

lib/utils/plotting.py

Lines changed: 1 addition & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -49,7 +49,7 @@ def make_interactive_plot(embset, cluster):
4949
plot.xgrid.grid_line_color = None
5050
plot.ygrid.grid_line_color = None
5151
plot.outline_line_color = None
52-
52+
plot.toolbar.logo = None
5353

5454

5555

lib/utils/processing.py

Lines changed: 1 addition & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -99,7 +99,7 @@ def cluster_tfidf(df, language="French"):
9999
colormap="Blues",
100100
width=100,
101101
height=100,
102-
).generate(" ".join(df[df.cluster == k].text.tolist()).lower())
102+
).generate(" ".join(df[df.cluster == k].text.astype(str).tolist()).lower())
103103
top_3 = list(wordcloud.words_.keys())
104104
df.loc[df.cluster == k, "cluster"] = f"{top_3[0]} - {top_3[1]} - {top_3[2]}"
105105
return df

main_app.py

Lines changed: 1 addition & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -13,3 +13,4 @@ def main():
1313
if __name__ == "__main__":
1414
st.set_page_config(layout='wide')
1515
main()
16+

0 commit comments

Comments
 (0)