Spaces:
Sleeping
Sleeping
Update src/streamlit_app.py
Browse files- src/streamlit_app.py +6 -11
src/streamlit_app.py
CHANGED
|
@@ -5,13 +5,12 @@ from urllib.parse import urlparse
|
|
| 5 |
import io
|
| 6 |
|
| 7 |
# --- CONFIGURA脟脮ES ---
|
| 8 |
-
# 鈿狅笍 IMPORTANTE: Substitua pelo
|
| 9 |
-
|
| 10 |
-
MODEL_ID = "asilvamaia/ident_br"
|
| 11 |
|
| 12 |
st.set_page_config(page_title="Validador .BR", page_icon="馃嚙馃嚪")
|
| 13 |
|
| 14 |
-
# --- FUN脟脙O DE LIMPEZA
|
| 15 |
def limpar_entrada(texto: str) -> str:
|
| 16 |
"""
|
| 17 |
Remove sujeira, portas, protocolos e www.
|
|
@@ -44,13 +43,13 @@ def limpar_entrada(texto: str) -> str:
|
|
| 44 |
except:
|
| 45 |
return texto
|
| 46 |
|
| 47 |
-
# --- CARREGAMENTO DO MODELO
|
| 48 |
@st.cache_resource
|
| 49 |
def load_model():
|
| 50 |
try:
|
| 51 |
tokenizer = AutoTokenizer.from_pretrained(MODEL_ID)
|
| 52 |
model = AutoModelForSequenceClassification.from_pretrained(MODEL_ID)
|
| 53 |
-
# For莽a uso de CPU no Space gratuito
|
| 54 |
model.to("cpu")
|
| 55 |
model.eval()
|
| 56 |
return tokenizer, model
|
|
@@ -80,8 +79,4 @@ if uploaded_file and tokenizer:
|
|
| 80 |
total_linhas = len(linhas)
|
| 81 |
|
| 82 |
for i, linha in enumerate(linhas):
|
| 83 |
-
original = linha.strip()
|
| 84 |
-
|
| 85 |
-
# --- CORRE脟脙O DO ERRO ANTERIOR AQUI ---
|
| 86 |
-
# Ignora linhas vazias ou metadados do arquivo como
|
| 87 |
-
if not original or original.startswith(")
|
|
|
|
| 5 |
import io
|
| 6 |
|
| 7 |
# --- CONFIGURA脟脮ES ---
|
| 8 |
+
# 鈿狅笍 IMPORTANTE: Substitua "SEU_USUARIO/NOME_DO_SEU_MODELO" pelo seu ID real no Hugging Face
|
| 9 |
+
MODEL_ID = "SEU_USUARIO/NOME_DO_SEU_MODELO"
|
|
|
|
| 10 |
|
| 11 |
st.set_page_config(page_title="Validador .BR", page_icon="馃嚙馃嚪")
|
| 12 |
|
| 13 |
+
# --- FUN脟脙O DE LIMPEZA ---
|
| 14 |
def limpar_entrada(texto: str) -> str:
|
| 15 |
"""
|
| 16 |
Remove sujeira, portas, protocolos e www.
|
|
|
|
| 43 |
except:
|
| 44 |
return texto
|
| 45 |
|
| 46 |
+
# --- CARREGAMENTO DO MODELO ---
|
| 47 |
@st.cache_resource
|
| 48 |
def load_model():
|
| 49 |
try:
|
| 50 |
tokenizer = AutoTokenizer.from_pretrained(MODEL_ID)
|
| 51 |
model = AutoModelForSequenceClassification.from_pretrained(MODEL_ID)
|
| 52 |
+
# For莽a uso de CPU no Space gratuito
|
| 53 |
model.to("cpu")
|
| 54 |
model.eval()
|
| 55 |
return tokenizer, model
|
|
|
|
| 79 |
total_linhas = len(linhas)
|
| 80 |
|
| 81 |
for i, linha in enumerate(linhas):
|
| 82 |
+
original = linha.strip()
|
|
|
|
|
|
|
|
|
|
|
|