mannnon commited on
Commit
88c8d30
·
verified ·
1 Parent(s): 255617c

Update app.py

Browse files
Files changed (1) hide show
  1. app.py +9 -17
app.py CHANGED
@@ -358,27 +358,20 @@ def extract_pdf_name(text: str, source_pdf: str = None):
358
  return name.upper()
359
 
360
  return None
361
- def extract_speed_from_pdf_text_or_filename(full_text: str, source_pdf: str):
362
- # 1) Cherche dans le texte PDF
 
 
 
363
  patterns = [
364
  r"VMA\s*(\d+(?:[.,]\d+)?)\s*kmh",
365
  r"VMA\s*(\d+(?:[.,]\d+)?)\s*km/h",
366
- r"Vitesse,\s*km/h\s*(\d+(?:[.,]\d+)?)",
367
  r"(\d+(?:[.,]\d+)?)\s*kmh",
368
  r"(\d+(?:[.,]\d+)?)\s*km/h",
369
  ]
370
 
371
- if full_text:
372
- for pattern in patterns:
373
- m = re.search(pattern, full_text, flags=re.I)
374
- if m:
375
- return float(m.group(1).replace(",", "."))
376
-
377
- # 2) Fallback : cherche dans le nom du fichier
378
- if source_pdf:
379
- m = re.search(r"(\d+(?:[.,]\d+)?)\s*kmh", source_pdf, flags=re.I)
380
- if not m:
381
- m = re.search(r"(\d+(?:[.,]\d+)?)\s*km/h", source_pdf, flags=re.I)
382
  if m:
383
  return float(m.group(1).replace(",", "."))
384
 
@@ -430,9 +423,8 @@ def parse_zebris_pdf(uploaded_pdf):
430
  page_texts.append(txt)
431
 
432
  full_text = " ".join(page_texts)
433
-
434
- # Extraction de l'allure du PDF (ex: "VMA 14kmh" ou "14,0 km/h")
435
- data["speed_kmh"] = extract_speed_from_pdf_text_or_filename(full_text, source_pdf)
436
 
437
  # fallback si nom non récupéré via fichier
438
  if not data["athlete_name"]:
 
358
  return name.upper()
359
 
360
  return None
361
+
362
+ def extract_speed_from_text(full_text: str):
363
+ if not full_text:
364
+ return np.nan
365
+
366
  patterns = [
367
  r"VMA\s*(\d+(?:[.,]\d+)?)\s*kmh",
368
  r"VMA\s*(\d+(?:[.,]\d+)?)\s*km/h",
 
369
  r"(\d+(?:[.,]\d+)?)\s*kmh",
370
  r"(\d+(?:[.,]\d+)?)\s*km/h",
371
  ]
372
 
373
+ for pattern in patterns:
374
+ m = re.search(pattern, full_text, flags=re.I)
 
 
 
 
 
 
 
 
 
375
  if m:
376
  return float(m.group(1).replace(",", "."))
377
 
 
423
  page_texts.append(txt)
424
 
425
  full_text = " ".join(page_texts)
426
+ data["speed_kmh"] = extract_speed_from_text(full_text)
427
+ st.text(full_text[:2000])
 
428
 
429
  # fallback si nom non récupéré via fichier
430
  if not data["athlete_name"]: