File size: 1,467 Bytes
63f8ad8 2cc8b30 63f8ad8 | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 | import gradio as gr
def dummy_response(entrada, modelo=None):
if modelo:
return f"🔧 Funcionalidad en desarrollo... Modelo seleccionado: {modelo}"
else:
return "🔧 Funcionalidad en desarrollo..."
with gr.Blocks() as demo:
gr.Markdown("""
# 🤖 Aplicación Multimodal con Deep Learning
Esta aplicación integra modelos de visión e inteligencia artificial para analizar **imágenes** y **audio** en tiempo real.
""")
with gr.Tab("📷 Clasificación de Imágenes"):
gr.Markdown("Sube una imagen para clasificarla con modelos visuales (ResNet, MobileNet, EfficientNet)")
image_input = gr.Image(type="pil", label="📤 Imagen de entrada")
image_model = gr.Dropdown(
["ResNet", "EfficientNet"],
label="Selecciona el modelo",
value="ResNet"
)
image_output = gr.Textbox(label="📈 Resultado")
gr.Button("Clasificar Imagen").click(fn=dummy_response, inputs=[image_input, image_model], outputs=image_output)
with gr.Tab("🎙️ Reconocimiento de Voz"):
gr.Markdown("Sube un archivo de audio para convertirlo en texto utilizando un modelo basado en CTC.")
audio_input = gr.Audio(type="filepath", label="🎧 Audio de entrada")
audio_output = gr.Textbox(label="📝 Texto transcrito")
gr.Button("Transcribir Audio").click(fn=dummy_response, inputs=audio_input, outputs=audio_output)
demo.launch()
|