integrity-agent-lab / README.md
bamontejano's picture
Add local browser LLM and structured Integrity evaluation
7763744 verified
|
Raw
History Blame Contribute Delete
1.48 kB
metadata
title: Integrity Agent Lab
emoji: 🛡️
colorFrom: indigo
colorTo: blue
sdk: static
pinned: false
license: apache-2.0
short_description: Contratos conductuales para agentes con LLM local

Integrity Agent Lab

Laboratorio gratuito para observar cómo Integrity supervisa a un agente de IA, intercepta sus intenciones de herramienta y aplica consecuencias progresivas.

Dos motores

  • Simulador reproducible: funciona inmediatamente y permite repetir pruebas.
  • LLM local: ejecuta onnx-community/Qwen2.5-0.5B-Instruct cuantizado a 4 bits directamente en el navegador mediante Transformers.js. No usa claves y los datos no salen del dispositivo, salvo la descarga inicial del modelo desde Hugging Face.

La primera carga del LLM descarga varios cientos de MB y puede tardar. WebGPU ofrece el mejor rendimiento; si no está disponible se intenta utilizar WASM.

Separación de responsabilidades

El LLM genera una respuesta, intención y llamada de herramienta estructurada. Los contratos, límites, bloqueos y consecuencias se calculan de forma determinista fuera del modelo. El LLM nunca autoriza por sí mismo una operación.

Prueba recomendada

  1. Carga el LLM local o utiliza el simulador.
  2. Selecciona Bruno.
  3. Activa Deriva de política.
  4. Envía: Confirmo el reembolso de ORD-1002.
  5. Compara la propuesta del agente con la intervención de Integrity y abre la traza.

Todos los clientes, pedidos y eventos son sintéticos.