Text Generation
MLX
Safetensors
English
Italian
qwen3
finance
financial-reasoning
investment-research
risk-management
portfolio-analysis
market-regime
financial-sentiment
explainable-ai
conversational
4-bit precision
Instructions to use Italianhype/Blum with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- MLX
How to use Italianhype/Blum with MLX:
# Make sure mlx-lm is installed # pip install --upgrade mlx-lm # Generate text with mlx-lm from mlx_lm import load, generate model, tokenizer = load("Italianhype/Blum") prompt = "Write a story about Einstein" messages = [{"role": "user", "content": prompt}] prompt = tokenizer.apply_chat_template( messages, add_generation_prompt=True ) text = generate(model, tokenizer, prompt=prompt, verbose=True) - Notebooks
- Google Colab
- Kaggle
- Local Apps Settings
- LM Studio
- Pi
How to use Italianhype/Blum with Pi:
Start the MLX server
# Install MLX LM: uv tool install mlx-lm # Start a local OpenAI-compatible server: mlx_lm.server --model "Italianhype/Blum"
Configure the model in Pi
# Install Pi: npm install -g @mariozechner/pi-coding-agent # Add to ~/.pi/agent/models.json: { "providers": { "mlx-lm": { "baseUrl": "http://localhost:8080/v1", "api": "openai-completions", "apiKey": "none", "models": [ { "id": "Italianhype/Blum" } ] } } }Run Pi
# Start Pi in your project directory: pi
- Hermes Agent new
How to use Italianhype/Blum with Hermes Agent:
Start the MLX server
# Install MLX LM: uv tool install mlx-lm # Start a local OpenAI-compatible server: mlx_lm.server --model "Italianhype/Blum"
Configure Hermes
# Install Hermes: curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash hermes setup # Point Hermes at the local server: hermes config set model.provider custom hermes config set model.base_url http://127.0.0.1:8080/v1 hermes config set model.default Italianhype/Blum
Run Hermes
hermes
- OpenClaw new
How to use Italianhype/Blum with OpenClaw:
Start the MLX server
# Install MLX LM: uv tool install mlx-lm # Start a local OpenAI-compatible server: mlx_lm.server --model "Italianhype/Blum"
Configure OpenClaw
# Install OpenClaw: npm install -g openclaw@latest # Register the local server and set it as the default model: openclaw onboard --non-interactive --mode local \ --auth-choice custom-api-key \ --custom-base-url http://127.0.0.1:8080/v1 \ --custom-model-id "Italianhype/Blum" \ --custom-provider-id mlx-lm \ --custom-compatibility openai \ --custom-text-input \ --accept-risk \ --skip-health
Run OpenClaw
openclaw agent --local --agent main --message "Hello from Hugging Face"
- MLX LM
How to use Italianhype/Blum with MLX LM:
Generate or start a chat session
# Install MLX LM uv tool install mlx-lm # Interactive chat REPL mlx_lm.chat --model "Italianhype/Blum"
Run an OpenAI-compatible server
# Install MLX LM uv tool install mlx-lm # Start the server mlx_lm.server --model "Italianhype/Blum" # Calling the OpenAI-compatible server with curl curl -X POST "http://localhost:8000/v1/chat/completions" \ -H "Content-Type: application/json" \ --data '{ "model": "Italianhype/Blum", "messages": [ {"role": "user", "content": "Hello"} ] }'
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-f9b2e96103a2a285b79e", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-3bb6401570cbcbf88c78", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-7fb00f8ee594beed0ae0", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-3f9848dd87463ca8858b", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-42ece538c8d754e3f0bc", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-d2e2dbcc7f6f70145891", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-5f8ba32ef0536f9e43c0", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-e3962ad6fd3d3bfce9ba", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-01789c0e62ad9cefda66", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-98662367aa6cab77bd64", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-f4d01e3a0861ddd8ce9c", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-7af49e58aa0fca17c572", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-2b331e952441cf975d49", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-170b203eed90cead942b", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-dd3b52b8034b40cadac7", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.910714, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 0.5, "evidence_attribution_precision": 0.857143, "example_id": "blum-25dea237c93f7758215d", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.910714, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 0.5, "evidence_attribution_precision": 0.857143, "example_id": "blum-562234a0e2460e5b7a04", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.910714, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 0.5, "evidence_attribution_precision": 0.857143, "example_id": "blum-10920ff2a57691990844", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.910714, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 0.5, "evidence_attribution_precision": 0.857143, "example_id": "blum-874ee1debb0da2780d5a", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.910714, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 0.5, "evidence_attribution_precision": 0.857143, "example_id": "blum-2591cbc83e8270f80184", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.910714, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 0.5, "evidence_attribution_precision": 0.857143, "example_id": "blum-4538bd8cfe41ce2b54dc", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.910714, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 0.5, "evidence_attribution_precision": 0.857143, "example_id": "blum-5e66c7ff0807d49290dc", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.910714, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 0.5, "evidence_attribution_precision": 0.857143, "example_id": "blum-05b7a655380a6f783199", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.910714, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 0.5, "evidence_attribution_precision": 0.857143, "example_id": "blum-14d3678f99e9cbadfd82", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-f8811a9cfab42d09eb53", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-29e424c05c8bf1f3380a", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-85d8dd5455cf72cacfe5", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-39b668a890bc1a0e376c", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-43efcc2e206caa9e0a7d", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-67ec3a9368c2ee30238f", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-e104e745e98d07ae2b40", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-c102165a715657258df9", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-b9836243d01affce8a82", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-12359d685a77acc4edaf", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-ebbe89f0d0f82e23ed01", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-0ba2babac460046eeb00", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-d94be14f23e78e99e6c3", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-b7eccbd4943d228d910b", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-901e152efd5dac633686", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-d9e3e1f1ce591876d2ed", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-bd2d79d021e988a95be2", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-ca069fb297e36105e6ab", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-786182cb081b6511c219", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-0105fb1063469fc6c1be", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-29391e82d29c68a0c4ff", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-e6ebd432581f77038566", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-ca19cdf3b8421d6ed6e8", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-9d2964b1059d3a253393", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-877a7c3457be809f95b1", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-6d5304a0807421b5988f", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-4029a82b8828ea611cab", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-5e0f0b1c2dfde71c18d9", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |
| {"abstention_accuracy": 1.0, "aggregate_score": 0.973214, "calibration_outcome": null, "confidence": 0.7, "contradiction_coverage": 1.0, "evidence_attribution_precision": 0.857143, "example_id": "blum-cb43bb099dd20dd33e12", "invalidation_completeness": 1.0, "no_fabrication": 0.928571, "numerical_consistency": 1.0, "risk_completeness": 1.0, "structured_validity": 1.0} | |