rahimar1002's picture
download
raw
286 kB
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Governance, auditability, and safety gates in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Self-grading and automated critique in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Governance, auditability, and safety gates in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in TypeScript.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Self-grading and automated critique in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Tool-calling traces and CI integration in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Governance, auditability, and safety gates in Go.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Diff-first patching and SWE-bench style evaluation in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for MoE expert routing for code in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in TypeScript.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for MoE expert routing for code in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Governance, auditability, and safety gates in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Python.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Tool-calling traces and CI integration in Rust.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Tool-calling traces and CI integration in TypeScript.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for Self-grading and automated critique in Python.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Go.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Diff-first patching and SWE-bench style evaluation in Go.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for MoE expert routing for code in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Self-grading and automated critique in Python.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Diff-first patching and SWE-bench style evaluation in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Diff-first patching and SWE-bench style evaluation in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Self-grading and automated critique in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate patch_diff for MoE expert routing for code in Go.", "response": "```diff\n- return a/b\n+ if b==0: raise ValueError('division by zero')\n+ return a/b\n```", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in Rust.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Tool-calling traces and CI integration in Go.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for MoE expert routing for code in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate tool_trace for Diff-first patching and SWE-bench style evaluation in TypeScript.", "response": "{'tool': 'checkout', 'args': {'commit': 'abc123'}}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate agent_loop for Tool-calling traces and CI integration in Rust.", "response": "Plan → Edit → Test → Reflect → Human Gate", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate eval for Agentic coding systems (plan→edit→test→reflect) in Python.", "response": "Metrics: pass@k, time-to-green, cost-per-fix, regressions", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Governance, auditability, and safety gates in TypeScript.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}
{"source": "genesis_code_demo", "source_dataset": "WithinUsAI/Genesis_AI_Code_1k_Demo", "instruction": "Demonstrate self_grade for Agentic coding systems (plan→edit→test→reflect) in Rust.", "response": "{'score': 9, 'confidence': 0.9, 'notes': 'Tests passed; minimal diff; safe.'}", "category": "coding"}

Xet Storage Details

Size:
286 kB
·
Xet hash:
a8cc6fc26208f6c9ed7a3cd7077dc435310ca82b65ed7c8fc36dc1f8017e6e28

Xet efficiently stores files, intelligently splitting them into unique chunks and accelerating uploads and downloads. More info.