Fix attack type normalization and safe classification leak in graph 08e7bbd imDrizzle commited on Jul 12
feat(security): disable OpenAI moderation layer completely per user request 3a62ceb imDrizzle commited on Jun 29
fix(security): add PROMPT_EXTRACTION regex rules to catch explicit system prompt leaks aa8c9a7 imDrizzle commited on Jun 29
feat(security): transition firewall to a cumulative risk ensemble architecture 6a3e3cc imDrizzle commited on Jun 29
fix(security): enforce pipeline risk threshold over openai moderation boolean dee921b imDrizzle commited on Jun 29
fix(ui): add openai moderation to live monitor breakdown and fix 0 score parsing 363f7ca imDrizzle commited on Jun 29