fix: support newer DynamicCache attribute structure in transformers 5.8 f4b26d5 MaduRox commited on 6 days ago
fix: Implement infinite O(1) chunked online softmax phase sweep ef6342e MaduRox commited on 7 days ago
feat: add real empirical benchmark harness with /run_benchmark endpoint ae7c56f MaduRox commited on 7 days ago
docs: update Swagger tab with complete PowerShell, Python, JS, and cURL 2-step REST examples 095ce37 MaduRox commited on 7 days ago
fix: configure clean chat template and hybrid RIF sliding window on T4 GPU 74aa433 MaduRox commited on 7 days ago
fix: enable KalpanaHybridCacheLayer in KalpanaDynamicCache for fluent generation 9ab7159 MaduRox commited on 7 days ago
fix: add system prompt, top_p, and repetition_penalty to prevent small model loop ef5ecdb MaduRox commited on 7 days ago
fix: restore native Gradio 5 launcher for ZeroGPU prestart hooks 38dbeb1 MaduRox commited on 7 days ago
feat: add FastAPI server with Live Swagger UI, OpenAI endpoints, and CORS c8f0400 MaduRox commited on 7 days ago
feat: upgrade holographic resolution to 2048 bands on NVIDIA A100 1e0f5c6 MaduRox commited on 7 days ago
fix: bridge KalpanaRIFTensor to native kalpana.core kernel without kwargs mismatch abbc3ec MaduRox commited on 8 days ago
chore: enforce strict binary SDK kernel with zero math in Python 9bbd4da MaduRox commited on 8 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU 6018bf3 MaduRox commited on 8 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU 01c6ddb MaduRox commited on 8 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU c23e3c7 MaduRox commited on 8 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU 37d0686 MaduRox commited on 8 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU ceb10c0 MaduRox commited on 8 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU 05bc684 MaduRox commited on 8 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU b1909b4 MaduRox commited on 8 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU efb9f26 MaduRox commited on 8 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU 1a668ac MaduRox commited on 8 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU ab09287 MaduRox commited on 8 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU 21e9521 MaduRox commited on 8 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU c828501 MaduRox commited on 8 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU 2a33d72 MaduRox commited on 8 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU 7fc1739 MaduRox commited on 8 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU 2e4d3c6 MaduRox commited on 8 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU c07d3e6 MaduRox commited on 8 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU 110959e MaduRox commited on 9 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU 2f6a704 MaduRox commited on 9 days ago
feat: integrate KalpanaDynamicCache into all 24 layers of Qwen2.5 on ZeroGPU b6b8b5d MaduRox commited on 9 days ago
fix: resolve AttributeError on llm.DEFAULT_MODELS in Gradio UI startup b879636 Madusha Perera commited on 17 days ago