future-html / gemmademo

Commit History

fix
3328c8a

aadya1762 commited on

Stream LLM responses
d24a753

aadya1762 commited on

fix
e4ef2eb

aadya1762 commited on

fix
4ffa911

aadya1762 commited on

fix
0adab94

aadya1762 commited on

fix
1719ee5

aadya1762 commited on

fixes
6aec7fd

aadya1762 commited on

fix
1dde7c7

aadya1762 commited on

fix
a37bbcd

aadya1762 commited on

fix
2fb6248

aadya1762 commited on

port to gradio
8cc5c82

aadya1762 commited on

use 4 bit quantized models for faster inference
5ca1c38

aadya1762 commited on

fix
8200fa2

aadya1762 commited on

Add model config sliders
c1e7456

aadya1762 commited on

Update _model.py
bc32324
unverified

Aadya Chinubhai commited on

fix
6ea3b45

aadya1762 commited on

use llama.cpp
bdca525

aadya1762 commited on

increase cache limit -> fewer recompilations by pytorch
5160420

aadya1762 commited on

fix
51cf9c8

aadya1762 commited on

remove torch.compile
9038c58

aadya1762 commited on

fix
cff4a94

aadya1762 commited on

initial commit
b4ecb60

aadya1762 commited on