Commit History

Load model in 4bit with bitsandbytes
6c3841a
verified

niranjani23 commited on

Use LlamaTokenizerFast in handler
1602a2e
verified

niranjani23 commited on

Fresh handler with LlamaTokenizer
4abe2c9
verified

niranjani23 commited on

Delete old handler
609437c
verified

niranjani23 commited on

Create handler.py
26f9601
verified

niranjani23 commited on