https://github.com/Mozilla-Ocho/llamafile faster than vanilla llama.cpp on cpu ** Better just add OpenAI compatible backend flexibility to use any api great rag project! - also any plan for an API?
https://github.com/Mozilla-Ocho/llamafile
faster than vanilla llama.cpp on cpu
** Better just add OpenAI compatible backend
flexibility to use any api
great rag project! - also any plan for an API?