feat: add initial AutoGPTQ backend implementation

2025-05-28 06:25:00 +00:00 · 2023-08-07 22:39:10 +02:00 · 2023-08-07 22:39:10 +02:00 · a843e64fc2
commit a843e64fc2
parent 91d49cfe9f
37 changed files with 660 additions and 148 deletions
--- a/pkg/grpc/llm/llama/llama.go
+++ b/pkg/grpc/llm/llama/llama.go
@ -71,7 +71,7 @@ func (llm *LLM) Load(opts *pb.ModelOptions) error {
 		llamaOpts = append(llamaOpts, llama.EnabelLowVRAM)
 	}

-	model, err := llama.New(opts.Model, llamaOpts...)
+	model, err := llama.New(opts.ModelFile, llamaOpts...)
 	llm.llama = model
 	return err
 }