Commit f928dd1
Changed files (1)
lib
elelem
llama
lib/elelem/llama/plugin.rb
@@ -4,10 +4,10 @@ Elelem::Providers.register(:gguf) do
gpu = %w[vulkan cuda metal].include?(Elelem::Net::GGUF.backend)
Elelem::Net::GGUF.new(
- model: ENV.fetch("GGUF_MODEL", File.expand_path("~/models/Qwen2.5-Coder-7B-Instruct-Q4_K_M.gguf")),
- n_ctx: Integer(ENV.fetch("GGUF_N_CTX", "8192")),
+ model: ENV.fetch("GGUF_MODEL", File.expand_path("~/models/gpt-oss-20b-MXFP4.gguf")),
+ n_ctx: Integer(ENV.fetch("GGUF_N_CTX", "16384")),
n_threads: Integer(ENV.fetch("GGUF_THREADS", "16")),
- max_tokens: Integer(ENV.fetch("GGUF_MAX_TOKENS", "512")),
+ max_tokens: Integer(ENV.fetch("GGUF_MAX_TOKENS", "4096")),
n_gpu_layers: Integer(ENV.fetch("GGUF_N_GPU_LAYERS", gpu ? "999" : "0")),
temp: Float(ENV.fetch("GGUF_TEMP", "0.7")),
seed: Integer(ENV.fetch("GGUF_SEED", "-1"))