Commit f41a23c
2026-08-30 06:27:50
1 parent
50e0ca2
Changed files (2)
lib
elelem
plugins
spec
evals
lib/elelem/plugins/gguf.rb
@@ -4,10 +4,10 @@ Elelem::Providers.register(:gguf) do
gpu = %w[vulkan cuda metal].include?(Elelem::Net::GGUF.backend)
Elelem::Net::GGUF.new(
- model: ENV.fetch("GGUF_MODEL", File.expand_path("~/models/Qwen2.5-Coder-7B-Instruct-Q4_K_M.gguf")),
- n_ctx: Integer(ENV.fetch("GGUF_N_CTX", "8192")),
+ model: ENV.fetch("GGUF_MODEL", File.expand_path("~/models/gpt-oss-20b-MXFP4.gguf")),
+ n_ctx: Integer(ENV.fetch("GGUF_N_CTX", "16384")),
n_threads: Integer(ENV.fetch("GGUF_THREADS", "16")),
- max_tokens: Integer(ENV.fetch("GGUF_MAX_TOKENS", "512")),
+ max_tokens: Integer(ENV.fetch("GGUF_MAX_TOKENS", "4096")),
n_gpu_layers: Integer(ENV.fetch("GGUF_N_GPU_LAYERS", gpu ? "999" : "0")),
temp: Float(ENV.fetch("GGUF_TEMP", "0.7")),
seed: Integer(ENV.fetch("GGUF_SEED", "-1"))
spec/evals/cases_spec.rb
@@ -12,14 +12,14 @@ module Elelem
end
end
- def self.gguf(model: ENV.fetch("GGUF_MODEL", File.expand_path("~/models/Qwen2.5-Coder-7B-Instruct-Q4_K_M.gguf")))
+ def self.gguf(model: ENV.fetch("GGUF_MODEL", File.expand_path("~/models/gpt-oss-20b-MXFP4.gguf")))
@gguf ||= begin
gpu = %w[vulkan cuda metal].include?(Elelem::Net::GGUF.backend)
Elelem::Net::GGUF.new(
model: File.expand_path(model),
- n_ctx: Integer(ENV.fetch("GGUF_N_CTX", "8192")),
+ n_ctx: Integer(ENV.fetch("GGUF_N_CTX", "16384")),
n_gpu_layers: Integer(ENV.fetch("GGUF_N_GPU_LAYERS", gpu ? "999" : "0")),
- max_tokens: Integer(ENV.fetch("GGUF_MAX_TOKENS", "2048")),
+ max_tokens: Integer(ENV.fetch("GGUF_MAX_TOKENS", "4096")),
temp: 0.0,
seed: 42
)