Inference efficiency
media Hugging Face Forums · 1 天前 · 11 次浏览

用户寻求用于本地希腊语使用的 Llama-Krikri-8B-Instruct 消融工作流

一名用户计划使用 ilsp/Llama-Krikri-8B-Instruct 检查点构建一个无审查、原生希腊语的大语言模型,以便进行本地部署。拟定的计划涉及使用 Heretic (heretic-llm) 对模型进行消融处理,将其转换为 GGUF Q4_K_M 格式,并在配备 AMD Ryzen AI MAX+ 395 处理器的 GMKtec EVO-X3 上通过 Vulkan 运行推理。