首页
随机
最近更改
特殊页面
社群首页
参数设置
关于WHY42
免责声明
WHY42
搜索
用户菜单
登录
欢迎来到Riguz的小站!这是一个私人wiki,用来记录一些我的笔记。
查看“︁Llama.cpp”︁的源代码
←
Llama.cpp
因为以下原因,您没有权限编辑该页面:
您请求的操作仅限属于该用户组的用户执行:
用户
您可以查看和复制此页面的源代码。
= Build llama.cpp = <ref>https://github.com/ggerganov/llama.cpp/blob/master/docs/build.md</ref> <syntaxhighlight lang="bash"> git clone https://github.com/ggerganov/llama.cpp cd llama.cpp make </syntaxhighlight> =Convert Hugging Face Model to GGUF = <syntaxhighlight lang="bash"> pip install -r requirements.txt python convert_hf_to_gguf.py --help #M1 MPS does not support bf16 python convert_hf_to_gguf.py ~/Documents/MODELS/Qwen2-0.5B --outfile ~/Documents/MODELS/qwen2-0.5b-fp16.gguf --outtype f16 </syntaxhighlight> =Run the model = <syntaxhighlight lang="bash"> ./llama-cli -m ~/Documents/MODELS/qwen2-0.5b-fp16.gguf -p "Hi, who are you?" -n 128 </syntaxhighlight> = quantize= <ref>https://cloud.aigonna.com/2024/03/25/llama-cpp%E9%87%8F%E5%8C%96/</ref> <syntaxhighlight lang="bash"> </syntaxhighlight> [[Category:Deep Learning]]
返回
Llama.cpp
。