微信扫码
添加专属顾问
我要投稿
深入了解GGUF文件格式,掌握大模型部署的关键技术。 核心内容: 1. GGUF格式的定义及其设计目的 2. GGUF格式在大模型部署中的优势 3. GGUF格式的高效性与量化支持应用实例
模型有 32×10**9个参数。
总字节数=32×10**9×2=64×10**9字节=64GB
总位数(量化后)=32×10**9×4=128×10**9位
FROM C:/Users/admin/.ollama/models/DeepSeek-R1-Distill-Qwen-7B-GGUF/DeepSeek-R1-Distill-Qwen-7B-Q8_0.ggufPARAMETER temperature 0.6SYSTEM """你是乐于助人的帮手,擅长中文多轮对话,回答需严谨且符合事实。>"""
ollama create model-name -f Modelfile
ollama create deepseek-r1-distill-qwen-7b -f ./Modelfile
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2026-05-28
谷歌放弃 Gemini CLI,转头用 Go 写了个新玩具 Antigravity CLI
2026-05-28
Claude code云端部署 & 魔改sdk实现http流式调用保姆级教程
2026-05-28
“不用AI的CEO,我会亲自干掉他!”亿万富翁马克·库班最新对话:看好Claude,但奥特曼迟早被自己反噬
2026-05-27
我把 OpenAI Codex 官方案例全跑了一遍
2026-05-27
一个Agent工程师听完VC的2小时播客后想通的事
2026-05-27
考虑把 Claude Code 全量切换到 Grok Build 了
2026-05-27
从透明开发到系统工程:AgentScope 2.0 发布
2026-05-27
大神Karpathy 发明 autoresearch,仅用 Markdown 就做出了自动化研究循环
2026-04-15
2026-04-07
2026-03-31
2026-03-13
2026-04-07
2026-03-17
2026-03-17
2026-03-21
2026-04-24
2026-03-06
2026-05-26
2026-05-23
2026-05-21
2026-05-19
2026-05-09
2026-05-09
2026-05-09
2026-05-08