微信扫码
添加专属顾问
我要投稿
Docker Desktop V4.40.0版本带来革命性更新,直接支持AI大模型部署和管理。 核心内容: 1. Docker Desktop V4.40.0重点更新:支持AI模型提取、运行和管理 2. 支持拉取、查看、运行和删除大模型,简化操作流程 3. 目前仅支持Apple Silicon版Mac,未来有望扩展到更多平台
2025年3月31,Docker Desktop发布了V4.40.0,该版本重点是支持从Docker Hub提取、运行和管理 AI 模型:
Release notes :https://docs.docker.com/desktop/release-notes/
在此之前,通过Docker部署大模型,必须先运行Ollama容器,再通过Ollama容器运行大模型。
现在,直接跑大模型了,这是一个好消息。
有好消息就有坏消息,坏消息是,当前只支持带有 Apple Silicon 的 Mac 版 Docker Desktop:
详细内容请查阅: https://docs.docker.com/desktop/features/model-runner/?uuid=66EBDDDD-7F8B-4743-AA27-F3BCA323736F
访问 https://docs.docker.com/desktop/release-notes/ 点击下载链接:
已安装过就打开Docker Desktop,找到Software updates,点击“Check for updates”:
事实上,当打开Docker Desktop也会提醒更新。
找到Features in development,勾选Enable Docker Model Runner前的复选框:然后"Apply & restart"。
准备就绪后,在终端中执行大模型拉取命令:
docker model pull ai/deepseek-r1-distill-llama
当然,也可在Docker Desktop的搜索框里查找并拉取:
目前支持拉取的大模型参考:https://hub.docker.com/catalogs/gen-ai
docker model list
docker model run ai/deepseek-r1-distill-llama:latest "你好"
docker model run ai/deepseek-r1-distill-llama:latest
docker model rm ai/deepseek-r1-distill-llama:latest
我尝试了官网说的其中2种调用方式,感觉都还行。
curl --unix-socket $HOME/.docker/run/docker.sock \
localhost/exp/vDD4.40/engines/llama.cpp/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{
"model": "ai/deepseek-r1-distill-llama",
"messages": [
{
"role": "system",
"content": "你是一个幽默的人."
},
{
"role": "user",
"content": "请给我讲一个小猪的笑话。"
}
]
}'
效果:
# 启用主机端 TCP 支持
docker desktop enable model-runner --tcp 12434
curl http://localhost:12434/engines/llama.cpp/v1/chat/completions \
-H "Content-Type: application/json" \
-d '{
"model": "ai/deepseek-r1-distill-llama",
"messages": [
{
"role": "system",
"content": "你是一个会讲故事的人."
},
{
"role": "user",
"content": "请给我讲一个小马过河的故事。"
}
]
}'
效果:
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费POC验证,效果达标后再合作。零风险落地应用大模型,已交付160+中大型企业
2026-03-15
Claude 这个更新,让模型能力提升10%+!
2026-03-14
100万上下文全面上线!Claude两款4.6模型取消长文本溢价,支持直塞600张图
2026-03-13
2026年 国内如何注册 Claude 账号教程
2026-03-13
1300 万人围观,龙虾「杀手」来了
2026-03-13
从IDE到Terminal:适合后端宝宝体质的Claude Code工作流|得物技术
2026-03-13
同一个 Claude,为什么别人跑出 78%,你只有 42%?也许你需要Harness工程
2026-03-13
破除偏见:阻碍生成式AI加速落地的认知桎梏
2026-03-12
OpenAI发布GPT-5.4金融套件:顶级数据库首次向普通用户开放
2026-01-24
2026-01-10
2026-01-01
2026-01-26
2025-12-21
2026-01-09
2026-01-09
2025-12-30
2026-01-21
2026-01-23
2026-03-09
2026-03-08
2026-03-03
2026-03-01
2026-02-27
2026-02-27
2026-02-26
2026-02-24