Docker 在其最新的 4.44.0 版本中引入了 Docker Model Runner 功能,使在本地环境中运行 AI 模型变得简单和便捷。
当前平台支持情况:目前,Docker Model Runner 仅在搭载 Apple Silicon 芯片(M 系列)的 Mac 设备上可用。Windows 平台的支持已在 Docker 的开发路线图上,将在未来版本中推出。正如官方所述:“Soon, this will also be available on Windows.”
这项功能的推出标志着 Docker 向 AI 开发领域迈出了重要一步,为开发者提供了一种无需配置复杂环境就能轻松管理和运行大型语言模型的方式,同时避免了对外部云服务的依赖。
可用命令整理
查看 Model Runner 状态
检查 Docker Model Runner 是否处于活动状态:查看所有命令
显示帮助信息和可用子命令列表:拉取模型
从 Docker Hub 拉取模型到本地环境:
列出可用模型
列出当前拉取到本地环境的所有模型:运行模型
运行模型并使用提交的提示或聊天模式与其交互。一次性提示
交互式聊天
删除模型
从系统中移除已下载的模型:使用 Rest 端点
从 Docker Desktop GUI 或通过 Docker Desktop CLI 启用主机端 TCP 支持。 使用docker desktop enable model-runner --tcp <port>。
之后,可以使用 localhost 和所选或默认端口与其交互:
LangChain4j 调用 Docker Model
LangChain4j 是一个 Java 框架,用于构建基于大型语言模型 (LLM) 的应用程序。它为 Java 开发人员提供了与各种 LLM 交互的简单方式,类似于 Python 世界中流行的 LangChain 库。设置步骤
1. 确保 Docker Model Runner 已启用
在 Docker Desktop 中确保 Model Runner 功能已启用(见前文)。2. 添加 LangChain4j 依赖
在您的 Java 项目的pom.xml文件中添加以下依赖: