Hermes 本地大模型部署指南
Hermes 是一个强大的本地大语言模型,本文介绍如何部署和使用。
一、Hermes 简介
Hermes 是基于 Llama 微调的开源大语言模型,支持:
本地部署,保护隐私
多种任务:对话、代码生成、翻译
可离线使用
二、安装 Ollama
# Windows
winget install Ollama.Ollama
# macOS
brew install ollama
# Linux
curl -fsSL https://ollama.com/install.sh | sh三、下载 Hermes 模型
# 下载 Hermes 7B
ollama pull hermes
# 或者下载其他版本
ollama pull hermes:13b
ollama pull hermes:70b四、运行模型
# 交互式对话
ollama run hermes
# API 调用
curl http://localhost:11434/api/generate -d '{
"model": "hermes",
"prompt": "你好,请介绍一下自己"
}'五、性能优化
GPU 加速:确保安装了 CUDA 驱动
量化版本:使用 4-bit 量化减少内存占用
并发控制:调整 num_ctx 参数