Administrator
发布于 2026-05-07 / 0 阅读
0
0

Hermes 本地大模型部署指南

Hermes 本地大模型部署指南

Hermes 是一个强大的本地大语言模型,本文介绍如何部署和使用。

一、Hermes 简介

Hermes 是基于 Llama 微调的开源大语言模型,支持:

  • 本地部署,保护隐私

  • 多种任务:对话、代码生成、翻译

  • 可离线使用

二、安装 Ollama

# Windows
winget install Ollama.Ollama

# macOS
brew install ollama

# Linux
curl -fsSL https://ollama.com/install.sh | sh

三、下载 Hermes 模型

# 下载 Hermes 7B
ollama pull hermes

# 或者下载其他版本
ollama pull hermes:13b
ollama pull hermes:70b

四、运行模型

# 交互式对话
ollama run hermes

# API 调用
curl http://localhost:11434/api/generate -d '{
  "model": "hermes",
  "prompt": "你好,请介绍一下自己"
}'

五、性能优化

  • GPU 加速:确保安装了 CUDA 驱动

  • 量化版本:使用 4-bit 量化减少内存占用

  • 并发控制:调整 num_ctx 参数


评论