// 11
模型管理
概述
模型管理页面是 DeepSeno AI 引擎的控制中心,负责管理本地和云端的语言模型、语音识别模型的安装和配置。页面顶部的就绪指示器显示 Ollama、LLM 和 Sherpa 三个组件的状态。
Ollama 安装与状态检测
DeepSeno 使用 Ollama 作为本地大语言模型的运行引擎:
- 自动检测: 启动时自动检测 Ollama 是否已安装和运行
- 一键安装: 如果未检测到 Ollama,提供一键自动下载和安装功能
- 连接状态: 实时显示 Ollama 服务的连接状态(已连接/未连接/检测中)
模型列表与下载
LLM 模型
DeepSeno 根据你的硬件配置推荐合适的语言模型。支持的模型系列包括 Qwen3 的多个规格:
qwen3:8b— 基础版(约 5.2 GB,16 GB 内存推荐)qwen3:14b— 进阶版(约 9.3 GB,32 GB 内存推荐)qwen3:30b— 高级版(约 19 GB,64 GB 以上内存推荐)
每个模型显示下载状态(等待中/下载中/已完成/错误)和下载进度。点击下载按钮开始拉取,支持取消正在进行的下载。
嵌入模型
bge-m3(约 1.2 GB)是向量检索的核心组件,用于将文本转化为语义向量。必须安装才能使用智脑问答功能。
ASR 模型管理
SenseVoice ONNX 模型(约 263 MB)提供语音识别、语音活动检测和说话人嵌入能力:
- 状态检测: 自动检查模型文件是否完整
- 镜像选择: 下载时可选择 CDN 加速(推荐国内)、HF Mirror 镜像、GitHub 加速代理或 GitHub 直连
- 下载管理: 支持开始下载、查看进度和取消下载
- 重新下载: 即使模型已就绪,也可以强制重新下载以更新版本
视觉模型
DeepSeno 支持配置视觉模型(Vision LLM)来处理图片内容:
- 支持的模型: Qwen3.5-vision 等支持图像输入的模型
- 使用场景: 图片内容分析、文字识别(OCR)、视频关键帧分析
- 配置方式: 在云端 API 或本地 Ollama 中安装支持视觉的模型
- 视觉模型为可选功能,未配置时图片仅作为附件存储
云端 API 配置
除了本地 Ollama 模型,DeepSeno 还支持连接 OpenAI 兼容的云端 API:
- API 地址: 输入 OpenAI 兼容接口的 URL
- API 密钥: 输入对应的 API Key
- 连接测试: 点击测试按钮验证 API 是否可用
- 切换到云端模式后,Ollama 不再需要运行
- 云端 API 同样支持视觉模型,可用于图片分析
预置云服务商
| 服务商 | 推荐模型 | 说明 |
|---|---|---|
| 火山方舟 (Volcengine) | ark-code-latest | 官方推荐,支持 Doubao 系列 |
| DeepSeek | deepseek-chat | 高性价比 |
| 智谱 (GLM) | glm-4-flash | 国产大模型 |
| Kimi (月之暗面) | moonshot-v1-8k | 长上下文 |
| OpenAI | gpt-4o-mini | 国际服务 |
所有支持 OpenAI 兼容接口的服务商均可接入,只需填写 API 地址、API Key 和模型名称。
硬件信息与推荐
页面展示当前设备的硬件信息:
- 内存: 总物理内存容量
- CPU: 处理器核心数
- 平台: 操作系统和架构(macOS Apple Silicon / Windows x86_64 等)
- 推荐等级: 根据硬件自动评估为 basic(基础)、good(良好)或 excellent(优秀)
- 推荐模型: 基于硬件配置自动推荐最适合的 LLM 模型