NVIDIA GeForce RTX 3060
显存使用
90%
VRAM
10.8 / 12 GB
剩余 1.2 GB
GPU 利用率
0%
空闲等待中
温度
55°C
P8 节能模式
功耗
17 / 170W
风扇 0%
CPU 使用率
12%
内存使用
64 / 126 GB
模型服务概览
点击卡片进入模型管理
SenseVoice
语音识别 · :8001
CosyVoice
语音合成 · :8002
Wan2.1
文生视频 · :8003
Ollama
大模型 · :11434
快速操作
调度建议
显存已用 90%,建议将 Wan2.1 设为按需启动,或在不使用视频生成时手动停止以释放 ~7GB 显存。
最近调度记录
11:12启动
SenseVoice 容器已启动,端口 8001
11:10调度
显存超过阈值 85%,自动停止 Ollama
11:05启动
Wan2.1 容器已启动,端口 8003
10:58警告
GPU 温度达到 68°C,触发降频
10:45停止
CosyVoice 空闲超时 15 分钟,自动停止
10:30调度
调度器启动,加载 4 个模型规则
SenseVoice 运行中
多语言语音识别 · 支持中/英/日/韩/粤
端口
:8001
显存
~1.0 GB
运行时长
38 分
CosyVoice 运行中
零样本声音克隆 · 语音合成
端口
:8002
显存
~2.5 GB
运行时长
38 分
Wan2.1 运行中
文本生成视频 · 480P/720P
端口
:8003
显存
~7.0 GB
运行时长
47 分
Ollama 已停止
大语言模型 · LLM 推理
端口
:11434
显存
~4.0 GB
运行时长
—
GPU 实时监控
显存与利用率趋势 · 每 5 秒刷新
实时
显存使用率 (90%)
GPU 利用率 (0%)
全局调度规则
85%
3 个
30 秒
当前状态:显存 90% 已超阈值,调度器将按优先级停止低优先级模型
调度日志
11:12:05INFO
SenseVoice 健康检查通过
11:11:30WARN
显存 90% 超过阈值 85%
11:10:00SCHED
自动停止 Ollama (优先级 3,按需模式)
11:05:22INFO
Wan2.1 启动完成,显存占用 7.0GB
11:00:00SCHED
调度周期检查:4 个模型,3 个运行中
10:58:14WARN
GPU 温度 68°C,触发降频保护
10:45:00SCHED
CosyVoice 空闲超时,自动停止
10:30:00INFO
调度器启动,加载配置完成
模型调度规则
优先级 1=最高,5=最低;显存不足时按优先级从低到高停止
SenseVoice
空闲超时
分
CosyVoice
空闲超时
分
Wan2.1
空闲超时
分
Ollama
空闲超时
分
识别参数
音频输入
00:00
点击开始录制
或
点击上传或拖拽音频文件到此处
支持 WAV、MP3、M4A、FLAC、OGG、WebM
识别结果
示例结果
大家好,欢迎使用 ConOrg AI 控制台。今天是 2026 年 9 月 3 日,我们将演示 SenseVoice 多语言语音识别功能。该模型支持中文、英文、日语、韩语和粤语的识别,识别准确率达到 98% 以上。
合成文本
😄 笑声
💨 呼吸
💪 强调
⏸️ 长停顿
合成参数
中
1.0x
1.0x
参考音频(声音克隆)
点击上传或拖拽参考音频到此处
建议 3-10 秒清晰人声
reference_voice.wav
1.2 MB · 5.2s
合成结果
示例
音频播放器(静态演示)
提示词
🐱 橘猫打哈欠
🌊 海浪夕阳
🌃 城市夜景
🌸 樱花少女
生成参数
30
5.0
正在生成视频,请耐心等待...(静态演示)
已用时:2分34秒 · 预计剩余 1分20秒
生成结果
示例AI 对话
Open WebUI 对话界面将在此处内嵌。当前为静态演示版本,连接真实服务后将显示完整的对话界面。