Ollama 没有运行
打开“设置 → 本地模型”检查运行时状态,并使用启动服务。如果仍失败,请打开日志并确认模型确实已经安装。
“failed to allocate buffer / kv cache”
这通常表示模型或 context 对当前 RAM/VRAM 来说过大。OrvixCode 可以自动降低 context 后重试,并按模型记住可工作的安全值。
8192 → 6144 → 4096 → 3072 → 2048
如果模型本身无法装入内存,就需要选择更小模型。关闭其他占用大量内存的程序也可能有帮助。
CUDA / GPU 错误
检测到 GPU、CUDA 或本地 runner 故障时,OrvixCode 可使用安全 CPU 模式重试。之后可在“本地模型”中使用重新尝试 GPU恢复 GPU 尝试。
本地模型非常慢
- 尝试更小的模型。
- 查看模型卡片上的 RAM/VRAM 建议。
- 关闭其他占用大量内存的应用。
- 如果有兼容 GPU,确认 GPU 重试已启用。