Ollama 没有运行

打开“设置 → 本地模型”检查运行时状态,并使用启动服务。如果仍失败,请打开日志并确认模型确实已经安装。

“failed to allocate buffer / kv cache”

这通常表示模型或 context 对当前 RAM/VRAM 来说过大。OrvixCode 可以自动降低 context 后重试,并按模型记住可工作的安全值。

自动 context 阶梯
8192 → 6144 → 4096 → 3072 → 2048

如果模型本身无法装入内存,就需要选择更小模型。关闭其他占用大量内存的程序也可能有帮助。

CUDA / GPU 错误

检测到 GPU、CUDA 或本地 runner 故障时,OrvixCode 可使用安全 CPU 模式重试。之后可在“本地模型”中使用重新尝试 GPU恢复 GPU 尝试。

本地模型非常慢

  • 尝试更小的模型。
  • 查看模型卡片上的 RAM/VRAM 建议。
  • 关闭其他占用大量内存的应用。
  • 如果有兼容 GPU,确认 GPU 重试已启用。