KamoCRM

运行 lama- 服务器, 其CPU 限制每个核心有一个线程

FixKlusterServices
已装运
2026年9月28日 02:35 UTC
作者
Kamo
提交
6186ce6

Ollama 启动 lama- server 没有 -- 线索, 所以它算 K3m1 的 24 物理 核心和运行 24计算线 在容器的8个核心配额。 这个 集装箱被拖了两倍于运行时间(16 560个被拖倒) 使用8 405 s),提示以~25个符号/s和~3的答案进行. 在AIService的120 s的一次尝试中,3个600克的代理步骤无法完成. LLAMA ARG THREADS 由 lama- server 读取(并设置批量线); 下行的API将其与极限相联. cpu 使得两者不能相去甚远.

所有更改

就像你看到的运输?

所有东西都是靠自己运入你的工作空间的 从免费计划开始,一个月后再读这页.

永远开始自由查看定价