- 已装运
- 2026年9月28日 02:35 UTC
- 作者
- Kamo
- 提交
- 6186ce6
Ollama 启动 lama- server 没有 -- 线索, 所以它算 K3m1 的 24 物理 核心和运行 24计算线 在容器的8个核心配额。 这个 集装箱被拖了两倍于运行时间(16 560个被拖倒) 使用8 405 s),提示以~25个符号/s和~3的答案进行. 在AIService的120 s的一次尝试中,3个600克的代理步骤无法完成. LLAMA ARG THREADS 由 lama- server 读取(并设置批量线); 下行的API将其与极限相联. cpu 使得两者不能相去甚远.
