- 관련 상품
- 2026년 9월 28일 오전 2:35 UTC
- 이름 *
- Kamo
- 뚱 베어
- 6186ce6
Ollama는 --threads없이 llama-server를 시작합니다. 그래서 k3m1의 24 물리적 인 계산 코어와 ran 24 compute 스레드 컨테이너의 8 코어 할당. 더 보기 컨테이너는 실행 (16 560 s throttled로 긴 throttled로 두 번 보냈습니다. 8 405 s 사용), 신속한 ~25 토큰 / s 및 답변 ~3, 및 3 600-token 에이전트 단계는 시도 당 AIService의 120 s 내부에 완료 할 수 없습니다. LLAMA ARG THREADS는 llama-server에 의해 읽습니다 (그리고 일괄 스레드를 설정); Downward API는 limits.cpu에 그것을 묶습니다 그래서 두는 drift apart 할 수 없습니다.
