KamoCRM

Cap llama-servidor rápido caché debajo del límite de memoria, por lo que deja de ser OOMKilled

FixKlusterServices
Se descapó
28 de septiembre de 2026 a las 14:09 UTC
Autor
Kamo
Compromit
f4d979d

el caché de emergencia host-RAM de llama predeterminado a 8192 MiB (--cache-ram), el El límite total del contenedor, así que creció hasta que el núcleo mató ollama: en 2026-09-28 tuvo 14 avisos en 3 548 MiB sobre un modelo ~4.4 GiB y el 15o Ahorro fue OOMKilled (8 reiniciados en 9,5 h, 502 a cada llamada en vuelo). LLAMA ARG CACHE RAM =1024 mantiene alrededor de cuatro indicaciones (parte de pasos urgentes ~340 tokens of prefix, so nothing is lost); LLAMA ARG CTX CHECKPOINTS=8 bounds the per-slot checkpoints (2-3 per prompt at ~55 MiB) that the default 32 left at 1.7 GiB. Ollama comienza llama-servidor sin bandera, y el env lo alcanza.

Todos los cambios

Como lo que ves enviaste?

Todo llega a su espacio de trabajo por sí solo. Comience en el plan gratuito y lea esta página de nuevo en un mes.

Arranzar gratis para siempreVer Precios