KamoCRM

Cap llama-server haraka cache chini ya kikomo cha kumbukumbu, hivyo kuacha kuwa OOMKilled

FixKlusterServices
Ya
28 Septemba 2026, 14:09 UTC
Mwandishi
Kamo
Ahadi ya
f4d979d

llama-server's mwenyeji-RAM haraka cache defaults kwa 8192 MiB (--cache-ram), Kikomo cha chombo chote, kwa hivyo kilikua hadi kernel ilipoua ollama: kwenye 2026-09-28 ilikuwa na hatua 14 katika 3 548 MiB kwenye mfano wa ~ 4.4 GiB na 15th. Kuokoa ilikuwa OOMKilled (8 kuanzisha upya katika 9.5 h, 502 kwa kila wito katika ndege). LLAMA ARG CACHE RAM = 1024 inaweka karibu hatua nne (hatua za haraka ~ 340 Ishara za prefix, kwa hivyo hakuna kitu kinachopotea; LLAMA ARG CTX CHECK Points = 8 inafungwa per-slot checkpoints (2-3 kwa haraka katika ~ 55 MiB) kwamba default 32 kushoto katika 1.7 GiB. Ollama alianza llama-server bila bendera, na env inakaribia.

Mabadiliko yote

Je, unaona nini kuhusu usafiri?

Kila kitu kinaingia kwenye tovuti yako mwenyewe. Anza kwenye mpango wa bure na usome ukurasa huu tena katika mwezi mmoja.

Kuwa Huru MileleMtazamo wa bei