KamoCRM

Qwen3 : 4b, 16 코어에 IBM 화강암 4.0 H-Tiny을 실행

FeatureKlusterServices
관련 상품
2026년 9월 28일 오전 4:36 UTC
이름 *
Kamo
뚱 베어
8f24b41

소유자는 k3m1의 실질적으로 더 나은 실행 로컬 모델에 대해 물었다 AVX2 전용 Xeons (2026-09-27, ruling SP01-LLM-granite4). Granite4:tiny h는 입니다 잡종 Mamba-2/transformer MoE (7B 합계, ~1B 활동): 몇몇 시간 qwen3:4b's CPU, 네이티브 도구 호출 및 생각 패스에 신속하고 응답 속도. - postStart 잡아당기기 화강암4:tiny-h; - CPU 제한 8 -> 16 (LLAMA ARG THREADS는 다음과 같습니다), 요청 2 -> 4; - OLLAMA CONTEXT LENGTH 8192 -> 16384 (시약 단계는 3-5k 토큰을 실행); - OLLAMA FLASH ATTENTION=1. 기억은 8Gi를 유지합니다.

모든 변경 사항

배송을 보는 것과 같이?

모든 것이 자신의 작업 공간에서 도착합니다. 무료 플랜을 시작하고 이 페이지를 다시 한 달에 읽으십시오.

무료 영원히 시작가격 비교