KamoCRM

Qwen3の代わりにIBMの花こう岩4.0 H-Tinyを実行します:4b、16コアで

FeatureKlusterServices
出荷済み
2026年9月28日 4:36 UTC
プロフィール
Kamo
コンテンツ
8f24b41

オーナーはk3m1の上で大幅に改善されたローカルモデルを要求しました AVX2-only Xeons (2026-09-27, ruling SP01-LLM-granite4). granite4:tiny-hは 雑種Mamba-2/transformer MoE (7B合計、~1B活動的):数回qwen3:4bの CPU、ネイティブツールの呼び出し、および思考パスのスピードを迅速かつ応答します。 - postStart は granite4:tiny-h を引っ張ります; - CPUの限界8 → 16 (LLAMA ARG THREADSはそれに従います)、要求2 → 4; - OLLAMA CONTEXT LENGTH 8192 → 16384 (エージェントのステップは3-5kトークンを実行します)。 - OLLAMA FLASH ATTENTION=1. 記憶は8Giにとどまります.

すべての変更

配送を見るのが好きですか?

自分のワークスペースに到着します。 無料プランをスタートし、月に再度このページをお読みください.

永遠に無料で始める料金を見る