ARTICLE ARCHIVE

記事一覧

ローカルAI、GPU、LLM、Dockerの実践記事を新しい順にまとめています。

AI

DGX Spark 8台でGLM-5.2|ピーク66 tok/sを検証

8台のDGX Sparkで753B級GLM-5.2を動かし、v18でprefill 1,329 tok/s、平均decode 35〜42 tok/s、ピーク66 tok/sを記録した公開例を、条件と注意点まで検証します。

AI

DwarfStarで45 TPS?DeepSeek V4 Flashの128GB推論

DwarfStarでDeepSeek-V4-Flashを128GB環境・45 TPSで動かし、Huihuiのabliterated版へ差し替えたX投稿を検証。1M文脈、KVキャッシュ、2bit量子化の注意点を解説します。

AI

DGX Spark 2〜4台実例|DeepSeek V4・GLM-5.2

DGX Sparkを2〜4台接続し、DeepSeek-V4-Flash、GLM-5.2、MiniMax M3を動かした公開実例を調査。量子化、文脈長、tokens/s、構成、再現上の注意点を比較します。