ARTICLE ARCHIVE

記事一覧

ローカルAI、GPU、LLM、Dockerの実践記事を新しい順にまとめています。

入門

Gemma 3n E2BとE4Bの端末別選び方

Gemma 3n E2B ITとE4B ITを、2GB/3GBの公式memory目安、32K context、画像・音声入力、Google公表品質から選ぶガイドです。速度未測定の範囲も分けて判断できます。

Gemma 3n E2B・E4B公式品質比較

Gemma 3n E2B ITとE4B ITのGoogle公表benchmarkを、variant、metric、n-shot、full precision、2GB/3GB memory、32K contextに固定し、小型端末へ適用できる範囲と未測定の速度を整理します。

入門

gpt-oss 20bと120bの機器別選び方

gpt-oss-20bと120bを、16GB memory、Apple Silicon、H100 80GB、Windowsで選ぶガイドです。MXFP4の公式容量目安、128K context、現行runtime、未測定範囲を分けて判断できます。

Jalapeño推論性能とllama.cpp 0.3.0

2026年8月25日の公式更新から、JalapeñoのGPT-OSS 120B推論測定とllama.cpp 0.3.0のモデル・Metal・分散実行変更を、条件、機器への影響、今日の判断に分けて整理します。