Gemma 3n E2BとE4Bの端末別選び方
Gemma 3n E2B ITとE4B ITを、2GB/3GBの公式memory目安、32K context、画像・音声入力、Google公表品質から選ぶガイドです。速度未測定の範囲も分けて判断できます。
ARTICLE ARCHIVE
ローカルAI、GPU、LLM、Dockerの実践記事を新しい順にまとめています。
Gemma 3n E2B ITとE4B ITを、2GB/3GBの公式memory目安、32K context、画像・音声入力、Google公表品質から選ぶガイドです。速度未測定の範囲も分けて判断できます。
Gemma 3n E2B ITとE4B ITのGoogle公表benchmarkを、variant、metric、n-shot、full precision、2GB/3GB memory、32K contextに固定し、小型端末へ適用できる範囲と未測定の速度を整理します。
2026年8月26日公開のvLLM 0.28.0を公式releaseで確認し、Kimi-K3・DeepSeek V4・ROCm対応、KV offload、互換性変更、更新前に固定すべき条件を整理します。
gpt-oss-20bと120bを、16GB memory、Apple Silicon、H100 80GB、Windowsで選ぶガイドです。MXFP4の公式容量目安、128K context、現行runtime、未測定範囲を分けて判断できます。
gpt-oss-20bと120bのMXFP4 weight、128K context、Harmony、Metal・vLLM・ONNX Runtimeを固定し、16GB、H100 80GB、Windowsへの適用範囲と未測定のpeak memory・速度を比較します。
2026年8月25日の公式更新から、JalapeñoのGPT-OSS 120B推論測定とllama.cpp 0.3.0のモデル・Metal・分散実行変更を、条件、機器への影響、今日の判断に分けて整理します。