Llama 4 Scout・MaverickのH100選び
Llama 4 ScoutとMaverickを、正確なmodel ID、109B/400B total、10M/1M context、Int4/BF16/FP8、H100構成、画像入力、Community Licenseから選ぶ実用ガイドです。
ARTICLE ARCHIVE
ローカルAI、GPU、LLM、Dockerの実践記事を新しい順にまとめています。
Llama 4 ScoutとMaverickを、正確なmodel ID、109B/400B total、10M/1M context、Int4/BF16/FP8、H100構成、画像入力、Community Licenseから選ぶ実用ガイドです。
Llama 4 ScoutとMaverickを、static model revision、109B/400B total、Int4/BF16/FP8、H100 80GB/DGX host、10M/1M context、vLLM/Transformers条件へ固定し、未測定の性能と機器適性を分けます。
NVIDIAが2026年8月28日に公開したTensorRT Model Connectを一次情報で確認し、checkpointからC++推論へ移す手順、対応環境、preview上の制限、今日の検証判断を整理します。
Mistral Small 4のAPI、BF16、NVFP4、EAGLEを、119B、256K context、公式artifact容量、H100/H200/B200要件から選ぶ実用ガイドです。未測定の速度とpeak memoryも分けます。
Mistral Small 4のBF16、NVFP4、EAGLEを、2026年7月15日revision、artifact容量、vLLM・SGLang・NIM、H100/H200/B200条件へ固定し、測定済み範囲と未測定結果を比較します。
2026年8月26日公開のOllama 0.33.1とTransformers 5.16.1を公式releaseで確認し、Qwen3.8 Flash Next、GLM-5.3-Flash、互換性修正の対象と更新判断を整理します。