CATEGORY

ローカル LLM

ローカル LLMの導入、設定、活用方法を実例とともに解説する記事一覧です。 全17件。

ChatGPT for Teensとllama.cpp公式更新

2026年8月18日に公開されたOpenAIのChatGPT for Teensとllama.cpp b10488を一次情報で確認し、保護機能とOpenVINO向け変更の影響、今日の対応、未検証範囲を整理します。

入門

OllamaのModelfileで設定を再利用する入門

OllamaのModelfileにベースモデル、system指示、生成parameterを記録し、ollama createとrunで同じ定義を呼び戻す手順を初心者向けに説明します。失敗時の切り分けと、タグだけに頼らない確認方法も整理します。

AI

Ollamaとllama.cppはどちらがおすすめ?用途別比較

Ollamaとllama.cppの違いを、導入、GGUF管理、API、詳細設定、速度検証の観点で比較。初心者、アプリ開発、ベンチマーク、Mac利用など用途別にどちらを選ぶべきかを解説します。

AI

ローカルLLMに必要なVRAMの計算方法|量子化別

ローカルLLMに必要なVRAMを、GGUFの重み、KVキャッシュ、計算バッファ、並列数、余裕容量へ分けて見積もる方法を解説。量子化別の理論値とllama.cppの確認コマンドも掲載します。

AI

llama.cppが遅い原因と高速化設定|確認順に解説

llama.cppが遅い原因を、ロード、プロンプト処理、トークン生成に分けて診断。GPUオフロード、メモリ、スレッド、batch、Flash Attention、KV cacheを安全な確認順で調整します。2026年8月2日時点の机上調査です。

AI

llama.cppでGGUFを動かす方法|導入から実行まで

llama.cppでGGUFモデルを動かす手順を、導入、モデル選択、固定リビジョンでのダウンロード、対話実行、API起動、ログ確認まで順番に解説します。2026年8月2日時点の公式情報に基づく机上調査です。

AI

GGUFモデルが読み込めない原因と対処法|エラー別

llama.cppでGGUFモデルを読み込めないときの確認順を、破損・分割ファイル・未対応アーキテクチャ・mmproj・メモリ不足などのエラー別に解説します。公式ソースに基づく机上調査です。

AI

Macのメモリ別・動かせるローカルLLM一覧

Apple Silicon Macのユニファイドメモリ容量別に、ローカルで試しやすいLLMの規模とGGUF量子化を整理。16GBから128GB超まで、モデル本体・KVキャッシュ・macOS用の余裕を含めた選び方を解説します。

AI

llama.cppコマンド例10選|llama-cli・llama-server用途別

llama.cppの実行コマンド例10選を2026年7月30日の公式情報で監査。ローカルGGUF、Hugging Face、CPU/GPU、長文脈、JSON、画像入力、複数GPU、OpenAI互換APIを用途別に解説します。検証は机上調査です。