#ローカルLLM
6件の記事
Meta Muse Glimmer 30B完全解説|ローカルGPUで動くAIエージェントの実力と限界
2026年8月10日リリース。RTX 4090一枚で動くオープンウェイト30Bエージェントモデル。Apache 2.0ライセンス、商用利用可。ベンチマーク、動作要件、限界を整理する。
Anthropicがオープンウェイト禁止を否定|Amodei 3提案と残る穴
Anthropicが「オープンウェイト禁止は求めていない」と公式表明。Amodeiの3提案と残る穴、Hacker Newsの冷めた反応、ローカルLLM実務への影響を2026年7月27日時点で整理した。
Google DiffusionGemma完全ガイド|4倍速テキスト生成の仕組みと限界【2026年6月】
Googleが6月10日にApache 2.0で公開した拡散ベースLLM。H100で1100トークン/秒、18GB VRAMで動作。Gemma 4より4倍速いが品質は劣る。仕組みと使いどころを整理。
Google Gemma 4完全ガイド|全4モデルの性能・実行環境を徹底比較【2026年4月】
Gemma 4の全4モデルの性能・VRAM要件を比較。Apache 2.0で商用無制限、Llama 4・Qwen 3.5との違いやOllamaでの実行方法も解説。
Google TurboQuant完全解説|LLMを6倍圧縮・8倍高速化する新アルゴリズム
Googleが2026年3月発表のTurboQuantを解説。KVキャッシュを3ビットに圧縮しメモリ6分の1・推論8倍速を精度劣化なしで実現。ローカルLLMやAPI利用コストへの影響も検証。
Meta Llama 4完全解説|10Mトークン・MoE革新と開発者が語る光と影
Meta Llama 4(Scout/Maverick)の仕組み・ベンチマーク・料金・ローカル実行要件を徹底解説。ベンチマーク論争やコーディング性能の実態、API無料利用まで日本語で詳説。