本文へスキップ
株式会社オブライト
AI Model2026-05-17

Llama(Meta)

別名: Llama (Meta) / Llama 4 / Meta Llama

Meta がオープンウェイトで公開する大規模言語モデルファミリー。Llama 4 世代は MoE 設計を採用し、商用利用可能なライセンスでローカル実行やファインチューニングが広く行われている。


概要

Llama 4 は MoE(Mixture-of-Experts)設計により効率的な推論を実現。Gemma 4・Qwen 3.5 と並ぶローカル LLM の主要選択肢で、Ollama 経由で手軽に実行できる。比較は Gemma 4 vs Llama 4 vs Qwen 3.5 比較 を参照。

エコシステム

Meta AI プラットフォーム・Ray・vLLM など多数のフレームワークが対応しており、エンタープライズのオンプレミス AI 導入において最もシェアが高いオープンモデルの一つ。

関連コラム

AI
Gemma 4 vs Llama 4 vs Qwen 3.5徹底比較 — 2026年ローカルLLM選定ガイド
Gemma 4、Llama 4、Qwen 3.5の3大ローカルLLMを徹底比較。ベンチマーク性能、ライセンス、日本語対応、ハードウェア要件、ユースケース別の選定基準を詳しく解説します。
AI
2026年4月ローカルLLM最新全体像 — 主要10モデル完全比較ガイド【Ollama対応表付き】
2026年4月時点の主要ローカルLLM10モデルを徹底比較。SWE-benchスコア・日本語性能・VRAM要件・Ollamaコマンド・ライセンスを一覧化。Gemma 4、Llama 4、Qwen 3.5、GLM-5.1、Kimi K2.5、MiniMax M2.5など最新モデルを網羅したガイド。
AI
Claude代替ローカルLLM総合比較2026 — Qwen 3.5・Mistral Small 4・DeepSeek R1・Gemma 4を徹底検証
Anthropic Claude制限変更を受け、Qwen 3.5-9B、Mistral Small 4、DeepSeek R1、Gemma 4、Llama 4などのローカルLLMを徹底比較。日本語性能、ハードウェア要件、用途別おすすめモデルを詳細解説します。
Mobile Development
[React Native ExecuTorch の `useLLM` フック](https://docs.swmansion.com/react-native-executorch/docs/hooks/natural-language-processing/useLLM) 徹底解説 — Qwen / Llama 3.2 / Hammer 2.1 / Phi 4 Mini / SmolLM 2 / LFM2.5 / Gemma 4 をオンデバイスで走らせる React Native 用フック、ツール呼び出し・ビジョン / オーディオ・構造化出力対応 Software Mansion 提供、Managed / Functional の 2 モード、Zod スキーマ検証込み
**Software Mansion 提供の [React Native ExecuTorch](https://docs.swmansion.com/react-native-executorch/) が `useLLM` フックを公開**、React Native アプリに **オンデバイス LLM をネイティブに統合**。**対応モデル**: Qwen (2.5 / 3 / 3.5)・Llama 3.2・Hammer 2.1・Phi 4 Mini・SmolLM 2・LFM2.5(ビジョン対応)・**[Gemma 4](../columns/gemma-4-technical-report-2026-07)(ビジョン + オーディオ対応)** の量子化版。**2 つの動作モード**: **Functional/Stateless**(`generate()` メソッドと `response` プロパティで conversation history を自前管理、tool calling とチャット設定は無効)と **Managed/Stateful**(`sendMessage()` でフックが自動的に conversation state 保持・tool call parse・callback 実行)。**キー機能**: token batching(トークンをバッチ化して re-render 削減)、tool calling(tool schema 定義でモデルが外部関数を invoke、自動 parse + callback 実行)、vision-language / audio マルチモーダル入力、生成コントロール(temperature / top-p / repetition penalty / mid-stream 中断)、**JSONSchema または Zod による構造化出力**。**用途**: サーバー依存のないオンデバイスチャットボット、プライバシー重視の会話 UI、カレンダー / フラッシュライト等のアプリ内 function calling、画像解析 / 音声書き起こし。**位置付け**: [Gemma 4 の encoder-free 12B](../columns/gemma-4-technical-report-2026-07) と [Qwen 3.6-35B](../columns/qwen36-35b-a3b-uncensored-abliterated-2026-07) のような最新 open-weight LLM が **iOS / Android アプリでネイティブに動く時代の入り口** を実装レベルで示す React Native 界隈の重要成果。
AI
Gemma 4 性能徹底比較 — Llama 4 / Qwen / Mistral / DeepSeek とベンチマーク・速度・コスパで比べた【2026年版 オープンウェイトLLM決定版】
Gemma 4(E2B / E4B / 26B MoE / 31B Dense)の性能を、同じくオープンウェイトの Llama 4 / Qwen 3.5 / Mistral / DeepSeek と公開ベンチマーク(MMLU-Pro / GPQA / HumanEval / MATH-500 / MT-Bench)で比較。さらに推論速度(tok/s)、メモリ効率(VRAM あたりの精度)、コスト効率(1M トークンあたりの円換算)、日本語性能、function calling 対応、Apache 2.0 / MIT / 商用利用条件まで2026年5月時点の最新情報で整理しました。社内 LLM・エッジ AI・コーディングアシスタント・RAG 用途別の推奨選定マトリクス付き。

関連用語

お気軽にご相談ください

お問い合わせ