本文へスキップ
株式会社オブライト
AI Model2026-05-17

Qwen(Alibaba)

別名: Qwen (Alibaba) / Alibaba Qwen / Qwen3

Alibaba Cloud が開発するオープンウェイト LLM シリーズ。Qwen 3.5・3.6 世代はエージェントコーディングで Claude Opus 超えのスコアを記録し、日本語性能も高い。


概要

Qwen 3.6-27B Dense は RTX 3090 で 40 tok/s を実現し、エージェントコーディングの最前線に位置する。社内 AI 構築コスト削減の観点でも注目されている。詳細は Qwen 3.6-27B リリース解説 を参照。

モデルバリエーション

Qwen3.5-9B(SLM)・27B Dense・35B-A3B MoE・72B など多様なサイズを提供。Ollama 対応で Mac mini を含む一般ハードウェアで動作可能。

関連コラム

AI
Qwen 3.6-27B リリース解説 — Dense 27B でエージェントコーディング最先端、RTX 3090 で 40 tok/s【2026年4月版】
Alibaba Qwen Team が 2026年4月22日に公開した Qwen 3.6-27B Dense モデルの概要解説。SWE-bench Verified 77.2、Terminal-Bench 2.0 で 59.3(Claude 4.5 Opus と並ぶ)、262K-1M コンテキスト、Apache 2.0 ライセンス、RTX 3090 で 40 tok/s(Q4_K_M)など、公式情報と公開ベンチマークを整理。
AI
Qwen3.5-9B完全ガイド|Ollamaで5GBから動く次世代SLMの特徴・性能・活用法
Alibaba Qwenチームが2026年3月に公開したQwen3.5-9Bを徹底解説。Ollamaでの導入手順、Gated DeltaNet+Sparse MoEハイブリッドアーキテクチャ、262Kコンテキスト、GPQA 81.7・IFBench 76.5(GPT-5.2の75.4を超越)のベンチマーク性能、GPT-4o-mini・Claude Haikuとの比較、中小企業向け活用法まで網羅。わずか5GB RAMで動作する次世代SLMの全貌。
AI
Gemma 4 vs Llama 4 vs Qwen 3.5徹底比較 — 2026年ローカルLLM選定ガイド
Gemma 4、Llama 4、Qwen 3.5の3大ローカルLLMを徹底比較。ベンチマーク性能、ライセンス、日本語対応、ハードウェア要件、ユースケース別の選定基準を詳しく解説します。
Mobile Development
[React Native ExecuTorch の `useLLM` フック](https://docs.swmansion.com/react-native-executorch/docs/hooks/natural-language-processing/useLLM) 徹底解説 — Qwen / Llama 3.2 / Hammer 2.1 / Phi 4 Mini / SmolLM 2 / LFM2.5 / Gemma 4 をオンデバイスで走らせる React Native 用フック、ツール呼び出し・ビジョン / オーディオ・構造化出力対応 Software Mansion 提供、Managed / Functional の 2 モード、Zod スキーマ検証込み
**Software Mansion 提供の [React Native ExecuTorch](https://docs.swmansion.com/react-native-executorch/) が `useLLM` フックを公開**、React Native アプリに **オンデバイス LLM をネイティブに統合**。**対応モデル**: Qwen (2.5 / 3 / 3.5)・Llama 3.2・Hammer 2.1・Phi 4 Mini・SmolLM 2・LFM2.5(ビジョン対応)・**[Gemma 4](../columns/gemma-4-technical-report-2026-07)(ビジョン + オーディオ対応)** の量子化版。**2 つの動作モード**: **Functional/Stateless**(`generate()` メソッドと `response` プロパティで conversation history を自前管理、tool calling とチャット設定は無効)と **Managed/Stateful**(`sendMessage()` でフックが自動的に conversation state 保持・tool call parse・callback 実行)。**キー機能**: token batching(トークンをバッチ化して re-render 削減)、tool calling(tool schema 定義でモデルが外部関数を invoke、自動 parse + callback 実行)、vision-language / audio マルチモーダル入力、生成コントロール(temperature / top-p / repetition penalty / mid-stream 中断)、**JSONSchema または Zod による構造化出力**。**用途**: サーバー依存のないオンデバイスチャットボット、プライバシー重視の会話 UI、カレンダー / フラッシュライト等のアプリ内 function calling、画像解析 / 音声書き起こし。**位置付け**: [Gemma 4 の encoder-free 12B](../columns/gemma-4-technical-report-2026-07) と [Qwen 3.6-35B](../columns/qwen36-35b-a3b-uncensored-abliterated-2026-07) のような最新 open-weight LLM が **iOS / Android アプリでネイティブに動く時代の入り口** を実装レベルで示す React Native 界隈の重要成果。
AI
Gemma 4 性能徹底比較 — Llama 4 / Qwen / Mistral / DeepSeek とベンチマーク・速度・コスパで比べた【2026年版 オープンウェイトLLM決定版】
Gemma 4(E2B / E4B / 26B MoE / 31B Dense)の性能を、同じくオープンウェイトの Llama 4 / Qwen 3.5 / Mistral / DeepSeek と公開ベンチマーク(MMLU-Pro / GPQA / HumanEval / MATH-500 / MT-Bench)で比較。さらに推論速度(tok/s)、メモリ効率(VRAM あたりの精度)、コスト効率(1M トークンあたりの円換算)、日本語性能、function calling 対応、Apache 2.0 / MIT / 商用利用条件まで2026年5月時点の最新情報で整理しました。社内 LLM・エッジ AI・コーディングアシスタント・RAG 用途別の推奨選定マトリクス付き。

関連用語

お気軽にご相談ください

お問い合わせ