本文へスキップ
株式会社オブライト
サービス
私たちについて
会社概要
コラム
用語集
料金
無料ツール
お問い合わせ
English
English
メニューを開く
コラム
推論最適化
「推論最適化」のコラム
2件の記事
AI
2026-08-24
oMLXとは?Apple Silicon向けローカルLLM推論サーバを解説
oMLXはApple Silicon Mac専用のオープンソースLLM推論サーバ。階層KVキャッシュ(RAM+SSD)と連続バッチングで複数リクエストを効率処理し、メニューバー常駐のmacOSアプリから管理できる。2026年8月時点でGitHub Trending週間上位・スター約2万。機能・要件・使い方・Ollama等との違いを解説。
ローカルLLM
Apple Silicon
推論最適化
AI
2026-03-17
Rakuten AI 3.0をHugging Faceからデプロイする実践ガイド
楽天の最新LLM「Rakuten AI 3.0」をHugging Faceからダウンロードし、vLLMやTGIで推論環境を構築する手順を詳解。MoEモデル特有のGPUメモリ要件、量子化による軽量化、APIサーバー構築、本番運用のベストプラクティスまで実践的に解説します。
Rakuten AI 3.0
Hugging Face
デプロイ