データが社外に出ない
規程、見積り、顧客とのやりとり。クラウドの利用規約を読まなくても、PCの中で完結すれば持ち出しの議論そのものが要りません。
ローカルLLMが動くかどうかは、CPUでもメモリでもなく、GPUに載っているVRAMの容量で決まります。動かしたいモデルのパラメータ数と量子化から必要なVRAMが出て、そこから構成が決まる。この順番を守れば、買い直しは起きません。
規程、見積り、顧客とのやりとり。クラウドの利用規約を読まなくても、PCの中で完結すれば持ち出しの議論そのものが要りません。
APIは使った分だけ増えます。ローカルは電気代だけ。部署で毎日回すなら、数か月で本体代を回収する計算になります。
手元のGPUで応答するので、混雑も上限もありません。社内RAGのように何度も往復する使い方ほど差が出ます。



ソフトはいずれも無料。当店はハードウェアの構成と組み立てを担当し、ソフトの初期導入はご相談のうえ対応範囲を決めます。
同じモデルでも、量子化(Q4/Q8)で必要なVRAMは倍近く変わります。用途に対して「何Bを、どの量子化で」を決めると、必要なGPUが1行で決まります。
| モデル | パラメータ | Q4_K_M | Q8_0 | F16 | 向いている用途 | 1枚で動くVRAM |
|---|---|---|---|---|---|---|
| Qwen3 0.6B | 0.6B | 0.5GB | 0.9GB | 1.3GB | 動作確認・組み込み | どのGPUでも |
| Qwen3 1.7B | 1.7B | 1.1GB | 1.9GB | 3.4GB | 分類・簡単な下書き | どのGPUでも |
| Qwen3 4B | 4B | 2.5GB | 4.6GB | 8GB | 要約・メール下書き・定型文 | 8GB〜 |
| Qwen3 8B | 8B | 4.6GB | 8.5GB | 16.1GB | 社内RAG・議事録・日本語チャット | 12GB(Q8まで) |
| Qwen3 14B | 14B | 8.3GB | 15.7GB | 28GB | RAGの精度重視・コード補助 | 12GB(Q4)/16GB(Q8) |
| Qwen3 30B-A3B | 30B(動作3B) | 16.8GB | 31.6GB | 60GB | 高速な推論。MoE型 | 24GB(Q4)/32GB(Q8) |
| Qwen3 32B | 32B | 19.1GB | 36.1GB | 64.4GB | コード生成・高精度の推論 | 24GB(Q4)/32GB(Q6) |
| Qwen3 235B-A22B | 235B(動作22B) | 131.9GB | 249GB | 470GB | 研究用途 | サーバー級(対象外) |
数値は WillItRunAI「Qwen 3 GPU Requirements」の量子化別モデルサイズ。実際にはコンテキスト長ぶんのKVキャッシュと実行時のオーバーヘッドで1〜2GB上乗せして見てください。「1枚で動くVRAM」はその上乗せ込みの当店の目安です。


縦がGPU(VRAM)、横がCPU。動くかどうかはVRAMで決まるので、CPUは左の安いほうで足りることが多いです。行頭に「そのVRAMで動くモデル」を添えています。価格はパーツ合計から出した例示で、1年保証込み。実際の構成はご相談のうえ、在庫と用途に合わせて決めます。
| GPU構成 ↓CPU → | Ryzen 5 7600AMD・6コア | Core i5-14400FIntel・10コア | Ryzen 7 9700XAMD・8コア | Core i7-14700FIntel・20コア |
|---|---|---|---|---|
| 12GBVRAMRTX 3060 12GBQwen3 14B(Q4) | LLM-36/R5¥190,060〜DDR5 32GB / 650W | LLM-36/I5¥193,670〜DDR5 32GB / 650W | LLM-36/R7¥211,810〜DDR5 32GB / 650W | LLM-36/I7¥228,470〜DDR5 32GB / 650W |
| 12GBVRAMRTX 4070 12GBQwen3 14B(Q5) | LLM-47/R5¥265,460〜DDR5 32GB / 650W | LLM-47/I5¥269,070〜DDR5 32GB / 650W | LLM-47/R7¥287,210〜DDR5 32GB / 650W | LLM-47/I7¥303,870〜DDR5 32GB / 650W |
| 16GBVRAMRTX 4060 Ti 16GBQwen3 14B(Q6〜Q8) | LLM-46T/R5¥285,760〜DDR5 32GB / 650W | LLM-46T/I5¥289,370〜DDR5 32GB / 650W | LLM-46T/R7¥307,510〜DDR5 32GB / 650W | LLM-46T/I7¥324,170〜DDR5 32GB / 650W |
| 16GBVRAMRTX 4070 Ti SUPER 16GBQwen3 14B(Q8) | LLM-47TS/R5¥356,810〜DDR5 32GB / 650W | LLM-47TS/I5¥360,420〜DDR5 32GB / 650W | LLM-47TS/R7¥378,560〜DDR5 32GB / 650W | LLM-47TS/I7¥397,720〜DDR5 32GB / 850W |
| 16GBVRAMRTX 5070 Ti 16GBQwen3 14B(Q8) | LLM-57T/R5¥387,260〜DDR5 32GB / 650W | LLM-57T/I5¥393,080〜DDR5 32GB / 750W | LLM-57T/R7¥409,010〜DDR5 32GB / 650W | LLM-57T/I7¥428,170〜DDR5 32GB / 850W |
| 16GBVRAMRTX 4080 16GBQwen3 14B(Q8) | LLM-48/R5¥375,660〜DDR5 32GB / 650W | LLM-48/I5¥381,480〜DDR5 32GB / 750W | LLM-48/R7¥397,410〜DDR5 32GB / 650W | LLM-48/I7¥416,570〜DDR5 32GB / 850W |
| 24GBVRAMRTX 3060 12GB ×2Qwen3 32B/30B-A3B(Q4) | LLM-36D/R5¥299,970〜DDR5 64GB / 650W | LLM-36D/I5¥305,790〜DDR5 64GB / 750W | LLM-36D/R7¥321,720〜DDR5 64GB / 650W | LLM-36D/I7¥340,880〜DDR5 64GB / 850W |
| 32GBVRAMRTX 4060 Ti 16GB ×2Qwen3 32B(Q6)/30B-A3B(Q8) | LLM-46TD/R5¥491,370〜DDR5 64GB / 650W | LLM-46TD/I5¥497,190〜DDR5 64GB / 750W | LLM-46TD/R7¥513,120〜DDR5 64GB / 650W | LLM-46TD/I7¥532,280〜DDR5 64GB / 850W |
| 32GBVRAMRTX 4070 Ti SUPER 16GB ×2Qwen3 32B(Q6)/30B-A3B(Q8) | LLM-47TSD/R5¥640,750〜DDR5 64GB / 1000W | LLM-47TSD/I5¥652,920〜DDR5 64GB / 1200W | LLM-47TSD/R7¥662,500〜DDR5 64GB / 1000W | LLM-47TSD/I7¥687,720〜DDR5 64GB / 1200W |
| 32GBVRAMRTX 5070 Ti 16GB ×2Qwen3 32B(Q6)/30B-A3B(Q8) | LLM-57TD/R5¥710,210〜DDR5 64GB / 1200W | LLM-57TD/I5¥713,820〜DDR5 64GB / 1200W | LLM-57TD/R7¥731,960〜DDR5 64GB / 1200W | LLM-57TD/I7¥748,620〜DDR5 64GB / 1200W |
← 左右にスクロールして全体をご覧いただけます →
※ 2枚挿しの構成はPCIe接続のまま、Ollama/llama.cpp/LM Studio/vLLM がモデルを2枚に振り分けて載せます。NVLinkは不要(GeForce RTX 40/50世代には端子自体がありません)。推論ではカード間の帯域はほぼ効かず、効くのは学習(ファインチューニング)のときです。
※ 共通:DDR5 32GB(2枚挿しは64GB)/1TB NVMe SSD/ケースは OKINOS または MONTECH XR(黒/白)/Windows 11 Home。価格は在庫と相場で変わります。
「何に使うか」が決まっていれば、必要なパラメータ帯とVRAMはほぼ決まります。迷ったら、まず一番小さい構成で用途が成立するかを試すのが早い。
規程・マニュアル・過去の見積りを読み込ませ、社内で質問に答えさせる。データが外に出ないのが最大の理由。
会議の文字起こしを要約し、返信の下書きを作る。4B〜8Bで十分に回り、一番安く始められる。
Qwen3-Coder系で補完と説明。14Bから実用、32Bで精度が一段上がる。ソースを外部に送らずに済む。
Qwen3-VLで図面や帳票を読ませる、Stable Diffusionで画像を作る。VRAM 16GB以上を推奨。
40 構成のうち、相談の起点になりやすい4つを写真つきで。ケースはMONTECH XRのブラック/ホワイトから選べます。ここに無い組み合わせも、表の中ならすべて組めます。

まず1台、要約・RAGを試したい
136枚の在庫があるRTX 3060 12GBを軸に。最安で12GBのVRAMを確保できる構成。

部署で日常的に使う
16GBあれば14Bを高精度のQ8で回せる。画像・帳票の読み取りもここから。

コード生成・高精度の推論
中古16GBを2枚挿してVRAM 32GB。PCIe接続のままソフト側が2枚に振り分けるので、NVLinkは不要。

複数人で同時に使う・応答速度も要る
帯域の広い16GBを2枚。同時アクセスが増える部署用に。
写真は当店のワークステーション筐体(OKINOS)。MONTECH XR のブラック/ホワイトも選べます。
32B級のモデルは1枚のVRAMでは足りません。新品で24GB以上のGPUを1枚買うのと、中古の16GBを2枚挿すのとで、載る容量は後者のほうが大きく、金額は桁が違います。推論用途なら、これが一番実務的な答えです。


お客様への提案に、構成表と見積りをそのままお使いください。複数台の一括納品、貴社経由でのご請求、納品先を直接お客様にする形も承ります。ソフトウェアと業務設計は貴社、動く箱は当店、という分担でご一緒できます。
フォームの「お立場」で「導入支援・コンサル」を選んでください
動かしたいモデルが決まっていなくても大丈夫です。用途と予算感から、構成案と見積りをお返しします。相談・見積りは無料です。
お電話でも 070-3623-8935 受付 10:00〜17:00
※ 本ページの構成・価格は例示です。実際の構成は、ご相談のうえ在庫と用途に合わせて決定します。価格はパーツ合計から算出した目安で、在庫と相場により変動します。
※ モデルの動作可否は量子化とコンテキスト長で変わります。表の「動くモデル」は当店の目安であり、特定のモデル・速度を保証するものではありません。
※ Qwen は Alibaba Cloud の、GeForce は NVIDIA の商標です。当店は各社と提携関係にありません。