GPU搭載PC
ノートPC RTX 4060 Laptop 8GB(i7-13700H/32GB)
ノートPC実機(GeForce RTX 4060 Laptop GPU 8GB VRAM・Intel Core i7-13700H・システムRAM32GB)。2026-06-22 SSH経由でA6000と同一プロトコル(ollama API・2回平均・num_predict=256)で実測。VRAM8GB超のモデル(14B級〜)はRAMオフロードで低速化。帯域・TGPは公称値(TGPは機種で可変)。
スペック
| ベンダー | NVIDIA |
|---|---|
| カテゴリ | GPU搭載PC |
| メモリ | 8 GB |
| メモリ帯域 | 256 GB/s |
| AI性能 | — |
| 最大消費電力 | 115 W |
この機材で計測したモデル
- Falcon3 7B Instruct7.5B / TII Falcon License 2.0
- Gemma 3 1B1B / Gemma Terms of Use
- Gemma 3 4B4.3B / Gemma Terms of Use
- Gemma 4 E2B (有効2B / 実5.1B)5.1B / Apache-2.0
- Gemma 4 E4B (有効4B / 実8.0B)8B / Apache-2.0
- GLM-OCR1.1B / MIT
- Granite 3.3 8B Instruct8.2B / Apache-2.0
- LFM2.5 1.2B JP1.17B / LFM Open License v1.0
- LFM2.5 230M0.23B / LFM Open License v1.0
- LFM2.5 8B A1B8.5B / LFM Open License v1.0
- Llama-3-ELYZA-JP-8B8.03B / Llama 3 Community License
- Llama 3.1 8B Instruct8B / Llama 3.1 Community License
- Llama 3.1 Swallow 8B Instruct v0.58.03B / Llama 3.1 Community License + Gemma Terms of Use
- Llama 3.2 1B Instruct1.2B / Llama 3.2 Community License
- Llama 3.2 3B Instruct3.2B / Llama 3.2 Community License
- LLM-jp-4 8B (thinking)8.59B / Apache-2.0
- MiniCPM-V 4.61.3B / Apache-2.0
- Ministral 3 3B3.8B / Apache-2.0
- Mistral 7B Instruct v0.37.2B / Apache-2.0
- Nemotron 3 Nano 4B4B / NVIDIA Nemotron Open Model License
- Phi-4-mini Instruct3.8B / MIT
- Qwen2.5 0.5B0.5B / Apache-2.0
- Qwen2.5 1.5B Instruct1.5B / Apache-2.0
- Qwen2.5 14B14.8B / Apache-2.0
- Qwen2.5 3B Instruct3.1B / Qwen Research License
- Qwen2.5 7B Instruct7.6B / Apache-2.0
- Qwen2.5 Coder 7B Instruct7.6B / Apache-2.0
- Qwen3 1.7B1.7B / Apache-2.0
- Qwen3-VL 2B2.1B / Apache-2.0
- Qwen3.5 0.8B0.8B / Apache-2.0
- Qwen3.5 2B2.3B / Apache-2.0
- Qwen3.5 4B4.7B / Apache-2.0
- Sarashina 2.2 3B Instruct3.36B / MIT
- SmolLM2 1.7B Instruct1.7B / Apache-2.0
全計測データ
| モデル | 量子化 | ランタイム | tok/s | TTFT(ms) | 温度(℃) | 計測日 |
|---|---|---|---|---|---|---|
| LLM-jp-4 8B (thinking) | Q4_K_M | ollama 0.32.0 | 47.3 | 848 | 45 | 2026-07-16 |
| Llama-3-ELYZA-JP-8B | Q4_K_M | ollama 0.32.0 | 49.5 | 1059 | 51 | 2026-07-15 |
| Falcon3 7B Instruct | Q4_K_M | ollama 0.32.0 | 52.6 | 765 | 52 | 2026-07-15 |
| Gemma 3 1B | Q4_K_M | ollama 0.31.2 | 176.7 | 2198 | 46 | 2026-07-15 |
| Gemma 3 4B | Q4_K_M | ollama 0.31.2 | 75.4 | 2217 | 67 | 2026-07-15 |
| Gemma 4 E2B (有効2B / 実5.1B) | Q4_K_M | ollama 0.32.0 | 109.6 | 2124 | 42 | 2026-07-15 |
| Gemma 4 E4B (有効4B / 実8.0B) | Q4_K_M | ollama 0.32.0 | 63.0 | 2116 | 51 | 2026-07-15 |
| GLM-OCR | Q8_0 | ollama 0.32.0 | 291.8 | 549 | 41 | 2026-07-15 |
| Granite 3.3 8B Instruct | Q4_K_M | ollama 0.32.0 | 46.2 | 365 | 53 | 2026-07-15 |
| LFM2.5 1.2B JP | Q4_K_M | ollama 0.31.2 | 265.5 | 372 | 50 | 2026-07-15 |
| LFM2.5 230M | Q8_0 | ollama 0.31.2 | 580.5 | 396 | 38 | 2026-07-15 |
| LFM2.5 8B A1B | Q4_K_M | ollama 0.32.0 | 177.6 | 1181 | 49 | 2026-07-15 |
| Llama 3.1 8B Instruct | Q4_K_M | ollama 0.32.0 | 49.2 | 1061 | 51 | 2026-07-15 |
| Llama 3.2 1B Instruct | Q8_0 | ollama 0.31.2 | 158.1 | 1076 | 47 | 2026-07-15 |
| Llama 3.2 3B Instruct | Q4_K_M | ollama 0.31.2 | 100.9 | 1061 | 52 | 2026-07-15 |
| MiniCPM-V 4.6 | Q4_K_M | ollama 0.32.0 | 226.4 | 1402 | 45 | 2026-07-15 |
| Ministral 3 3B | Q4_K_M | ollama 0.31.2 | 94.3 | 1167 | 53 | 2026-07-15 |
| Mistral 7B Instruct v0.3 | Q4_K_M | ollama 0.32.0 | 53.9 | 207 | 50 | 2026-07-15 |
| Nemotron 3 Nano 4B | Q4_K_M | ollama 0.32.0 | 77.9 | 1226 | 53 | 2026-07-15 |
| Phi-4-mini Instruct | Q4_K_M | ollama 0.31.2 | 84.3 | 1175 | 55 | 2026-07-15 |
| Qwen2.5 1.5B Instruct | Q4_K_M | ollama 0.32.0 | 178.0 | 846 | 47 | 2026-07-15 |
| Qwen2.5 Coder 7B Instruct | Q4_K_M | ollama 0.32.0 | 51.9 | 907 | 57 | 2026-07-15 |
| Qwen3 1.7B | Q4_K_M | ollama 0.31.2 | 167.6 | 852 | 49 | 2026-07-15 |
| Qwen3.5 0.8B | Q8_0 | ollama 0.31.2 | 181.0 | 1650 | 48 | 2026-07-15 |
| Qwen3.5 2B | Q8_0 | ollama 0.32.0 | 96.7 | 1588 | 47 | 2026-07-15 |
| Qwen3-VL 2B | Q4_K_M | ollama 0.31.2 | 162.2 | 955 | 50 | 2026-07-15 |
| Sarashina 2.2 3B Instruct | Q4_K_M | ollama 0.31.2 | 93.1 | 503 | 53 | 2026-07-15 |
| SmolLM2 1.7B Instruct | Q8_0 | ollama 0.31.2 | 117.0 | 334 | 50 | 2026-07-15 |
| Llama 3.1 Swallow 8B Instruct v0.5 | Q4_K_M | ollama 0.32.0 | 49.2 | 1075 | 53 | 2026-07-15 |
| Qwen2.5 0.5B | Q4_K_M | ollama 0.30.10 | 319.9 | 843 | 43 | 2026-06-23 |
| Qwen2.5 14B | Q4_K_M | ollama 0.30.10 | 12.8 | 810 | 56 | 2026-06-23 |
| Qwen3.5 4B | Q4_K_M | ollama 0.30.10 | 69.5 | 1635 | 54 | 2026-06-23 |
| Qwen2.5 3B Instruct | Q4_K_M | ollama 0.30.10 | 104.6 | 838 | 59 | 2026-06-22 |
| Qwen2.5 7B Instruct | Q4_K_M | ollama 0.30.10 | 51.9 | 823 | 57 | 2026-06-22 |
※ 数値はすべて自前機材での実測です(ollama API・2回平均・num_predict=256)。
この機材を使った記事
- 巨大MoEはローカルで動くか【「収まる」と「使える」を実測で線引き】数百B級の巨大オープンMoE(Hy3・MiMo-V2.5)が話題ですが、「動く」論の中身はMoE・GGUF・量子化の3要素。当サイト178件・5機材の自前実測DBで検証し、「メモリに収まる」と「実用速度で使える」の境界を正直に線引きします。
- 8GB機でモデル切替は何秒損するか【Raspberry Pi 5・Jetson・RTX 4060 Laptop実測】8GB機3台(Raspberry Pi 5・Jetson Orin Nano Super・RTX 4060 Laptop)でOllamaのモデル切替コストを実測。数十秒かかるコールドロードと、Jetsonで実績あるモデルが4回中4回ロード失敗する断片化リスクを、48試行の実測データで記録します。
- ローカルAIでループエンジニアリング【3機種で総実時間を実測】エージェントの「ループ=足場」をローカルで設計・運用する実践ガイド。同じ多段ループをA6000・RTX4060ノート・Mac mini M4で実測。成否は機材非依存でも総実時間は機材で激変——暴走ガード・文脈管理・VRAM適合などループ設計の勘所を一次データで示します。
- ローカルAI PoCを成功させる完全ガイド【段階導入・実測・業種別】ローカルAIのPoCは段階的に小さく始め、用途で族を選び、機材に合わせるのが成功の核。自前実測56件(A6000〜Mac〜Jetson〜Pi5)と段階導入・業種別・PoC事例で、投資を最小化しつつ失敗を避ける進め方を示します。