ai-local-lab

Jetson

Jetson Orin NX Super 16GB

16GB機・Nanoとは別機体。JetPack6.2/L4T R36.4.3/CUDA12.6、電力モードMAXN_SUPER、ollama0.34.0で実測。Q4_K_Mで14Bクラス(qwen3:14b 7.4/gemma3:12b 8.7 tok/s)まで実用。tops=157はSuperモードのINT8 sparse公称値(dense 78)で、Nano機の67と同じsparse基準。gpt-oss:20b/qwen3:30b-a3bはGPUロードでサーバークラッシュ→CPU/mmapのみ低速稼働。feasibility参照。

スペック

Jetson Orin NX Super 16GBの主要スペック
ベンダーNVIDIA
カテゴリJetson
メモリ16 GB
メモリ帯域102 GB/s
AI性能157 TOPS
最大消費電力40 W

この機材で計測したモデル

全計測データ

Jetson Orin NX Super 16GBの全ベンチマーク計測
モデル量子化ランタイムtok/sTTFT(ms)温度(℃)計測日
Gemma 3 12BQ4_K_Mollama 0.34.08.7400712026-09-14
Gemma 3 4BQ4_K_Mollama 0.34.019.7151612026-09-14
Llama 3.2 1B InstructQ8_0ollama 0.34.050.333532026-09-14
Llama 3.2 3B InstructQ4_K_Mollama 0.34.024.664592026-09-14
Phi-4-mini InstructQ4_K_Mollama 0.34.021.969652026-09-14
Qwen2.5 Coder 7B InstructQ4_K_Mollama 0.34.013.697672026-09-14
Qwen2.5-VL 3BQ4_K_Mollama 0.34.025.756662026-09-14
Qwen3 14BQ4_K_Mollama 0.34.07.4163692026-09-14
Qwen3 8BQ4_K_Mollama 0.34.012.8102702026-09-14
Qwen3.5 0.8BQ8_0ollama 0.34.041.678562026-09-14
Qwen3.5 2BQ8_0ollama 0.34.025.179592026-09-14

※ 数値はすべて自前機材での実測です(ollama API・2回平均・num_predict=256)。

TTFT は同一プロンプトを繰り返す計測でプロンプトキャッシュが効いた状態の値です。機材をまたぐ TTFT の比較は、キャッシュを無効化した再計測(cache-busted-v2)が揃うまで保留しています。

この機材を使った記事