spark-vllm-dockerのvLLMを使いQwen3.6-27B(NVFP4)ロード。メモリを113GB+ほど使っている。Qwen3.6-35B-A3Bの方が高速だが、賢さ重視なら27Bの方がいい