ローカルLLMをNPU単体で動かせる「Lemonade Server」をRyzen AI 9 HX 470搭載の「Minisforum AI X1 Pro-470」で試してみた

FastFlowLMを使って推論を回している間、NPUの使用率が100%に張り付く一方で、GPUには余裕があることが確認できた