今週のローカルAI(AMD編) 2026-10-05
/確認した候補 32 件
直近 14 日の更新 32 件から、統合GPU・NPU でローカルAIを動かす構成に関係するものを 4 件選びました。
Lemonadeが統合GPUのGTTに対応
ストリーミングモデルが、固定VRAM枠ではなくAPUのGTTプールを基準にサイズを決めることで、AMD統合GPU上で動作するようになった。これにより以前は未対応だったハードウェアでもモデルストリーミングが可能になる。JetBrainsのJunieがlemonade launch junieで追加され、system-infoのAMD GPU表示が製品名になった。
この構成での影響: 統合GPUで、固定VRAMではなくGTTプールを前提にストリーミングモデルを動かせるようになる。
出典: Lemonade リリース(2026-09-30)
FastFlowLMがNPUで投機的デコード
qwen3.8-mtp:27bが追加され、FastFlowLMがこれまでに出荷した最大のdenseモデルとなった。組み込みのMTPドラフトヘッドにより、NPU上で初めて投機的デコードを実行する。ツール呼び出し対応の27B推論モデルで、hy-mt2:1.8bのリネームやコミュニティ修正も含まれる。
この構成での影響: NPU上のFastFlowLMで、27Bモデルと投機的デコードが使えるようになる。
出典: FastFlowLM リリース(2026-09-30)
Ryzen AI Max+ 395でVLAを実行
ビジョン・ランゲージ・アクションモデルMolmoAct2を、AMD Ryzen AI Max+ 395(Strix Halo)ミニPC上のROCmで動かす例が紹介されている。場面を見て英語の指示を読み、ロボットアームを動かす処理を、クラウドや外部アクセラレータなしの1台で行うと述べている。
この構成での影響: 同じRyzen AI Max+ 395ミニPCとROCmで、クラウドなしのVLA実行事例が示される。
出典: AMD ROCm Blogs(2026-09-30)
ComfyUIがQwen Image処理を改善
Qwen 2.1のKVキャッシュ配置の改善、Qwen Image 2.1トランスフォーマーブロックのコンパイル、ブロックごとのattention指定、JsonExtractStringの拡張、torchaudio依存の削除が入った。ace step 1.5向けのCuda graphs、H3 VAEタイルのブレンド、高速ディスク検出も含まれる。
この構成での影響: 利用中のComfyUIに機能追加が入るが、統合GPUでの効果は本文からは不明。
出典: ComfyUI リリース(2026-09-29)
各項目の要約は上記の出典ページの記載に基づいています。速度や消費電力の数値は、出典に書かれていない限り載せていません。