1. はじめに
8月26日に発表された Qwen3.8 Flash Next が Ryzen AI Max+ 395 であっさり動いたのでその報告です。
2. 環境説明
自分が使っているPCは、 GMKtec EVO-X2 (128GB) で、Windows11 を使っています。
その上に、LM Studio(0.4.23) + ROCm llama.cpp(Windows v2.31.2) を載せて、サーバー機能を有効化しています。
3. 使ったモデル
今回のお試しで使ったモデルは以下になります。
- unsloth/Qwen3.8-flash-next (IQ4_XS)
デフォルト設定だと、GPU Offload の値が、最大になっていなかったため、最大値(48) に設定しました。
また、コンテキスト長 に関しては、お試しということもあり 3万程度 に設定しました。
他の設定はデフォルトのままで、モデルをロードしました。
その結果、特に問題なくモデルのロードも終了し、いつも最初に試している質問(「結城明日奈とは?」)で、MCPに設定している web-search も使いながらちゃんと(? 一部、嘘がありましたが)答えてくれました。
4. 今後のお試し
今後は、先日から色々と試行錯誤している Continue.dev を使っての Fortran to Java マイグレーション を試してみようと思います。
JetBrains Context も入れたので、うまい具合にマイグレーション出来たら報告します。