こちら(メイン64GB+RTX4060Ti 16GB)で今日のStrataでQwen3.8-Flash-Next-Coderだと、Coder版は日本語で質問すると、chatの返答の出力は90%くらい英語で、コメント書かせたら中国語混じる感じです。
ちゃんと回答とかコーディングしてくれたら英語➡英語でもいいかな、って感じですけど・・
大規模なAIモデルは、家庭用GPU1枚でどこまで動くのか?
今回は、モデルの一部をRAMに置きながら動かす「Strata」を使い、Qwen3.8-Flash-Nextの軽量化版IQ2_XSを検証しました。
環境はRTX 5060 Ti 16GB×1、RAM64GB。日本語の要約、JSON形式の出力、コード作成、文書読解などを試し、起動確認を含む15回のリクエストがすべて成功しました。