ローカルLLM推論エンジン「Strata」がRyzen AI Max/Max+シリーズに対応し、128GBメモリでQwen3.8-Flash-Nextを動作可能になった
- •オープンソースのローカルLLM推論エンジン「Strata」のバージョン0.1.40が10月6日に公開された
- •AMDのRyzen AI Max/Max+シリーズへの対応が実験的に追加された
- •128GBのメモリを活用して「Qwen3.8-Flash-Next」を動作できるようになった
Qwen3.8-Flash-Nextに関する最新のAI・ITニュースを新着順にまとめ、DevPickのAIが要点を要約しています。
Qwen3.8-Flash-Nextの記事で同時に取り上げられることが多い製品・企業・技術です。
ローカルLLM推論エンジン「Strata」がRyzen AI Max/Max+シリーズに対応し、128GBメモリでQwen3.8-Flash-Nextを動作可能になった
VRAM 12GBのビデオカードで総パラメータ125Bの「Qwen3.8-Flash-Next」を動作させるツール「Strata」の試行結果を報告
ローカルLLM「Qwen3.8-Flash-Next」をコンシューマ向けPCで実行できる推論環境「Strata」の最新版v0.1.39が10月4日に公開された
Run Qwen 3.8 Flash Next (125B) on consumer hardware (RTX 4090) at 100T/s
推論エンジンStrataにより、Qwen3.8-Flash-NextモデルをRTX 4090などの消費者向けハードウェア上で100T/sの速度で実行できる手法が公開された
From the creator of Redis; run LLM locally with ds4
Redisの創始者antirezが開発したC言語製推論エンジンds4について、DeepSeek V4などのモデルをローカルで実行するドキュメントやベンチマークを解説した
AlibabaのQwen3.8-Flash-NextをゲーミングPCで高速実行する推論エンジン「Strata」が公開され、秒間60~95トークンで動作
Show HN: Running 104GB Qwen3.8-Flash-Next on 48GB Mac with at ~12 tok/s
スロットストリームという技術により、125Bパラメータの巨大モデルをメモリ不足のMacでもSSDストリーミングとエキスパートオフロードを使って実行可能にした
AlibabaのQwenチームが次世代モデル設計を先取りした「Qwen3.8-Flash-Next」をオープンウェイトで公開し、125Bパラメータながら高性能モデルに匹敵する性能を有する。
Qwen3.8-Flash-Next: A New Architecture, Towards Ultimate Cost-Efficiency
アリババグループのQwenチームが、高いコスト効率を実現する新アーキテクチャ「Qwen3.8-Flash-Next」を発表。推論コストの大幅削減と、パフォーマンスの維持・向上を両立する技術的詳細が解説されている。
アリババのQwenチームが次期モデルに向けた新アーキテクチャを採用した「Qwen3.8-Flash-Next」を8月27日にオープンウェイトで公開する。詳細なスペックは未公開だが、既存モデルと同等の性能が期待されている