Az Alibaba Qwen csapata kiadta a Qwen3.8-Flash-Next modellt, egy nyílt súlyú, multimodális MoE-architektúrát, amely a következő generációs Qwen4 család alapjaira épül. A 125 milliárd paraméteres modell tokenenként mindössze 6 milliárd aktív paramétert használ, és 262 144 tokenes kontextust kínál alapból, amely egymillió tokenig bővíthető.

A vállalat állítása szerint a modell a DeepSWE 1.1 (58,7), SWE-bench Pro (62,5) és GPQA Diamond (91,7) benchmarkokon is megelőzi a Claude Opus 4.6 Maxot. A Qwen Community License 1.0 alatt kiadott súlyok kereskedelmi célre is felhasználhatók, csak a Model-as-a-Service üzleti modellhez szükséges külön megállapodás. Az API árazás a Qwen Cloudon körülbelül 0,16 dollár egymillió input és 0,47 dollár egymillió output tokenenként.