Az Alibaba Qwen csapata bemutatta az új Qwen3.8-Flash-Next mesterséges intelligencia modellt, amely új mércét állít a költséghatékonyságban. A modell innovatív architektúrája révén képes felvenni a versenyt nagyobb és drágább MI-rendszerekkel, miközben jelentősen kevesebb erőforrást igényel, így új lehetőségeket teremt az üzleti és fejlesztői felhasználók számára.[^1]
Az új Qwen3.8-Flash-Next modell 125 milliárd paraméterből áll, de minden token feldolgozásakor csak 6 milliárd paraméter aktiválódik. Ezt egészíti ki az N-gram beágyazási réteg, amely további 51 milliárd paramétert tartalmaz. Ez a réteg gyakori kifejezéseket tárol, így hatékonyabbá teszi a feldolgozást és lehetővé teszi, hogy ezek az információk a rendszer memóriájában, nem pedig a drága GPU-n legyenek eltárolva.[^1]
A modell natívan 262 144 tokenes kontextust támogat, de YaRN technológiával akár 1 millió tokenig is bővíthető.[^1] Az újítások a közelgő Qwen4 modellben is megjelennek majd.
Az új modell elérhető a QwenCloud platformon keresztül, ahol az input tokenek ára 0,16 USD/millió, az output tokeneké pedig 0,47 USD/millió.[^1] Az API elérhetősége hamarosan bővül, és a modell súlyai nyíltan letölthetők a Hugging Face vagy ModelScope platformokról.
Az Alibaba Qwen3.8-Flash-Next modellje mindössze egy kilencedébe kerül a Qwen3.7-Plus tanítási költségeinek, miközben bizonyos feladatokban jobb eredményeket ér el.[^1] A modell fő riválisai közé tartozik a DeepSeek-V4-Flash és az Anthropic Claude-Opus-4.6, de az új Qwen modell több mérésben is vezető helyen végez.
„A Flash-Next különösen jól teljesített az ügynöki programozási feladatokban és irodai produktivitási teszteken, ahol jelentős előnyt mutatott fel.”[^1]
Például a CoWorkBench teszten 73,9 pontot ért el (szemben a DeepSeek 45,1 pontjával), a JobBench mérésen pedig 55,7 pontot, ami majdnem duplája a Qwen3.7-Plus eredményének.[^1]
Az új modell bevezetése tovább növeli a nyomást az olyan nagy versenytársakon, mint az OpenAI és az Anthropic. Az árkülönbség kiemelkedő: az input tokenek ára tizenkettede, az output tokeneké pedig szintén csak töredéke az aktuális csúcsmodell, a Qwen3.8-Max díjainak.[^1] Ez a versenytársakat is árcsökkentésre kényszeríti, ami végső soron a felhasználóknak kedvez.
Az Alibaba Qwen3.8-Flash-Next modellje jelentős lépést jelent a költséghatékony mesterséges intelligencia felé, miközben megőrzi, sőt egyes területeken túl is szárnyalja a csúcskategóriás modellek teljesítményét. A fejlesztés várhatóan új iparági standardokat teremt, és további árversenyt indíthat el a globális MI-piacon.[^1]
[^1]: THE DECODER (2026-08-26). “Alibaba veröffentlicht KI-Modell Qwen3.8-Flash-Next für ‘ultimative Kosteneffizienz'”. Közzétéve [2026. 08. 26.].