Was ist Qwen3.8-Flash-Next?
Qwen3.8-Flash-Next ist ein multimodales
Mixture-of-Experts-Modell (MoE), das auf der nächsten Generation der Qwen4-Architektur
basiert und am 25. August 2026 vom Qwen-Team angekündigt wurde. Es bündelt
Innovationen wie GDN-Hybrid-Layer und Qwen Sparse Attention (QSA)
und erweitert damit die Grenzen von Modellkapazität und Performance – mit besonderer Stärke bei
Agentic Coding, langlaufenden Long-Horizon-Aufgaben und
multimodaler Intelligenz.
Mit 125 Milliarden Hauptparametern, ergänzt um zusätzliche
51 Milliarden N-Gram-Embeddings, werden pro Token nur
6 Milliarden Parameter aktiviert. Das verbindet die Kapazität eines sehr großen
Modells mit der Effizienz und Geschwindigkeit eines deutlich kleineren Modells.