Qwen3.8-Flash-Next: A New Architecture, Towards Ultimate Cost-Efficiency
Qwen introduced a Flash-Next architecture focused on lower-cost inference, attracting major developer discussion around model efficiency.
Excerpt
HN · 303 points · 92 comments
Read at source: https://qwen.ai/blog?id=qwen3.8-flash-next