InclusionAI открывает Ling Flash 2.0 — 100B MoE с качеством 40B-плотной и скоростью в 3×
InclusionAI выпустила Ling Flash 2.0 на HuggingFace под лицензией MIT. Модель активирует лишь 6.1B из 100B параметров за шаг инференса, обеспечивая 200+ токенов/с на H20 и превосходя или сравниваясь с плотными моделями до 40B на GPQA-Diamond, LiveCodeBench v6, AIME 2025 и FinanceReasoning.