小型118億パラメータで大型モデル上回る。Poolside Laguna S 2.1の思考モード戦略
Poolsideが発表した Laguna S 2.1 は118億パラメータの混合エキスパート構造で、思考モード導入により大規模モデルを上回るコーディング性能を実現。低コストで企業が実用できる効率性が特徴です。
続きを読むPoolsideが発表した Laguna S 2.1 は118億パラメータの混合エキスパート構造で、思考モード導入により大規模モデルを上回るコーディング性能を実現。低コストで企業が実用できる効率性が特徴です。
続きを読むSina Weibo が公開した 30 億パラメータの VibeThinker-3B は、数学・コーディングで 200~333 倍大きいモデル(DeepSeek V3.2、Kimi K2.5)と互角のスコア。一方、事実知識の問題では大規模モデルに大きく劣後。研究から浮かぶのは、論理的推論は小型モデルに圧縮可能だが、事実知識は圧縮困難という知見。
続きを読む