Alibaba、Qwen4アーキテクチャ先取りの「Qwen3.8-Flash-Next」公開、訓練コストを9分の1に圧縮
AlibabaがQwen4のアーキテクチャプレビューと位置づける新モデルQwen3.8-Flash-Nextを公開。総125億パラメータのうち実際に使うのは60億のみで、価格はフラグシップの12分の1に抑えた。
続きを読むAlibabaがQwen4のアーキテクチャプレビューと位置づける新モデルQwen3.8-Flash-Nextを公開。総125億パラメータのうち実際に使うのは60億のみで、価格はフラグシップの12分の1に抑えた。
続きを読む米国の大手 AI 企業が値下げに動く。中国勢の台頭で兆ドル規模の野心が揺らぐ中、安価で実用的なモデル戦略へシフト。
続きを読むMAI-Cyber-1-Flash が Anthropic Mythos を CyberGym で 12 ポイント上回りながら半額。GPU コスト 84% カット。競争の軸がモデル性能からオーケストレーション戦略へシフト。
続きを読むCisco がオープンソースのサイバーセキュリティ AI モデル Antares をリリース。15 分・$1 で 500 リポジトリをスキャンし、GPT-5.5 は 5 時間・$100+ を要する。小規模モデルの圧倒的な効率性が、エンタープライズセキュリティの新基準を示唆。
続きを読むMicrosoft は Copilot で使用中の OpenAI・Anthropic のモデルを、独自 MAI(Microsoft AI Infrastructure)に段階的に置き換える。AI チーフ Mustafa Suleyman が『最終的に外部モデルのコストを排除する』と明言。ユーザーは同じ価格でより弱い AI を使う可能性も。
続きを読むNVIDIAのNemotron 3 NanoとMambaハイブリッドは、長文コンテキストの理解と資源効率を両立する可能性が高く、公開された評価レシピを参照して実務での導入可否を検証することが重要です。
続きを読む