タグ一覧に戻る

推論最適化

記事数: 5
DeepSeek がDSpark公開、推論速度60~85%向上。米国規制下での中国AI戦略の転換点に

DeepSeek がDSpark公開、推論速度60~85%向上。米国規制下での中国AI戦略の転換点に

DeepSeekが新しい推論フレームワーク『DSpark』をMITライセンスで公開。投機的デコーディング技術により、ユーザーあたりの応答速度を60~85%削減。半導体リソース削減によるコスト低下で、AIインフラの経済モデルが大きく変わる局面に。

続きを読む
Google、Pixel上の Gemini Nano を50%高速化——「Frozen Multi-Token Prediction」で次世代オンデバイスAIを実現

Google、Pixel上の Gemini Nano を50%高速化——「Frozen Multi-Token Prediction」で次世代オンデバイスAIを実現

Google AI が新技術「Frozen Multi-Token Prediction(FMTP)」を発表。既存 Gemini Nano モデルの重みを固定し軽量な変換器を追加することで、Pixel 9/10 上での処理速度を50%以上高速化。メモリ効率も大幅改善。

続きを読む
Alibaba Qwen-Image-2.0、圧縮 2 倍・推論ステップ 40→4 で高速化——画像生成競争が加速

Alibaba Qwen-Image-2.0、圧縮 2 倍・推論ステップ 40→4 で高速化——画像生成競争が加速

Alibaba の最新画像生成モデル Qwen-Image-2.0 が圧縮率を 2 倍に向上。16 段階の空間圧縮とトランスフォーマー改善により、生成ステップを 40 から 4 に削減。LMArena で第 9 位を獲得、テキスト描写精度も向上。開発者向けベータ API で利用可能。

続きを読む