DeepSeek V4.1-Flash 完全ガイド:GPT超えの格安LLMを使いこなす
2026年9月10日リリースのDeepSeek V4.1-Flashは、5520億パラメータのMoEモデルながら1Mトークンあたり最安0.3円という破格の価格を実現。コーディングベンチマークではClaude Opus 5やGPT-5.6 Solを上回る性能を誇る。APIの使い方からローカル動作まで徹底解説。
続きを読む2026年9月10日リリースのDeepSeek V4.1-Flashは、5520億パラメータのMoEモデルながら1Mトークンあたり最安0.3円という破格の価格を実現。コーディングベンチマークではClaude Opus 5やGPT-5.6 Solを上回る性能を誇る。APIの使い方からローカル動作まで徹底解説。
続きを読む中国Z.aiが新モデルGLM-5.3-Flashを公開。上位モデルGLM-5.3にわずか3ポイント差の性能を、タスクあたりのコストは7分の1に抑えて実現した。推論基盤はNvidiaに頼らず中国製AIチップで稼働する。
続きを読むAlibabaがQwen4のアーキテクチャプレビューと位置づける新モデルQwen3.8-Flash-Nextを公開。総125億パラメータのうち実際に使うのは60億のみで、価格はフラグシップの12分の1に抑えた。
続きを読むドイツの AI コンソーシアムが独語最適化の 30B パラメータモデル『Soofi S』をリリース。MoE アーキテクチャで推論効率を実現し、英語・ドイツ語のベンチマークで大規模オープンモデルを上回った。
続きを読むHN で 1,757 ポイントを叩き出した DeepSeek V4 の全貌を解説。V4-Pro と V4-Flash の違い、GPT-5.5・Claude Opus 4.7 との価格・性能比較、OpenAI SDK 互換 API の使い方、ユースケース別の選び方まで詳しくまとめた。
続きを読むAlibabaのQwen3.5は学習済み重みを公開するオープンウェイトで、線形アテンションとMixture-of-Expertsの組合せにより推論効率を高め、企業や研究者に新たな選択肢を提供します。
続きを読むTinkerの公開によりQwen-235Bなどの大規模モデルがワンクリックに近い手軽さで微調整できるようになり、分散トレーニング管理を提供側が担い、LoRAで計算資源を共有してコストを抑えつつ研究や実験が加速すると期待され、オンボーディングは本日開始予定で主要大学や研究所が既に試験導入している点も注目です。
続きを読むパリ拠点のMistral AIが提示したMistral 3は、多サイズと多モーダル対応で企業と開発者の選択肢を広げます。今後の公式情報と実運用評価に期待です。
続きを読むBaiduの新マルチモーダルAI「ERNIE-4.5-VL-28B」は28Bだが入力ごとに約3Bだけ活性化するMoE設計で、Apache 2.0で公開され80GB GPU運用を想定しますが独立検証が必須です。
続きを読むMoonshot AIのオープンモデルKimi K2は高いベンチマークと長文・多数ツール呼び出し対応で注目を集めています。技術的利点は多い一方、ライセンス表示や実運用コスト、ドメイン適合性は導入前に慎重な検証が必要です。
続きを読む