タグ一覧に戻る

MoE

記事数: 10 件
DeepSeek V4.1-Flash 完全ガイド:GPT超えの格安LLMを使いこなす

DeepSeek V4.1-Flash 完全ガイド:GPT超えの格安LLMを使いこなす

2026年9月10日リリースのDeepSeek V4.1-Flashは、5520億パラメータのMoEモデルながら1Mトークンあたり最安0.3円という破格の価格を実現。コーディングベンチマークではClaude Opus 5やGPT-5.6 Solを上回る性能を誇る。APIの使い方からローカル動作まで徹底解説。

続きを読む
TinkerでQwen-235B微調整がぐっと手軽に

TinkerでQwen-235B微調整がぐっと手軽に

Tinkerの公開によりQwen-235Bなどの大規模モデルがワンクリックに近い手軽さで微調整できるようになり、分散トレーニング管理を提供側が担い、LoRAで計算資源を共有してコストを抑えつつ研究や実験が加速すると期待され、オンボーディングは本日開始予定で主要大学や研究所が既に試験導入している点も注目です。

続きを読む