タグ一覧に戻る

コスト削減

記事数: 19 件
DeepSeek V4.1-Flash 完全ガイド:GPT超えの格安LLMを使いこなす

DeepSeek V4.1-Flash 完全ガイド:GPT超えの格安LLMを使いこなす

2026年9月10日リリースのDeepSeek V4.1-Flashは、5520億パラメータのMoEモデルながら1Mトークンあたり最安0.3円という破格の価格を実現。コーディングベンチマークではClaude Opus 5やGPT-5.6 Solを上回る性能を誇る。APIの使い方からローカル動作まで徹底解説。

続きを読む
Harvard の Orla、複数 AI モデルを自動調整——計算コストと応答速度を同時削減

Harvard の Orla、複数 AI モデルを自動調整——計算コストと応答速度を同時削減

Harvard 研究チームが開発したフレームワーク Orla は、複数の AI モデルの実行を自動で最適化し、計算コスト・応答時間・精度を同時に改善。ACM Conference で発表された、スケーラブルな AI ワークフロー管理の新手法。

続きを読む