タグ一覧に戻る

効率化

記事数: 7
Tencent、効率的な巨大モデル Hy3 をオープンソース化――295B パラメータでも高速推論

Tencent、効率的な巨大モデル Hy3 をオープンソース化――295B パラメータでも高速推論

Tencent がオープンソース LLM『Hy3』を発表。295 億パラメータのモデルながら、実際のアクティブは 21 億のみで、最大5倍サイズのモデルと同等の性能を実現。ハルシネーション率も 5.4% に削減し、ローカル実行・低コスト推論を求める開発者に新たな選択肢を提供。

続きを読む
Allen Institute × UC Berkeley、Mixture-of-Experts モデルを12.5%に圧縮―EMO で AI 推論のコスト削減が現実に

Allen Institute × UC Berkeley、Mixture-of-Experts モデルを12.5%に圧縮―EMO で AI 推論のコスト削減が現実に

Allen Institute for AI と UC Berkeley の研究チームが、従来の Mixture-of-Experts(MoE)モデルを、全エキスパートの12.5%だけで従来同等の性能を実現する新手法『EMO』を発表。メモリ制約環境での AI 運用が劇的に改善される可能性。

続きを読む
OpenAI、Codex for Work で営業・経営・データ分析チーム向けガイドを公開

OpenAI、Codex for Work で営業・経営・データ分析チーム向けガイドを公開

OpenAIが新たに『Codex for Work』としてビジネス各職種向けのCodex活用ガイドを公開。営業チームは提案資料の自動作成、経営チームは戦略文書の生成、データ分析チームは分析レポートの作成に活用できるようになり、実務的なワークフローの効率化が可能に。

続きを読む

Tencent の 440MB 超軽量 AI 翻訳モデル、33言語に対応――スマートフォンでオフライン翻訳、Google Translate を上回る精度

Tencent が極度に圧縮された AI 翻訳モデル「Hy-MT1.5-1.25bit」をオープンウェイト公開。3.3GB から 440MB に圧縮し、33言語をサポート。スマートフォンで完全オフライン実行でき、商用サービスと同等の翻訳精度を実現。

続きを読む