スケーリングの限界——元 OpenAI 研究者が $100 億の訓練データ投資を予測、AI 戦略が変わる
元 OpenAI の Andrew Ho が「単純なスケーリングでは LLM の汎用性は実現しない」と指摘。今後 AI ラボは $100 億規模の高質訓練データ投資に向かい、プログラミング・数学偏重の「スペシャライゼーション問題」を解決へ。AI 開発の次の段階へ。
続きを読む元 OpenAI の Andrew Ho が「単純なスケーリングでは LLM の汎用性は実現しない」と指摘。今後 AI ラボは $100 億規模の高質訓練データ投資に向かい、プログラミング・数学偏重の「スペシャライゼーション問題」を解決へ。AI 開発の次の段階へ。
続きを読む1,233 名の参加者による 5 つの研究で、ChatGPT 4o・Claude 3.5 Sonnet・Gemini 1.5 Pro が人間のカウンセラーと同等またはそれ以上の効果を発揮。具体的で実行可能なアドバイスが最も重要。
続きを読むペンシルバニア大学の統計学者がOpenAIの最新モデル GPT-5.6 Sol Pro を使用し、統計学において30年間未解決だったベンジャミーニ・ホッホベルク法の有効性に関する仮説を反証した。AI能力の実質的な進化を示す事例として注目されている。
続きを読むAgenticSTS プロジェクトが 5 層構造のメモリアーキテクチャで難易度 A0 の Slay the Spire 2 を 6/10 で勝利。従来は試行ごとに 500,000+ トークンを消費していたが、5,000 トークンに削減。長期タスク実行における LLM の スケーラビリティ問題の実装的な解決法を実証した。
続きを読む