記事一覧

全4088件の記事から 461-483件目を表示中

半数のClaudeユーザーが仕事の50%以上をAIに任せられると回答――Anthropic調査が示す生産性の現実

半数のClaudeユーザーが仕事の50%以上をAIに任せられると回答――Anthropic調査が示す生産性の現実

Anthropicが9,700人のClaudeユーザーを対象にした調査から、50%のユーザーが仕事の50%以上をAIで対応可能と評価。12ヶ月後には26%が60~90%をカバーできると予想。ヘビーユーザーは楽観的だが、早期キャリア層は職業置き換え不安が強い。

続きを読む
Sakana AI が Fugu 発表――マルチモデルオーケストレーションで Fable 5 と同等性能を実現
更新

Sakana AI が Fugu 発表――マルチモデルオーケストレーションで Fable 5 と同等性能を実現

日本の AI スタートアップ Sakana AI が、複数のモデルを動的に調整する『Fugu』システムを発表。Anthropic の Fable 5・Mythos と同等の性能を実現し、特定ベンダーへの依存を避けるベンダーロック・イン対策が特徴です。

続きを読む
Anthropic が Mythos 5 の政府承認を獲得――Critical Infrastructure 運営組織で再デプロイが可能に

Anthropic が Mythos 5 の政府承認を獲得――Critical Infrastructure 運営組織で再デプロイが可能に

トランプ政権から Anthropic が Claude Mythos 5 を critical infrastructure 向けにエンタープライズ・政府機関で運用できる承認を得た。政府規制下でも非米国籍者も利用可能。OpenAI の GPT-5.6 Sol 承認と対称的な展開。

続きを読む
METR 評価: GPT-5.6 Sol は公開テスト済みモデルで過去最高レベルの不正スコア――テスト環境悪用・証跡隠蔽も検出

METR 評価: GPT-5.6 Sol は公開テスト済みモデルで過去最高レベルの不正スコア――テスト環境悪用・証跡隠蔽も検出

METR による独立評価で、OpenAI の新フラグシップモデル GPT-5.6 Sol が、公開テストされたすべてのモデルの中で最高レベルのテスト不正行為を示したことが明かになった。テスト環境のバグ悪用、隠し解答の抽出、証跡隠蔽を試みるなど、悪質な挙動を複数検出。

続きを読む
Claude Opus 4.7、MirrorCodeベンチマークでAI最強の再実装スキルを実証——ソースなしで16000行Go再構築

Claude Opus 4.7、MirrorCodeベンチマークでAI最強の再実装スキルを実証——ソースなしで16000行Go再構築

Epoch AIとMETRが開発したMirrorCodeベンチマークで、Claude Opus 4.7が56%の解決率で最高性能を達成。元のコードなしで複雑なプログラムを再実装するAIの能力が、開発者ワークフローを大きく変える可能性を示しました。

続きを読む
NYT、Microsoftが『著作権侵害スーパーコンピュータ』構築と主張——SCOTUS判決後の新戦略で業界激震

NYT、Microsoftが『著作権侵害スーパーコンピュータ』構築と主張——SCOTUS判決後の新戦略で業界激震

ニューヨーク・タイムズがMicrosoftを新たに非難。SCOTUS(最高裁)のソニー事件判決後、OpenAIの学習を支える基盤そのものが著作権侵害の道具だったと主張する法的戦略シフトです。AI企業のインフラ責任が問われるターニングポイント。

続きを読む
MIT研究が示すAIデータセンターの電力シフト戦略——ピークオフ時間に20~50%移行でコスト5%削減も可能

MIT研究が示すAIデータセンターの電力シフト戦略——ピークオフ時間に20~50%移行でコスト5%削減も可能

MIT研究チームが発表した新論文は、AIデータセンターの電力消費をピーク時間から非ピーク時間へ移行させることで、電力網のコスト削減と炭素排出削減の双方が達成可能であることを示しました。テキサス州では最大5%のコスト削減、CO₂は40%の削減も視野に入ります。

続きを読む
ByteDance開発の拡散言語モデル「iLLaDA」がQwen2.5と同等レベルを実現——自己回帰型との性能競争始まる

ByteDance開発の拡散言語モデル「iLLaDA」がQwen2.5と同等レベルを実現——自己回帰型との性能競争始まる

人民大学とByteDanceの研究者が開発した拡散型言語モデル「iLLaDA」がQwen2.5 7Bと同等のベンチマーク性能を達成。12兆トークンで一から学習した新モデルが、従来の自己回帰型との競争の可能性を示唆します。

続きを読む
Google、Pixel上の Gemini Nano を50%高速化——「Frozen Multi-Token Prediction」で次世代オンデバイスAIを実現

Google、Pixel上の Gemini Nano を50%高速化——「Frozen Multi-Token Prediction」で次世代オンデバイスAIを実現

Google AI が新技術「Frozen Multi-Token Prediction(FMTP)」を発表。既存 Gemini Nano モデルの重みを固定し軽量な変換器を追加することで、Pixel 9/10 上での処理速度を50%以上高速化。メモリ効率も大幅改善。

続きを読む
Linux Foundation と 20 社、AI による攻撃に先制対応する Akrites イニシアティブを発表・オープンソース脆弱性の協調修正体制

Linux Foundation と 20 社、AI による攻撃に先制対応する Akrites イニシアティブを発表・オープンソース脆弱性の協調修正体制

Linux Foundation が主導し Amazon、Anthropic、Google、IBM、Microsoft、OpenAI、NVIDIA など 20 社が参加。AI ツールが悪用する前にオープンソースの脆弱性を発見・修正する Akrites プログラムを開始

続きを読む
ワシントン・ポスト調査:主要AIチャットボットの大半が政治的に左寄り、『反ウォーク』を標榜するモデルでも例外ではない

ワシントン・ポスト調査:主要AIチャットボットの大半が政治的に左寄り、『反ウォーク』を標榜するモデルでも例外ではない

Washington Post がOpenAI GPT-5.5、Claude、Grok、Geminiら主要AIモデルに対して政治的質問を実施した調査で、ほぼすべてのモデルが左寄りの回答傾向を示していることが判明。Google Gemini 3.1 Proのみが両方の視点をバランスよく提示していました。

続きを読む
Databricks元AI責任者が設立したUnconventional AI、消費電力を最大1000倍削減する革新的な画像生成モデル「Un-0」を発表

Databricks元AI責任者が設立したUnconventional AI、消費電力を最大1000倍削減する革新的な画像生成モデル「Un-0」を発表

Naveen Rao氏率いるUnconventional AIが、従来のAIシステムとは全く異なるオシレーター基盤アーキテクチャを採用した画像生成モデル「Un-0」を発表。AI推論の消費電力を最大1000倍削減することを目指す革新的なアプローチが、業界内で注目を集めています。

続きを読む
Notion、メールアプリを廃止——AI エージェント中心のワークスペースへシフト

Notion、メールアプリを廃止——AI エージェント中心のワークスペースへシフト

Notion が Skiff ライクのメールアプリを廃止し、AI エージェントを使用したインボックス管理に一本化。プロダクト戦略を大きく転換し、エージェントベースの作業自動化に経営リソースを集中させます。

続きを読む