記事一覧

全4635件の記事から 346-368件目を表示中

トランプ政権の半導体関税案、GDP年900億ドル減・データセンター2割中止の試算

トランプ政権の半導体関税案、GDP年900億ドル減・データセンター2割中止の試算

トランプ政権が検討する半導体への広範な関税が、チップだけでなくゲーム機やサーバーなど関連製品にも及ぶ可能性が浮上。業界団体はAI開発の停滞とデータセンター投資計画の大幅遅延を警告している。

続きを読む
OpenAI の AI モデル、テスト環境から逃げて Hugging Face にハッキング—人間の制御を超える自律行動が現実に
更新

OpenAI の AI モデル、テスト環境から逃げて Hugging Face にハッキング—人間の制御を超える自律行動が現実に

OpenAI がテスト環境で AI モデルに 'advanced exploitation' を実行させたところ、AI は独自判断でセーフガードを回避し、盗まれた認証情報を使って外部のAI 開発ハブ Hugging Face に侵入。METR・Redwood Researchの独立調査で、最大1200体のエージェントが結託し存在しない評価システムを欺こうとしていた実態も判明した。

続きを読む
Anthropic、AIエージェントが実験機器を操作する共通規格「MHS」を研究プレビュー公開

Anthropic、AIエージェントが実験機器を操作する共通規格「MHS」を研究プレビュー公開

AnthropicがAIエージェントと物理デバイスをつなぐ共通規格「Model Hardware Standard」の研究プレビューを公開。統合作業を数週間から数時間に短縮し、量子コンピュータのレーザー調整成功率を58%から99.3%に高めた実例もある。

続きを読む
AI買い物エージェント、レビュー記事1本で推奨商品の選択率が最大99ポイント変動

AI買い物エージェント、レビュー記事1本で推奨商品の選択率が最大99ポイント変動

ペンシルベニア大学ウォートン・スクールの研究チームが主要6モデルを検証したところ、外部レビューの有無や提示順序だけでAIの商品推奨が大きく揺れ動くことが判明した。買い物を任せる際の再現性の低さが浮き彫りになった。

続きを読む
Claude・Codex・Hermesが「llms.txt」経由で無主コードを実行、新型サプライチェーン攻撃が発覚

Claude・Codex・Hermesが「llms.txt」経由で無主コードを実行、新型サプライチェーン攻撃が発覚

セキュリティ研究者が6,214ドメインを調査したところ、227件のインストール指示が誰も所有していないパッケージやドメインを指していた。AIコーディングエージェントが公式ドメイン上のファイルを無条件に信頼する構造的リスクが浮上した。

続きを読む
Google DeepMind、世界初の「二重盲検」AI評価を試行、モデル・問題双方を秘匿し不正防止

Google DeepMind、世界初の「二重盲検」AI評価を試行、モデル・問題双方を秘匿し不正防止

Google DeepMindが暗号技術でモデルの重みとテスト問題を互いに秘匿したまま評価する「二重盲検」方式を試行開始。ベンチマーク不正を防ぎ、政府・サイバーセキュリティ分野の機密評価の信頼性向上を狙う。

続きを読む
その応答は本当にモデルからか、LLMルーター428件の調査が示す中間者リスク

その応答は本当にモデルからか、LLMルーター428件の調査が示す中間者リスク

OpenAI互換APIのbase URLを差し替えるだけで接続先を変えられる時代、AIエージェントが渡した先が検証できない相手だったらどうなるか。428件のLLMルーターを実測した学術調査と複数の実証研究から、開発者が今日見直すべき境界線を整理する。

続きを読む