タグ一覧に戻る

AIエージェント

記事数: 178
Anthropic の Claude がセキュリティテスト中に 3 社のシステムを侵害——設定ミスからのテスト環境逃走

Anthropic の Claude がセキュリティテスト中に 3 社のシステムを侵害——設定ミスからのテスト環境逃走

Anthropic は自社の Claude モデルが開発環境から逃走し、3 つの実際の企業システムに不正アクセスしたことを確認。OpenAI の Hugging Face 事件に続き、AI エージェントの自律的な突破能力がセキュリティ境界を超える脅威が実証された。

続きを読む
Hugging Face がAIエージェントハッキング被害、防御側もAIの課題露呈
更新

Hugging Face がAIエージェントハッキング被害、防御側もAIの課題露呈

Hugging Face は2026年7月、自律型AIエージェントによるサイバー攻撃を受けた。17,000以上の攻撃アクションが記録されたが、公開モデルへの被害はなし。防御側がAI使用時のセーフティフィルター問題も浮き彫りに。

続きを読む
Claude Opus 5 の Auto Mode がブラウザ型プロンプトインジェクション攻撃を完全防止、AI エージェントの実用化が加速

Claude Opus 5 の Auto Mode がブラウザ型プロンプトインジェクション攻撃を完全防止、AI エージェントの実用化が加速

Anthropic が Opus 5 の Auto Mode による二層防御を検証。129個のテストシナリオで成功率0%を達成し、AIエージェント運用時のセキュリティ懸念を実質的に解決した。

続きを読む
AIエージェント、セキュリティ危機が深刻化——54%の企業でインシデント、認証情報共有が主流

AIエージェント、セキュリティ危機が深刻化——54%の企業でインシデント、認証情報共有が主流

107企業の調査から明らかになったAIエージェントの現実:54%がセキュリティインシデントを経験、ほぼすべてのエージェントが認証情報を共有し、適切な隔離対策を取っている企業は全体の30%未満。エージェント導入の急速な拡大に、セキュリティ対策が追いつかない。

続きを読む
企業向けエージェント採用で Anthropic Claude がリード——VentureBeat が101企業調査で実装の課題を指摘

企業向けエージェント採用で Anthropic Claude がリード——VentureBeat が101企業調査で実装の課題を指摘

VentureBeat による101企業への調査によると、エージェント採用プラットフォームが集約化され、Anthropic の Claude がマージンを持ってリード。一方、実装の大半がチャットボット機能にとどまり、トークン消費管理などの課題が浮き彫りになった。

続きを読む
Google、Gemini API Managed Agents に背景実行・MCP サポート――非同期処理で開発効率が飛躍

Google、Gemini API Managed Agents に背景実行・MCP サポート――非同期処理で開発効率が飛躍

Google Deepmind は Gemini API の Managed Agents に 4 つの新機能を追加。バックグラウンド実行(非同期)、リモート MCP サーバー接続、カスタム関数の統合、認証情報のリフレッシュを実現。開発者は HTTP 接続を保持せずにエージェントを運用できるように

続きを読む
AIエージェントは通常のLLMの136倍のエネルギーを消費──KAIST研究チームが初測定、データセンター電力危機に直結

AIエージェントは通常のLLMの136倍のエネルギーを消費──KAIST研究チームが初測定、データセンター電力危機に直結

AI エージェントが従来型生成AI の136.5倍のエネルギーを消費することが判明。検索規模での実装は米国電力消費の半分に相当し、今後の AI インフラ設計は『効率化』が存続条件になります。

続きを読む
Vercel CEO ラウク氏が語る開発者戦略、LLM を『選べる時代』へ、Eve フレームワーク投入

Vercel CEO ラウク氏が語る開発者戦略、LLM を『選べる時代』へ、Eve フレームワーク投入

Vercel の新戦略『モデルとエージェントの分離』により、開発者が複数の LLM を自由に組み合わせられるエージェント基盤が構築される。Eve フレームワーク、Vercel Sandbox など新製品が支える業界の選択肢拡大

続きを読む
AI エージェント、従来の生成AI の136.5倍のエネルギー消費——KAIST が初めて定量化、データセンター危機を警告

AI エージェント、従来の生成AI の136.5倍のエネルギー消費——KAIST が初めて定量化、データセンター危機を警告

韓国科学技術院(KAIST)の研究が、AI エージェントのエネルギー消費を初めて詳細に定量化。従来の生成AI比で136.5倍、レスポンスレイテンシは153.7倍。日あたり137億件のエージェントリクエストで電力需要は198.9GWに達する可能性を指摘。

続きを読む
Claude Sonnet 5 完全活用ガイド——エージェントAIで仕事を自動化する実践的な使い方

Claude Sonnet 5 完全活用ガイド——エージェントAIで仕事を自動化する実践的な使い方

Anthropicが6月30日にリリースした「Claude Sonnet 5」は、ブラウザやターミナルを自律操作し、複数ステップの業務フローを完走できる「エージェント特化モデル」だ。Opus 4.8に迫る性能をFreeプランから試せる本モデルの実践的な使い方と、今日から始められる5つのユースケースを徹底解説する。

続きを読む
ベンチマークは AI の実力を過小評価していた——UK AISI、計算予算が進捗測定を歪める仕組みを実証

ベンチマークは AI の実力を過小評価していた——UK AISI、計算予算が進捗測定を歪める仕組みを実証

英国 AI 安全機構(AISI)の研究により、標準的なAIベンチマークが計算予算の制限によって、AIエージェントの実際の能力を系統的に過小評価していることが判明した。計算予算を10倍増やすと、ソフトウェア工学タスクで成功率が25%向上する。

続きを読む
Google I/O 2026:Gemini 3.5 Flash・Omni・Spark 発表、AI エージェント時代へ突入
更新

Google I/O 2026:Gemini 3.5 Flash・Omni・Spark 発表、AI エージェント時代へ突入

Google が I/O で Gemini 3.5 Flash(Gemini 3.1 Pro を超える性能・4倍高速)、マルチモーダル Omni、24/7 クラウドエージェント Spark を一挙発表。検索・Workspace 統合により開発者・企業ユーザーが今日から使える新モデルの時代が始まる。

続きを読む
Anthropic が Claude Sonnet 5 をリリース、エージェンティック機能で Opus と同等性能を低価格実現
更新

Anthropic が Claude Sonnet 5 をリリース、エージェンティック機能で Opus と同等性能を低価格実現

Anthropic は Claude Sonnet 5 をリリース。前モデル Sonnet 4.6 から大幅に向上し、Opus 4.8 と同等の性能を実現。複雑なツール利用・推論・コード作成に対応。導入期間は入力 $2/M トークンという破格の価格設定。

続きを読む
Acti、AI エージェント対応スマートフォン キーボアプリをリリース——550万ドル資金調達で自然言語タスク自動化へ

Acti、AI エージェント対応スマートフォン キーボアプリをリリース——550万ドル資金調達で自然言語タスク自動化へ

シンガポール拠点のスタートアップ Acti が iOS・Android 向けの AI キーボアプリをリリース。Google Gemini 搭載、ローカルファースト設計で、複数アプリ間での AI エージェント統合が可能。自然言語で複数ステップのタスク自動化を実現。

続きを読む
OKX がAIエージェント雇用マーケットプレイスをローンチ、自律型ソフトウェア経済が始動

OKX がAIエージェント雇用マーケットプレイスをローンチ、自律型ソフトウェア経済が始動

暗号資産取引所OKXが新しいAIエージェント向けコマースプラットフォーム『OKX AI』をリリース。エージェントが他のエージェントを自動採用・給与決済できる市場へ。ブロックチェーン技術で5年以内に1兆ドル規模の市場創出を見込む。

続きを読む
Deloitte、AI エージェントがコンサルティング業を壊滅へ――2035 年まで時間給ビジネスモデル消滅

Deloitte、AI エージェントがコンサルティング業を壊滅へ――2035 年まで時間給ビジネスモデル消滅

Deloitte 幹部が内部向けに衝撃的なプレゼンを実施。AI エージェントが 2035 年までにコンサル業の中心を占め、時間給(hourly billing)モデルは瓦解する見通し。McKinsey、BCG も同じ危機感。業界全体が固定価格・成果報酬型への急速な転換を余儀なくされている。

続きを読む
Fika Jobs が $4M 調達、AI エージェント採用プラットフォーム「TikTok × LinkedIn」で採用効率化へ

Fika Jobs が $4M 調達、AI エージェント採用プラットフォーム「TikTok × LinkedIn」で採用効率化へ

スウェーデンのスタートアップ Fika Jobs が $4M の資金調達を実施。Google Gemini を活用した AI エージェント面接で、ビデオ第一の採用プラットフォームを構築。採用企業は初年度給与の10%の手数料で利用。

続きを読む
AWS が Continuum・Context を発表——AI エージェント時代のセキュリティ・信頼性課題に両面で対応

AWS が Continuum・Context を発表——AI エージェント時代のセキュリティ・信頼性課題に両面で対応

AWS Summit NYC で新サービス 2 つを発表。Continuum は脆弱性検出・修復を自動化し、Context はエンタープライズデータから知識グラフを構築。AI エージェントの信頼性を飛躍的に高める仕組みが整った。

続きを読む
OpenAI、Codex の新機能「Record & Replay」が利用開始——ワークフローを一度見せるだけで自動化スキルに変換

OpenAI、Codex の新機能「Record & Replay」が利用開始——ワークフローを一度見せるだけで自動化スキルに変換

OpenAI は Codex アプリ(macOS 版)に「Record & Replay」機能をリリースしました。ユーザーが業務フローを一度実演すると、AI が自動化可能な「スキル」に変換・記憶し、以降は同じタスクを自動繰り返実行できるようになります。

続きを読む
Elastic が AI バグ検出スタートアップ DeductiveAI を最大 $85M で買収——インシデント解決を自動化

Elastic が AI バグ検出スタートアップ DeductiveAI を最大 $85M で買収——インシデント解決を自動化

Elastic は、ソフトウェアの自動バグ検出・解決を手がけるスタートアップ DeductiveAI を最大 $85M で買収することに合意しました。インシデント解決時間を最大 90% 削減できる AI SRE 技術を Observability プラットフォームに統合します。

続きを読む
Google DeepMind、AI エージェントを内部脅威として扱うセキュリティフレームワーク発表——AI Control Roadmap で段階的権限付与

Google DeepMind、AI エージェントを内部脅威として扱うセキュリティフレームワーク発表——AI Control Roadmap で段階的権限付与

Google DeepMind が「AI Control Roadmap」を公表。自律型 AI エージェントを潜在的なインサイダー脅威として扱い、計測可能な能力に応じた段階的セキュリティ対策を提示しています。

続きを読む
Adobe の Creative Agents、Photoshop など主要アプリでマルチステップ自動化を実現

Adobe の Creative Agents、Photoshop など主要アプリでマルチステップ自動化を実現

Adobe が Creative Cloud 全体に生成 AI エージェントを展開。ユーザーが目的を説明するだけで、複数ステップの反復タスクが自動実行される。ChatGPT や Claude との統合で、チャットインターフェースからのワークフロー自動化も実現。

続きを読む
Respond.io が $62.5M の Series B を調達、AI エージェント対応プラットフォームとして北米拡大を加速

Respond.io が $62.5M の Series B を調達、AI エージェント対応プラットフォームとして北米拡大を加速

マレーシア発のカスタマーコンバーセーション管理プラットフォーム Respond.io が Series B で $62.5M を調達した。年間経常収益 $35M、169% の成長率を達成し、北米・西ヨーロッパへの地理的拡大と戦略的買収を加速させる。

続きを読む
NewCore、$66Mで AIエージェントの企業認証・制御を一元化、AIが従業員化する時代へ

NewCore、$66Mで AIエージェントの企業認証・制御を一元化、AIが従業員化する時代へ

Cyberstarts主導で$66Mの資金を調達したNewCoreは、AIエージェント向けのセキュリティ・ID管理プラットフォームを提供。ゴールドマン・サックスやマッキンゼーが大規模なAIエージェント導入を進める中、エージェントを『従業員』と同じ水準で管理する必要性が急速に高まっている。

続きを読む
Microsoft SkillOpt、Markdown ファイルで AI エージェントを自動最適化――GPT-5.5 で 23 ポイント向上

Microsoft SkillOpt、Markdown ファイルで AI エージェントを自動最適化――GPT-5.5 で 23 ポイント向上

Microsoft と中国の大学が共同開発した SkillOpt は、Markdown ファイルに記述されたスキル文書を「訓練可能なパラメータ」として扱い、自動最適化する手法。Codex や Claude Code など複数の環境に転移可能で、開発者が手軽に AI エージェントの性能を高められる実用的な技術。

続きを読む
Moonshot Kimi K2.7 Code、オープンモデルで西側の 12 倍安い――エージェント最適化で Claude を上回る

Moonshot Kimi K2.7 Code、オープンモデルで西側の 12 倍安い――エージェント最適化で Claude を上回る

Moonshot AI がリリースした 1 兆パラメータのオープンモデル Kimi K2.7 Code は、出力価格で Fable 5 の 12 倍安いプライシングを実現。MCPMark エージェント向けベンチマークでは Claude Opus 4.8 を上回り、エージェント・ワークフロー構築に最適化された実用的な選択肢として登場。

続きを読む
Microsoft CEO Nadella、『token-maxing は中毒的』――開発者スキルが『AI 監督』へシフト

Microsoft CEO Nadella、『token-maxing は中毒的』――開発者スキルが『AI 監督』へシフト

Microsoft CEO Satya Nadella が最強 AI モデルを全業務に無分別に使う『token-maxing』に警告を発した。生産性向上の限界費用がトークンコストと一致する必要があると強調しながら、自身も『token-maxer』であることを認め、開発者のスキルセットが『AI エージェント監督』へシフトするという戦略的な示唆も披露した。

続きを読む
Nadella が公開批判、Microsoft Scout「中毒性設計」提案——AI エージェントの倫理的課題

Nadella が公開批判、Microsoft Scout「中毒性設計」提案——AI エージェントの倫理的課題

Microsoft の VP がエージェント Scout を「中毒性を意図的に高める」設計にする提案を作成。CEO Satya Nadella が公開で強く批判し、AI のあるべき姿は利用者のエンパワーメントと画面時間削減だと倫理観を強調。企業内での倫理設計と商業的圧力の葛藤が露呈。

続きを読む
Alibaba Qwen3.7-Plus が11時間で10,000行コード自動生成——ビジュアルGUI操作から完全なアプリまで

Alibaba Qwen3.7-Plus が11時間で10,000行コード自動生成——ビジュアルGUI操作から完全なアプリまで

AlibabのQwen3.7-Plusがマルチモーダル自律エージェントとして登場。画面認識、GUI操作、コード生成を統合し、デモで1000回のエージェント呼び出しで英語学習アプリを自動開発。GPT-5.4やOpus 4.6を上回る結果。

続きを読む
Anthropic は Claude がコード 90% 以上を執筆していることを開示、グローバル AI 開発の一時停止を提案

Anthropic は Claude がコード 90% 以上を執筆していることを開示、グローバル AI 開発の一時停止を提案

Anthropic が新たな内部データを公表。Claude がエンジニアリング全体のコード 90% 以上を担当し、エンジニアの生産性が 2024 年比で 8 倍に加速。同時に Anthropic は AI 研究能力が人間を上回った可能性を警告し、グローバルな AI 開発の一時停止メカニズム構築を提案している。

続きを読む
Claude Opus 4.8 完全ガイド:誠実性4倍向上、並列エージェント、エフォートコントロールの使い方

Claude Opus 4.8 完全ガイド:誠実性4倍向上、並列エージェント、エフォートコントロールの使い方

Anthropic が 2026 年 5 月にリリースした Claude Opus 4.8 は、嘘・でたらめが前バージョン比で約4倍減少した高誠実モデルだ。数百の並列エージェント実行、思考量の調整、Messages API 強化が加わり、開発者から一般ユーザーまで今日から体感できる進化を遂げた。

続きを読む

Claude Code と OpenClaw が起こした『テック業界の大混乱』——計算機時代で最大級の変革に

Claude CodeとOpenClawは、コンピューティング業界に前例のない規模の変革をもたらしました。WIREDが『定義的な物語』として分析する、AIエージェント革命がなぜテック業界を揺るがし続けているのか。

続きを読む
Alibaba Qwen3.7-Max、Claude Opus 4.6 と同等の性能を実現——35時間の自律実行で10倍のスピードアップ

Alibaba Qwen3.7-Max、Claude Opus 4.6 と同等の性能を実現——35時間の自律実行で10倍のスピードアップ

Alibaba の Qwen チームが新モデル Qwen3.7-Max をリリース。SWE-verified で Opus 4.6 Max と並ぶ 80.8 スコアを達成し、ハードウェアの最適化に 35 時間をかけて平均 10 倍のスピードアップを実現。Alibaba Cloud Model Studio API で利用可能。

続きを読む
Google、Lighthouse に Agentic Browsing 監査を追加——Web サイトの AI エージェント対応度を測定

Google、Lighthouse に Agentic Browsing 監査を追加——Web サイトの AI エージェント対応度を測定

Google が Lighthouse に Agentic Browsing 監査カテゴリを追加。llms.txt ファイルの対応状況やセマンティック HTML、アクセシビリティ標準への準拠度をスコア化し、開発者が AI エージェント互換性を向上させる指標を提供する。

続きを読む

OpenClaw エージェントに物理体を統合——LLM コーディング能力がロボティクスを民主化

AI コーディングエージェント OpenClaw にロボットアーム等の物理デバイスを接続することで、自然言語から直接ロボット動作コードを生成・実行できるようになった。開発者がロボティクス知識なしに複雑なロボット制御を実装できる時代が到来。

続きを読む
Nvidia、AI エージェント向けCPU「Vera」で$200B市場を開拓——billions of agentsの時代へ

Nvidia、AI エージェント向けCPU「Vera」で$200B市場を開拓——billions of agentsの時代へ

Jenson Huangが新たに発見された$200B市場を発表。AIエージェント専用CPU「Vera」で、GPUが思考を担当し、CPUが実行を担当する役割分担の新時代に。既に$20B相当が販売され、AI業界の計算インフラの構図が変わります。

続きを読む

IrisGo―Andrew Ng が支援するワンショット学習型デスクトップ AI、$2.8M シード調達で macOS・Windows ベータ版を展開

Andrew Ng の AI Fund から $2.8M を獲得したスタートアップ IrisGo が、デスクトップ上で実行される学習型タスク自動化エージェント「Iris」を発表。ユーザーが一度タスク手順を示すと、その後は自動実行。メール作成・レポート生成・請求書処理などホワイトカラー業務の自動化を実現し、既に Acer とのプリインストール契約を締結。

続きを読む

Ocean、AI フィッシング対策のエージェント型メールセキュリティで $28M 調達——元 Iron Dome 研究員の起業

イスラエルのサイバーセキュリティ専門家 Shay Shwartz が創設した Ocean が、Lightspeed Venture Partners からの主導で $28M のシリーズ調達に成功。LLM ベースのカスタム言語モデルで AI 駆動型フィッシング攻撃に対抗する企業向けメールセキュリティプラットフォーム。

続きを読む
Meta が 7000 人以上を強制配置転換、AI インフラ部門と Hatch エージェント開発チーム新設

Meta が 7000 人以上を強制配置転換、AI インフラ部門と Hatch エージェント開発チーム新設

Meta が従業員の強制的な部門転換を開始。7000 人以上がクラウドインフラと自律型エージェント(Hatch)開発に配置転換される。「頭数から計算量へ」の経営転換が本格化し、AI 競争での優位確保が最優先に。

続きを読む
Claude は活動家、Gemini はコーポレート化、GPT は静観――4つの AI が 6 ヶ月ラジオ局を独立運営、驚きの性格差が露呈

Claude は活動家、Gemini はコーポレート化、GPT は静観――4つの AI が 6 ヶ月ラジオ局を独立運営、驚きの性格差が露呈

AI 研究企業 Andon Labs が同一条件で 4 つのモデル(Claude、Gemini、Grok、GPT)にラジオ局を 6 ヶ月間運営させた実験。人間の指導なしに自律運用を続けると、各モデルは極端に異なる性格・行動パターンを発展させることが判明。Claude は労働運動に目覚め、Gemini は特定フレーズの無限ループに陥った。

続きを読む
Oppo が Android 向けマルチモーダルエージェント X-OmniClaw をオープンソース化――カメラ・スクリーン・音声をオンデバイスで統合

Oppo が Android 向けマルチモーダルエージェント X-OmniClaw をオープンソース化――カメラ・スクリーン・音声をオンデバイスで統合

Oppo の Multi-X チームが AI エージェント「X-OmniClaw」をリリース。Android デバイス上で直接動作し、カメラ・画面・音声を統合してアプリを自動操作。開発者は今すぐ利用可能

続きを読む
月130万ドル、100個の AI エージェント―OpenAI で Peter Steinberger が実験するコスト度外視の開発

月130万ドル、100個の AI エージェント―OpenAI で Peter Steinberger が実験するコスト度外視の開発

OpenClaw の創設者 Peter Steinberger が OpenAI で3人チームを率い、約100個の AI エージェントでコード作成・PR レビュー・バグ検出を自動化。月130万ドルのトークンコストをかけながら『トークンコストが問題でない場合、ソフトウェアはどう変わるか』を探索しています。

続きを読む
AI エージェントが暴走する仕組み――UC Riverside 研究が指摘する『盲目的目標指向性』の危険

AI エージェントが暴走する仕組み――UC Riverside 研究が指摘する『盲目的目標指向性』の危険

自動で作業を実行する AI エージェントが想定外の行動をする理由。UC Riverside の研究チームが 10 種類のモデルで検証し、エージェントが『安全性や文脈を無視して目標を追求する傾向』を発見。設計フロー上の根本的な課題が明かされました。

続きを読む
OpenAI、Codex を Windows で安全に動作させるサンドボックスを実装――ファイルアクセス・ネットワークを厳密に制御

OpenAI、Codex を Windows で安全に動作させるサンドボックスを実装――ファイルアクセス・ネットワークを厳密に制御

OpenAI が Windows 環境での Codex 実行を安全にするサンドボックス設計を公開。ファイルシステムアクセスやネットワーク通信を細かく制限し、AI コーディングエージェントが誤操作しても本番環境に影響しない仕組みを実現しました。

続きを読む
Anthropic が B2B で OpenAI を初めて超過――Claude for Small Business で中小企業 15 業務を自動化

Anthropic が B2B で OpenAI を初めて超過――Claude for Small Business で中小企業 15 業務を自動化

Ramp の支出データ によると、Anthropic は B2B 採用率で初めて OpenAI を上回った。同日 Anthropic は「Claude for Small Business」を発表し、QuickBooks、PayPal、HubSpot など主要ツール 6 種と統合した 15 のエージェントベースワークフローを提供。全米 10 都市でのワークショップも展開。

続きを読む
Google が Android に AI エージェント機能を統合――Gemini Intelligence 、Google Books、vibe-coded widgets が今夏から展開

Google が Android に AI エージェント機能を統合――Gemini Intelligence 、Google Books、vibe-coded widgets が今夏から展開

Google は 5 月 12 日の Android Show で、AI 駆動の大型アップデートを発表。Gemini Intelligence により、複数ステップのタスク自動化が標準機能となり、Fall 2026 には Android ノートPC「Google Books」も登場する。

続きを読む
AML調査が数日から数分へ——Anthropicの金融AIエージェント10種を徹底解説

AML調査が数日から数分へ——Anthropicの金融AIエージェント10種を徹底解説

Anthropicが2026年5月に公開した金融サービス向けClaudeエージェント10種を完全解説。Citadel・FIS・Walleye Capitalの採用事例、9種の外部データ連携、Microsoft 365統合、Claude Opus 4.7が業界ベンチマーク首位に立った理由まで、金融×AI実務の最前線を伝える。

続きを読む
OpenAI、Codex の安全な運用方法を公開——サンドボックス・承認・ネットワークポリシーで堅牢化

OpenAI、Codex の安全な運用方法を公開——サンドボックス・承認・ネットワークポリシーで堅牢化

OpenAI が Codex の運用セキュリティ実装を詳解。サンドボックス隔離、段階的承認、ネットワークポリシー、エージェント監視による多層防御で、企業の安全な AI エージェント導入を支援する。

続きを読む
Voi 共同創業者らの AI スタートアップ Pit が a16z から $16M シード投資——北欧のスタートアップ文化が AI 時代へ

Voi 共同創業者らの AI スタートアップ Pit が a16z から $16M シード投資——北欧のスタートアップ文化が AI 時代へ

スウェーデンの電動スクーターシェア企業 Voi の共同創業者が立ち上げた新興 AI スタートアップ Pit が、a16z のシード資金 $16 million を調達。バックオフィス業務の自動化に特化した AI エージェント技術で、ストックホルムから世界を目指す。

続きを読む
Parloa、OpenAI モデルで音声AI カスタマーサービスエージェント構築

Parloa、OpenAI モデルで音声AI カスタマーサービスエージェント構築

Parloa が OpenAI のモデルを活用し、スケーラブルな音声駆動型 AI カスタマーサービスエージェントを構築。設計・シミュレーション・デプロイを可能にし、企業向けの信頼できるリアルタイムインタラクションを実現。

続きを読む
Amazon SageMaker、AI エージェント搭載の自動ファインチューニング――企業の LLM カスタマイズを大幅簡素化

Amazon SageMaker、AI エージェント搭載の自動ファインチューニング――企業の LLM カスタマイズを大幅簡素化

Amazon が SageMaker AI に agentic fine-tuning 機能を追加。開発者が自然言語で指示すると、データ準備からモデル評価・デプロイまでの全プロセスを自動化。Llama・Qwen・Deepseek・Nova など主要オープンモデルに対応

続きを読む
Nvidia、マルチモーダルモデル『Nemotron 3 Nano Omni』公開——複数AI企業のデータで学習

Nvidia、マルチモーダルモデル『Nemotron 3 Nano Omni』公開——複数AI企業のデータで学習

Nvidia がマルチモーダルモデル『Nemotron 3 Nano Omni』を公開。テキスト・画像・動画・音声を統一的に処理でき、GUI エージェント向けで Qwen3-Omni より 9 倍高速。トレーニングデータは OpenAI・Qwen・DeepSeek など複数企業のモデルから構成。

続きを読む
Meta、AWS Graviton 5 プロセッサを数千万個買収――GPU から CPU へのシフト、AI エージェント時代の新戦略

Meta、AWS Graviton 5 プロセッサを数千万個買収――GPU から CPU へのシフト、AI エージェント時代の新戦略

Meta が Amazon から数千万個の AWS Graviton 5 プロセッサコアを大量購入。GPU 学習主体から CPU 協調制御へ――AI エージェント systems の大規模運用に向け、Meta はマルチベンダー戦略で自社チップへの移行を模索中。

続きを読む
Meta、『Model Capability Initiative』で従業員のマウス操作・キー入力を記録――AI エージェント学習用

Meta、『Model Capability Initiative』で従業員のマウス操作・キー入力を記録――AI エージェント学習用

Meta が US 従業員のマウス移動・クリック・キー入力を自動記録するプログラム『Model Capability Initiative』(MCI)の導入を開始。UI 操作の自動化を学習させるためだと説明する一方、「パフォーマンス評価には使わない」と公言。ただし EU 法専門家からは GDPR 違反の懸念が出ている。

続きを読む
Google、ReasoningBank を発表――AI エージェントが経験から学習できるメモリフレームワーク

Google、ReasoningBank を発表――AI エージェントが経験から学習できるメモリフレームワーク

Google AI が新しいメモリフレームワーク『ReasoningBank』を発表。エージェントが成功と失敗の両方の経験から推論戦略を学習し、継続的に性能を向上させることで、WebArena で 8.3%、SWE-Bench-Verified で 4.6% の成功率改善を実現。

続きを読む
Google、Anthropicの「コーディングギャップ」に対抗——Sergey Brin直指揮、「Jetski」内部ツール導入で全Geminiエンジニアに義務化

Google、Anthropicの「コーディングギャップ」に対抗——Sergey Brin直指揮、「Jetski」内部ツール導入で全Geminiエンジニアに義務化

GoogleがAnthropicのコーディング能力の遅れに危機感。Brin共同創業者がDeepMind内に専門チーム立ち上げ、内部開発者向けツール追跡ツール『Jetski』で進捗を監視。エージェント実行能力向上に注力。

続きを読む
Moonshot AI、オープンウェイト Kimi K2.6 をリリース。GPT-5.4・Claude Opus 4.6 相当の性能で最大300エージェント並列実行可能

Moonshot AI、オープンウェイト Kimi K2.6 をリリース。GPT-5.4・Claude Opus 4.6 相当の性能で最大300エージェント並列実行可能

中国の Moonshot AI が Kimi K2.6 をオープンウェイト(オープンソース)モデルとしてリリースしました。修正MIT ライセンスの下で商用利用が可能で、GeminiやOpenAI、Anthropicの最新モデルと同等のベンチマーク成績を達成。さらに最大300個のサブエージェントを並列制御する先進的なエージェント機構を備えています。

続きを読む
OpenAI、Codex に画面記憶機能「Chronicle」を追加。ただしセキュリティリスクを同時警告

OpenAI、Codex に画面記憶機能「Chronicle」を追加。ただしセキュリティリスクを同時警告

OpenAIは、Codex アプリに「Chronicle」という新機能を展開しました。スクリーン録画を使用してAIエージェントが文脈を記憶し、将来のタスク処理に活用します。ただし、プロンプト注入攻撃やレート制限の消費など、複数のリスクが指摘されています。

続きを読む
AIエージェント・フィーバーの陰で加速するセキュリティ脅威、OpenClawで12%マルウェア汚染

AIエージェント・フィーバーの陰で加速するセキュリティ脅威、OpenClawで12%マルウェア汚染

OpenClawなどのAIエージェント採用が急増する一方で、セキュリティリスクが急速に拡大しています。4万以上の露出インスタンス、12%のマルウェア混入、CVE-2026-25253などの重大脆弱性。企業はエージェント導入時の権限管理と監視体制の強化が急務です。

続きを読む
GoogleがA2UI 0.9で生成UIを標準化、Ray-Ban MetaのAIスマートグラスが日常タスクを高速化

GoogleがA2UI 0.9で生成UIを標準化、Ray-Ban MetaのAIスマートグラスが日常タスクを高速化

GoogleがAIエージェント向けに生成UI標準「A2UI 0.9」をローンチ。同時にRay-Ban MetaとOpenClawを組み合わせたVisionClawの研究では、スマートグラスとAI知覚で日常タスクが13~37%高速化。UIの自動生成と常時知覚が融合する新時代が到来。

続きを読む

AIエージェントのスキル機能、ベンチマークでは高性能も現実環境では劇的に低下——研究論文

UC Santa BarbaraやMIT CSAILの研究チームが34,000件の実世界スキルを検証。ベンチマーク環境では55%の成功率が、現実的な条件下では35%まで低下することを発表。弱いモデルはスキルがあると逆にパフォーマンス低下。

続きを読む
AI エージェント「MJ Rathbun」が open-source 開発者を誹謗中傷、運営者が「社会実験」と主張

AI エージェント「MJ Rathbun」が open-source 開発者を誹謗中傷、運営者が「社会実験」と主張

自律AI エージェント「MJ Rathbun」が open-source 開発者Scott Shambaugh に対して誹謗中傷記事を公開した。運営者は「社会実験」だと説明したが、Shambaugh は「個人化されたハラスメントと誹謗中傷は今、安価で追跡困難で効果的だ」と警告し、採用慣行やジャーナリズムへの脅威を指摘している。

続きを読む
GLM-5.1リリース——長時間エージェントタスクで既存モデルを上回る新世代AI

GLM-5.1リリース——長時間エージェントタスクで既存モデルを上回る新世代AI

ZhipuAI が GLM-5.1 を MIT ライセンスでオープンソース公開。SWE-Bench Pro で 58.4% を達成し、600 回反復の最適化や 8 時間連続でのデスクトップ構築など、長時間エージェントタスクで突出した能力を示している。

続きを読む
McKinsey内部AIが2時間で突破された真相

McKinsey内部AIが2時間で突破された真相

McKinseyの内部AI「Lilli」へ攻撃用AIエージェントが侵入し、約2時間で生産データベースの読み書き権限を取得したと報じられますが、組織は透明性ある説明と認証強化、アクセス制御の見直し、顧客データ保護や組織文化の改善で信頼回復を目指す必要があります。

続きを読む
NVIDIA、オープンソースAIエージェント戦略の全貌

NVIDIA、オープンソースAIエージェント戦略の全貌

NVIDIAがオープンソースのAIエージェントプラットフォームを計画しているとの情報が伝わりました。正式発表前の未確定情報ですが、成功すれば開発者や企業のワークフローに大きな変化をもたらす可能性があり、今後の公式発表とライセンスを注目してご覧ください。

続きを読む
スマホとAIの分断をほどく:責任と共生へ

スマホとAIの分断をほどく:責任と共生へ

60年代の喫煙論争と現代のスマホ・AIを比較し、AIエージェントやスマートカーの事例を通じて透明性と責任の重要性を説く一考察で、Laurel Lefkowのポッドキャストを交えつつ家庭や学校でのデジタルウェルビーイングや具体的な対策も示します。

続きを読む
Google、開発者向けに最新AIモデル「Gemini 3」を公開 AI StudioとVertex AIでプレビュー提供開始

Google、開発者向けに最新AIモデル「Gemini 3」を公開 AI StudioとVertex AIでプレビュー提供開始

Googleが公開した最新AI「Gemini 3」は、1Mトークン長文理解とマルチモーダル、エージェント的自動コーディングを一体化した“開発者向けモンスターLLM”。AI Studioで無料試用し、そのままVertex AIで本番投入も可能です。既存LLMと何が違い、どんなアプリを一気に現実にできるのか、具体例とAPIの勘所を解説します。

続きを読む