Nvidiaが無料の話者識別AI公開、8人同時会話でもリアルタイム識別
Nvidiaが1億パラメータの音声ダイアライゼーションモデル「Nemotron 3 Diarization」をオープンウェイトで公開。最大8人の会話を誰が話しているかまで含めてリアルタイムで識別できる。
続きを読むNvidiaが1億パラメータの音声ダイアライゼーションモデル「Nemotron 3 Diarization」をオープンウェイトで公開。最大8人の会話を誰が話しているかまで含めてリアルタイムで識別できる。
続きを読むSalesforceがNvidiaのオープンウェイトモデルNemotronを土台に、営業・マーケティング・カスタマーサポート特化の推論モデル「Koa」を発表。顧客データ不使用で情報漏洩リスクを抑えつつコスト削減を狙う。
続きを読むNvidiaとPalantirがAIによるサプライチェーン管理で提携。Palantir FoundryにNemotronモデルを統合し、Nvidia自身の複雑な部品調達網で先行運用する。
続きを読むNvidiaが開発中のNemotron 4は1兆パラメータを目指しますが、Kimi K3(2.8兆)やDeepSeek V4 Pro(1.6兆)に及びません。秋リリース予定。オープンモデル普及でGPU販売も増えるという両利き戦略の真意を読み解きます。
続きを読むNvidia がマルチモーダルモデル『Nemotron 3 Nano Omni』を公開。テキスト・画像・動画・音声を統一的に処理でき、GUI エージェント向けで Qwen3-Omni より 9 倍高速。トレーニングデータは OpenAI・Qwen・DeepSeek など複数企業のモデルから構成。
続きを読むNemotron 3 Nano 4Bは約40億パラメータの小型ハイブリッドモデルで、端末上で完結する推論を現実に近づけ、プライバシー保護と導入コスト低減の恩恵をもたらす可能性を示しています。
続きを読むNemotron 2 Nano 9B日本語版は、Hugging Faceで紹介された約90億パラメータの日本語対応モデルで、日本のAI自立を後押しする可能性があり、公式発表を注視しつつデータガバナンスやセキュリティ準備を進めることが重要です。
続きを読むシンガポールとブラジルで進むNemotron-Personasを軸とした国家規模のデータ共設計について、仕組みの要点と期待される影響、今後注視すべき透明性や評価指標までわかりやすくお伝えします。
続きを読む