タグ一覧に戻る

音声認識

記事数: 32
OpenAI が GPT Transcribe 新版リリース、音声認識を 25% 値下げ・精度も向上

OpenAI が GPT Transcribe 新版リリース、音声認識を 25% 値下げ・精度も向上

OpenAI は音声認識 API「GPT Transcribe」の新版をリリース。エラー率を 3.98% から 3.31% に改善し、価格を 25% 低下させて 1 分あたり 0.0045 ドルに設定。処理速度は実時間の 34 倍を実現。競合ツール(ElevenLabs Scribe v2、Google Gemini 3 Pro)との精度比較と API 仕様を解説。

続きを読む
Cohere がアラビア語専門の音声認識モデルをオープンソース公開、Whisper を上回る性能

Cohere がアラビア語専門の音声認識モデルをオープンソース公開、Whisper を上回る性能

Cohere が20億パラメータのオープンソース音声認識モデル『Cohere Transcribe Arabic』を発表。Apache 2.0ライセンスで Hugging Face に公開。Whisper と比べて方言・コード混在・アラビア英語混交に対応。開発者が自由に活用・改善できる。

続きを読む
会議が変わる 最新AIノート端末の本当の実力

会議が変わる 最新AIノート端末の本当の実力

会議を手元で丸ごと録音し、文字起こし・要約・アクション抽出・ライブ翻訳まで担うAIノート端末の最新事情を、機能差や翻訳精度、プライバシーやコスト面の課題を交えて分かりやすく解説し、導入時の確認ポイントを具体的に示し、試すべきチェック項目や選び方のコツを紹介し、実際の導入事例も交えてイメージを掴んでいただけますぜひ!

続きを読む
Subtleの新イヤホンが変える音声入力

Subtleの新イヤホンが変える音声入力

Subtleの新イヤホンはノイズアイソレーションとデスクトップ・スマホ横断のディクテーション(音声を文字に変換する技術)を搭載し、在宅や移動中の作業を効率化する期待が高く、対応アプリの幅や騒音下での認識精度が鍵ですが、段階的な導入で利便性は大きく向上するはずです。

続きを読む