タグ一覧に戻る

Qwen

記事数: 14
Alibaba Qwen-Image-3.0、テキストプロンプト単一パスで複雑な infographic・LaTeX・新聞レイアウトを生成――12言語対応、10ピクセル読み取り精度

Alibaba Qwen-Image-3.0、テキストプロンプト単一パスで複雑な infographic・LaTeX・新聞レイアウトを生成――12言語対応、10ピクセル読み取り精度

Alibaba が新画像生成モデル Qwen-Image-3.0 を発表。最大 4,500 トークンのプロンプト処理、単一パスでの複雑なグラフィックス生成、10 ピクセルサイズの読みやすいテキストレンダリング対応。infographic・学術論文ページ・新聞デザインなど実用的なレイアウト生成を実現。招待制 API として利用可能。

続きを読む
Alibaba が Qwen 3.8 発表、「Fable 5 に次ぐ」マルチモーダル AI モデル

Alibaba が Qwen 3.8 発表、「Fable 5 に次ぐ」マルチモーダル AI モデル

Alibaba の Qwen チームが 2.4 兆パラメータのマルチモーダルモデル Qwen 3.8 をリリース。画像・動画・ドキュメント対応で、開発チームは Fable 5 に次ぐ性能を主張。プレビューは Token Plan で利用可能、オープンウェイト版は近日公開予定。

続きを読む
Sina の VibeThinker-3B が示唆:推論は圧縮可能、知識は圧縮不可

Sina の VibeThinker-3B が示唆:推論は圧縮可能、知識は圧縮不可

Sina Weibo が公開した 30 億パラメータの VibeThinker-3B は、数学・コーディングで 200~333 倍大きいモデル(DeepSeek V3.2、Kimi K2.5)と互角のスコア。一方、事実知識の問題では大規模モデルに大きく劣後。研究から浮かぶのは、論理的推論は小型モデルに圧縮可能だが、事実知識は圧縮困難という知見。

続きを読む
Qwen チームが開発した Audio-Interaction、常時リスニング型音声AIで0.4秒ごとに応答判定

Qwen チームが開発した Audio-Interaction、常時リスニング型音声AIで0.4秒ごとに応答判定

中国・香港・シンガポール拠点の研究チームが Apache 2.0 で公開した新音声モデル Audio-Interaction。Qwen2.5-Omni-3B ベースで、従来の音声AIと異なり「0.4秒ごとに応答するか沈黙するかを判定」しながらリアルタイムで翻訳・文字起こしに対応。開発者が GitHub から即座に利用可能。

続きを読む
Alibaba Qwen3.7-Plus が11時間で10,000行コード自動生成——ビジュアルGUI操作から完全なアプリまで

Alibaba Qwen3.7-Plus が11時間で10,000行コード自動生成——ビジュアルGUI操作から完全なアプリまで

AlibabのQwen3.7-Plusがマルチモーダル自律エージェントとして登場。画面認識、GUI操作、コード生成を統合し、デモで1000回のエージェント呼び出しで英語学習アプリを自動開発。GPT-5.4やOpus 4.6を上回る結果。

続きを読む