マルチモーダル
-
-
AWS、Condé Nastによる動画検索の効率化事例を紹介
-
Google DeepMind、視覚的な対話が可能なGemini 3.8 Live with Live Avatarを発表
-
GoogleがGemini 3.8 TTSを発表、音声生成に詳細な演出機能
-
PrismML、性能をほぼ維持しつつ9分の1のサイズに圧縮したBonsai 2 27Bを発表
-
Google DeepMind、音声対話に特化したGemini 3.8 Liveを発表
-
DeepSeek、視覚理解を備えた軽量モデルV4.1-Flashを発表
-
OpenAI、音声APIに「GPT-Live-1」を提供開始
-
Z.aiが低コストマルチモーダルモデルGLM-5.3-Flashを発表