AI分野において、マスクは常に他者に引けを取らないスピードで進んでいます。最新の報道によると、
今回の
実際には、
2025年5月:
2026年2月:
2026年3月: テキストから音声への
このような迅速なアップデートのペースは、
マスクにとって、

AI分野において、マスクは常に他者に引けを取らないスピードで進んでいます。最新の報道によると、
今回の
実際には、
2025年5月:
2026年2月:
2026年3月: テキストから音声への
このような迅速なアップデートのペースは、
マスクにとって、
マスクはGrokの新バージョンを推奨し、コビーのAI合成映像でテストを公開しました。Grokは画像と台詞をフレームごとに解析し、マンバスピリットなどの詳細を正確に抽出するだけでなく、最終的にそれがディープフェイクであることを判定し、強力なビデオ理解とインタラクティブな能力を示しました。
xAIがビデオモデルであるImagine Video1.5をアップグレードし、画像リファレンスや音声リファレンス、純テキストによる動画生成およびネイティブ1080p出力が追加されました。役割の一貫性とシーンの制御が強化されています。テキストから動画への変換および1080p機能は、Grok Imagineの各プラットフォームで利用可能となっています。画像および音声リファレンスは、アメリカのSuperGrok Heavy/Plusユーザーに先駆けて提供されており、後日カバー範囲が拡大される予定です。
テンセントPR責任者・張軍氏がWorkBuddyの機能更新を発表。チームで資料共有、タスク連携、進捗同期が可能になり、メンションで担当者指定もスムーズに。さらにプロジェクト内でスキルを作成し参加者全員が利用可能に。共同作業の効率が大幅向上。....
字节跳动Seedチームが発表した音声映像同時生成モデルSeedance2.5は、ワンカットでの映像制作を可能に。生成時間が15秒から30秒に延長され、複数回のシームレスな延長で物語の一貫性が向上。材質・光・肌質を最適化し、プラスチック感を低減、実写に迫る質感を実現。多様な産業シーンの効率革命を後押しする。....
アリババは音声認識の大規模モデル「Qwen-Audio-3.0-ASR-Flash」を発表しました。このモデルは専門用語の正確な認識に特化しています。コンテキストの一貫性、業界用語およびトレンド語のカスタマイズを最適化し、音声の修正機能をサポートし、構造化されたテキストを直接出力できます。チームは医療、IT、株式など多業種にわたる高品質な語彙データベースを構築しており、評価結果では業界用語の認識効果が著しく向上していることが確認されています。