【AI日報】へようこそ!ここは毎日あなたが人工知能の世界を探索するためのガイドです。毎日、AI分野の注目ニュースをお届けし、開発者に焦点を当てて、技術トレンドや革新的なAI製品の応用を理解するお手伝いをします。
新鮮なAI製品クリックして詳細を確認:https://app.aibase.com/zh
1、アリババの新しい大規模モデル「Qwen3.8」が近づく:ベータ版がアリババクラウドとQoderに登場、正式版は近日オープンソース予定
アリババの新しい大規模モデル「Qwen3.8」がリリースされ、同時にオープンソースされる予定です。ベータ版はすでに複数のプラットフォームで公開されており、ユーザーは事前にその能力の限界を体験でき、現実的なユーザーのシナリオを通じてモデルのパフォーマンスを検証できます。

【AiBase要約:】
🚀 アリババは、新たな大規模モデル「Qwen3.8」を発表し、同時にオープンソースを行うことで、通義千問シリーズのオープンソースプロセスをさらに推進します。
🔧 「Qwen3.8-Max」のベータ版はすでに複数のプラットフォームで利用可能となり、ユーザーは新モデルの能力の限界を事前に体験できます。
📈 アリババは、ベータ版を先に公開し、その後に正式版をオープンソースすることで、製品の信号を放出しつつ、現実的なユーザーのシナリオで検証を行います。
2、字節跳動がSeed Audio 1.0を発表:音声生成は「話せる」から「創造できる」へ
字節跳動が発表したSeed Audio 1.0は、AI音声生成技術の新たな段階を示しています。このモデルは、エンドツーエンドで完全な音声作品を生成することが可能です。このモデルは正確な時空間の編成、安定した音声表現、多言語サポートなどのコアな能力を持ち、高品質な音声コンテンツ制作の門檻を大きく下げました。

【AiBase要約:】
🌱 精確な時空間の編成:100ミリ秒単位で会話や効果音の入力タイミングを制御できます。
🎭 安定した音声表現:ゼロサンプル生成と長時間の音声延長をサポートし、自然に異なる感情を表現します。
🌍 多言語サポート:20種類以上の言語をカバーし、地域の表現スタイルに合った音声を提供します。
詳細リンク:https://seed.bytedance.com/seedaudio1_0
3、面壁インテリジェンスがMiniCPM-Robotをオープンソース:1.5BパラメータのVLAモデルを完全公開、個人開発者も本物のロボットで動作可能
面壁インテリジェンスは、初めての身体的AIモデルシリーズ「MiniCPM-Robot」をオープンソースしました。これは、1.5Bパラメータを持つ視覚-言語-行動モデルであり、個人開発者が本物のロボット上で操作やターゲット追跡を行うことが可能になります。このモデルシリーズには、MiniCPM-RobotManip、MiniCPM-RobotTrack、および高性能な推論フレームワークPhyAIが含まれており、身体的インテリジェンスの普及に重要な支援を提供しています。

【AiBase要約:】
🧠 MiniCPM-RobotManip:1.5Bパラメータを持つ汎用的な視覚-言語-行動モデルで、ロボット操作に特化しています。
🔍 MiniCPM-RobotTrack:現実的な目標追跡に向けたコンパクトなモデルで、ロボットの認識能力を向上させます。
⚙️ PhyAI:高性能な推論フレームワークで、身体的モデルに効率的なサポートを提供し、ロボットの理解・記憶・行動能力の発展を促進します。
詳細リンク:https://github.com/OpenBMB/MiniCPM-Robot
4、DeepSeek V4の公式版テスト画像と実機デモが暴露、性能は注目されます
DeepSeek V4の公式版のテストビデオと実機デモが明らかになりました。その性能は非常に注目されています。価格と性能において現在の人気モデルに挑戦する可能性があります。

【AiBase要約:】
🧠 DeepSeek V4は、いくつかの主要な指標において驚異的な性能を示しており、実測値ではClaude Opus4.8に近づいています。
🎮 特定のテストでは、V4の公式版がFable5とGPT-5.6をすでに超えています。
💡 インターフェースの最適化により、思考チェーンのスタイルがClaudeに近く、出力が簡潔で読みやすくなっています。
5、アリババクラウドの百煉にHappyOyster1.0が登場:リアルタイムインタラクティブなオープンワールドモデルがグレーカスタム開始
アリババクラウドの百煉にHappyOyster1.0が登場しました。これは、リアルタイムインタラクティブなオープンワールドモデルで、AIデジタル世界を構築・探索することができます。このモデルは従来のテキストからビデオを生成するモデルとは異なり、世界状態の転移を学ぶことを主な訓練目的としています。また、2つのモード、世界探索とリアルタイムディレクターを提供しています。

【AiBase要約:】
🧠 世界探索モードでは、ユーザーがテキスト入力または画像アップロードを行い、対話可能なデジタル世界を作成できます。
🎬 リアルタイムディレクターモードでは、ストーリーの任意のノードで一時停止、巻き戻し、ストーリーの方向を調整できます。
🌐 HappyOyster1.0は、オープンワールドゲームのプロトタイプ、インタラクティブショートドラマ、仮想の仲間などに応用可能です。
6、15秒の呪文を打破:智象未来が世界初の無限時間作成エージェントvivago R1を発表、商用利用率は85%に達する
智象未来は2026年の世界人工知能大会でvivago R1を発表しました。これは世界初の無限時間のコンテンツ作成マルチモーダルエージェントであり、従来のAIビデオ作成における時間制限、論理の混乱、効果の不安定といった問題を解決します。また、智象未来は複数の機関と協力し、AI技術のグローバルな応用と生態系の建設を推進しています。

【AiBase要約:】
🧠 vivago R1は、世界初の無限時間のビデオ生成と編集機能を持つマルチモーダルなクリエイティブエージェントです。
🌐 智象未来は中国科学技術研究院類脳などの機関とともに、「一帯一路Token出海連盟」を設立し、中国のAI能力のグローバル展開を推進しています。
⚙️ 智象未来はAgentOSエージェントオペレーティングシステムを発表し、マルチエージェントの協働をサポートし、産業への導入効率を向上させています。
7、昆仑万维が2026年を世界モデルの元年に設定:Matrix-Game 3.5は1枚のカードでリアルタイム生成、5Bモデルで20FPSを達成
昆仑万维は2026年の世界人工知能大会で、2026年を世界モデルの元年に設定すると発表しました。そしてMatrix-Game 3.5、Mureka v9.5、O3音楽モデルを発表しました。これらの製品は強力なリアルタイムインタラクティブな能力と音楽創作のツール化特性を示し、AI技術がより複雑で実用的な方向へ発展していることを示しています。

【AiBase要約:】
🧠 Matrix-Game 3.5世界モデルは、ピッチレベルの記憶注入機能を持ち、リアルタイムインタラクティブな生成を実現します。
🎵 Mureka v9.5とO3音楽モデルはバージョン化された創作をサポートし、ツール感を向上させます。
🚀 昆崙萬維は2026年を世界モデルの元年に定義し、AIによるインタラクティブな世界生成の起点となることを目指しています。
詳細リンク:https://github.com/Riemann-Dynamics/Matrix-Game-3.5
8、騰訊混元Hy3の無料キャンペーンが8月5日まで延期、WorkBuddyとCodeBuddyユーザーは引き続き無料利用可能
騰訊混元Hy3の無料キャンペーンが8月5日まで延期されました。これは、実際に業務環境で使用範囲を広げ、ユーザーからのフィードバックを収集してモデルの能力を最適化することを目的としています。

【AiBase要約:】
🧠 腾讯混元Hy3の無料キャンペーンが8月5日まで延期され、WorkBuddyとCodeBuddyユーザーは引き続き無料で利用できます。
💻 Hy3モデルはコード生成、開発補助およびワークフローの場面で優れた性能を発揮しており、多くのユーザーにテストされています。
📈 遅らせられた無料体験期間を通じて、腾讯はHy3の実際の業務環境での使用範囲を拡大し、モデル能力の最適化のためにユーザーからのフィードバックを収集したいと考えています。
