【AIデイリーレポート】へようこそ!ここは毎日、人工知能の世界を探索するためのガイドです。毎日、AI分野のホットな情報をあなたにお届けし、開発者に焦点を当て、技術のトレンドを理解し、革新的なAI製品の応用を紹介します。

新鮮なAI製品クリックして詳細を見るhttps://app.aibase.com/zh

1. ドウボー2.1Proが火山方舟にリリースされ、飛書8.0にチームスマートエージェント「ドウボー作業パートナー」が導入されました

バイトダンス系の企業生産性製品が重要なアップデートを発表しました。火山エンジンはドウボー大モデルを0915バージョンにアップグレードし、APIへのアクセスを最適化しました。一方、飛書は8.0バージョンをリリースし、チームスマートエージェント「ドウボー作業パートナー」を導入し、AIを個人アシスタントからチーム協働へと変革させました。

image.png

【AiBase要約:】

🧠 モデルの強化により、証拠の追跡やデータの検証が向上し、複雑なタスクの安定性が向上しました。

💻 多モダールプログラミング能力が強化され、コードリポジトリの分析と修復テストが可能になりました。

👥 チームスマートエージェント「ドウボー作業パートナー」の導入により、AI協働と共有が実現されました。

2. 生数科技がVidu S2を正式リリース、リアルタイム編集、動的参照画像、ヘッドマウントディスプレイ対応をサポート

生数科技はVidu S2ビデオ大規模モデルシリーズを正式リリースしました。このシリーズにはAvatarとEditingの2つの主要モデルが含まれており、VRヘッドマウントディスプレイ空間におけるビデオ生成と編集機能を探索し、強力な技術力と応用可能性を示しています。

image.png

【AiBase要約:】

🎥 Vidu S2-Avatarは音声コントロールと動的参照画像をサポートし、高いインタラクティブな自由度を持つデジタルキャラクターの生成を実現します。

📹 Vidu S2-Editingはビデオストリームのリアルタイム編集を実現し、スタイル移行、仮想試着、人物交換、背景交換が可能です。

🕶️ 生数科技はVRヘッドマウントディスプレイ空間でのビデオ生成と編集機能を探索し、没入型体験を向上させます。

3. Claudeの重大なアップデート:43のマルチタスクワークフローと27の巨頭アプリとの深く統合

Anthropicは「中小企業版Claude」に大きな機能アップデートを実施し、43の効率的なワークフローおよび27の主流ビジネスソフトウェアとの深い統合を提供し、中小企業が人工知能を核心的なビジネス駆動力として活用することを目的としています。

image.png

【AiBase要約:】

🧠 43の効率的なワークフローにより中小企業の効率が向上します。

🤝 27の主流ビジネスソフトウェアとの深い統合により、包括的なエコシステムが構築されます。

🔒 セキュリティとデータプライバシーの管理が強化され、企業のデータセキュリティが確保されます。

4. グーグルが多言語AI新戦略を発表、すべての言語が聞こえ、理解されるように

グーグルは多言語AI新戦略を発表し、世界中のすべての言語が聞こえ、理解されるようにすることを目指しています。この戦略には、300種類以上の言語をサポートし、リアルタイムの口語翻訳、低リソース言語のサポート、アクセシビリティ設計などが含まれています。

image.png

【AiBase要約:】

🌐 グーグルは多言語AI技術を展開し、世界の71億人、86%の人々をカバーしています。

🎙️ オリジナル音声インテリジェンスを推進し、70種類の言語間でリアルタイムの口語翻訳を実現します。

🌍 「1,000言語プロジェクト」とオープンソースデータ協力を通じて、低リソース言語のサポートを強化します。

5. 中文インターネット基礎語料4.0が正式リリース、120GBの高品質信頼性データが登場

中文インターネット基礎語料4.0のリリースは、中国が人工知能分野において重要な進展を遂げたことを示しており、大規模モデルの訓練と産業の高品質発展に堅固なデータ支援を提供しています。

image.png

【AiBase要約:】

🧠 中文インターネット基礎語料4.0のリリースにより、大規模モデルの訓練にデータを提供します。

🌐 中央ネットワーク情報弁公室の指導のもと、複数の業界機関がプロジェクトを共同で推進しています。

📊 120GBの高品質信頼性データが登場し、人工知能産業の発展を促進します。

6. OpenAI内部のLilyプロジェクトが暴露、ユーザーのプライベートチャット履歴を人工審査員が確認している?

記事はOpenAI内の「リリー計画」を明らかにし、ユーザーのチャット履歴を人工審査員が品質評価を行うこと、そしてプライバシーに関する懸念を引き起こしました。

image.png

【AiBase要約:】

🧠 ChatGPTユーザーのチャット履歴を人工審査員が品質評価を行っています。

🔒 审査中にプライバシー漏洩のリスクがあり、ユーザーの個人情報が含まれる可能性があります。

🔄 OpenAIはユーザーにそのチャット履歴が人工的に審査される可能性があることを明確に伝えていません。

7. vivoのブルーハート大モデル全面アップデート:4つのモデルが登場、聞くことができる、記憶できる、できることも可能

vivoは2026年の開発者カンファレンスでブルーハート大モデルの全面アップデートを発表し、4つの主要モデルをリリースしました。これらのモデルは音声理解、エッジ側の感知・記憶、クラウド側のタスク実行をカバーし、スマートエージェント大規模モデル分野におけるリーダーシップを示しています。

image.png

【AiBase要約:】

🧠 ブルー音声大モデルBlue LM-RealTimeは強力な環境適応能力を持ち、騒音、口調、中英混合などの複雑な状況下での音声入力を認識できます。

💾 ブルー端末大モデルBlue LM-Nanoはリアルタイムで個人の記憶を感知し蓄積し、さまざまな情報タイプを統合処理し、長期的にユーザーの習慣と好みを記録します。

⚙️ ブルークラウド大モデルBlue LM-FlashとBlue LM-Proは自社開発のAgenticエンジンとシステムレベルのHarnessと深く協働し、スマホのタスクコントローラーとして機能し、デバイス間やアプリ間のタスク実行を実現します。

8. GoogleがGemini 3.8 Liveを公式発表、「話しながら考える」を創出、業界を変える

GoogleはGemini 3.8 Liveとその拡張バージョンを発表し、音声インタラクション分野で大きな突破を達成しました。特に低遅延の音声ストリームで深い推論能力を実現し、音声AIの応用に新たな変化をもたらしました。

image.png

【AiBase要約:】

🧠 Gemini3.8Liveは低遅延の音声ストリーム内で深い多段階推論能力を実現し、音声AIの応用モデルを変革しました。

💡 Gemini3.8Live Extended Thinkingは「話しながら考える」バックグラウンドの拡張推論能力を提供し、複雑なタスク処理をサポートします。

🚀 新世代のLiveシリーズモデルは、リアルタイムステップエラー修正、複雑な数学的推論などの高知能要求のシナリオで優れた性能を発揮します。