【AI日報】へようこそ!ここは毎日人工智能の世界を探索するためのガイドです。毎日、AI分野の注目ニュースをお届けし、開発者に焦点を当てて、技術のトレンドや革新的なAI製品の応用を理解するお手伝いをいたします。
新規のAI製品クリックして詳細を確認:https://app.aibase.com/zh
1. 腾讯混元がオープンソースのエクスパートモデルHy4previewをリリース、パラメータ総数770B、コンテキスト1M
腾讯混元がオープンソースのエクスパートモデルHy4previewをリリースしました。このモデルは、リアルな生産性の場面を想定しており、複数のプラットフォームで利用可能となっています。ソフトウェアエンジニアリング、オフィスシーン、ゲーム開発、研究分野において顕著な進展を遂げています。内部の盲測データによると、他のモデルよりも性能が優れ、オープンソース戦略を通じて業界のトレンドを変化させています。

【AiBase要約:】
🧠 Hy4previewはソフトウェアエンジニアリング、オフィスシーン、ゲーム開発および研究分野で顕著な進展を遂げています。
📊 内部の盲測では、Hy4previewの評価がGLM-5.3とKimi K3を上回っています。
🚀 腾讯はオープンソース戦略を通じて、大規模モデル競争をパラメータ競争から生産性実効検証へと転換しています。
2. 4K解像度を直接出力!グーグルが新たなGemini Omni 1.1 Flash動画モデルを発表
グーグルは、新たなGemini Omni 1.1 Flash動画生成AIモデルをリリースしました。このモデルは、マルチモーダル分野での競争において、高精細かつ長時間の動画生成の突破を達成しました。機能設計にはシーン拡張、カメラワーク制御、参照動画セグメントの導入などが含まれており、動画生成の柔軟性とプロフェッショナルさを向上させています。また、複数の解像度オプションを提供し、段階的価格戦略を採用することで、使用のハードルを下げています。

【AiBase要約:】
🎥 シーン拡張機能により、既存の動画の終わりにスムーズに続きの映像を生成することが可能です。拡張のステップは10秒ごとで、最大40秒まで拡張できます。
📽 カメラワーク制御により、指定されたフレームの開始と終了を指定することで、スムーズで自然なトランジションとプロフェッショナルなカメラワークが実現されます。
📹 新モデルは、最長3秒の参照動画セグメントの導入をサポートしており、新しいシーンを構築する際に画面の文脈背景とキャラクターの一貫性を正確に維持します。
3. Midjourney V8.2が画像編集モデルをリリース、コマンド微調整とキャンバス拡張を完全対応
Midjourney V8.2の画像編集モデルのリリースは、AI絵画分野における重要なアップグレードを意味します。このモデルは、コマンド微調整、複数画像参照、局所再描画などの機能を通じて、クリエイターにより正確でコントロール可能なビジュアル創作体験を提供します。

【AiBase要約:】
🎨 コマンド編集機能により、ユーザーはテキストコマンドを使って既存の画像を修正できます。
🖼️ 複数画像参照生成メカニズムは、一度に最大4枚の画像を参考として統合できます。
🖌️ 局所再描画とキャンバス拡張機能により、画面の細部調整とサイズの拡張が簡単に実現できます。
詳細リンク:https://updates.midjourney.com/edit-model-for-v8/
4. アリババグループが中金と協力し、最初の金融強化大モデルLing-3.0-flash-Finをリリース
アリババグループと中国国際金融(CICC)は共同で、金融強化大モデル「Ling-3.0-flash-Fin」をリリースしました。このモデルは専門的な金融語彙で訓練されており、投資研究能力が大幅に向上しています。情報検索などの主要な能力でも優れた表現を示しています。同時に、双方はFinFIRST金融検索ベンチマークをリリースし、オープンソース化することを計画しています。これにより業界生態系の発展を促進する予定です。

【AiBase要約:】
🧠 金融強化大モデル「Ling-3.0-flash-Fin」は、専門的な金融語彙で訓練され、投資研究の核心能力が強化されています。
🔍 モデルは情報検索など4つの主要な能力に焦点を当てており、特に突出した表現と汎用性が向上しています。
🌐 オープンソース計画により、業界生態系の発展を促進し、無料API呼び出しとモデル重みのオープンソース化を提供します。
5. アリババが新しくQoderをリリース、AIプログラミングツールから全員向けのスマートエージェント作業台へとアップグレード
アリババが新たにQoderをリリースし、AIプログラミングツールからすべての人向けのスマートエージェント作業台へとアップグレードしました。これにより、効率とユーザー体験が向上しました。

【AiBase要約:】
🧠 新バージョンのQoderは、作業対象を「コード工学」から「スマートエージェントタスク」に変更し、効率を向上させました。
⚙️ 技術的には、「読む—修正—検証—反復」の自主的な閉ループをサポートしており、ファイル間編集などの機能があります。
🌐 本製品は、プログラミングモードと一般的モードの2つの入口を提供し、非技術者も開発に参加できるようにしています。
6. グーグルが検索AIモードをアップグレード:300以上のプラットフォームで航空券追跡とホテル予約をサポート
グーグルは、会話型検索体験である「AIモード」に大きな機能アップグレードを行いました。航空券価格の追跡、ホテル予約の補助、ポイント/マイル価格の確認など、新たな機能が追加されました。これは、AIモードを全体的なAI旅行代理として加速させる重要な出来事です。

【AiBase要約:】
✈️ 300以上の航空会社および旅行サイトの即時の価格と提案を統合できます。
🏨 ホテルシーンでは、ユーザーの好みに基づいて評価付き物件を推奨し、提携先のインターフェースにスムーズに移動して支払いを行うことができます。
✈️ 全球ユーザーは自然言語で航空マイルやホテルポイントの交換額を確認できます。
7. 小鹏の第2世代VLA大モデルが初の重大なアップグレードを実施、総合的な安全能力が20倍に増加
小鹏の第2世代VLA大モデルが初の重大なアップグレードを実施しました。その中心は、AIが時間を真正に理解し、静的な3D空間から動的な4D時空への飛躍を実現することです。同時に、モデルの推論効率が向上し、車両全体の脳となるMaster Agentが導入され、RobotaxiのL4レベルの体験が量産モデルに下放されました。

【AiBase要約:】
🧠 Infini-VLAの長期時系列構造を導入し、モデルの時間の理解能力を向上させました。
🚀 モデルの推論効率を向上させ、「見る—考える—行動する」の並列処理を実現しました。
🤖 Master Agentの初登場により、VLAとVLMのキャビン融合が実現されました。
8. AnthropicがMHSハードウェア基準を発表、物理AIの分野に初参入
Anthropicは、モデルハードウェア基準(MHS)を発表し、初めて身体知能と物理AIの分野に公開的に参入しました。MHSは、AIエージェントがさまざまなデバイスを操作できる統一された制御と通信の基準であり、実験効率を向上させます。この技術は、医薬品・生物技術、量子計算、高度製造など分野で、強力な高速化能力を示しています。

【AiBase要約:】
🧠 MHSは、AIエージェントがさまざまなデバイスを操作できる統一された制御と通信の基準です。
🧪 医薬品・生物技術分野では、実験開発と運用サイクルを大幅に短縮しました。
🚀 AnthropicのMHS基準は、大規模モデル競争を会話から動作操作の領域へと広げています。
VIP会員