【AI日報】へようこそ!ここは毎日あなたが人工知能の世界を探索するためのガイドです。毎日、AI分野の注目ニュースをお届けし、開発者に焦点を当てて技術トレンドや革新的なAI製品の応用について理解を深めていただきます。
新規なAI製品クリックして詳細を確認:https://app.aibase.com/zh
1. ワイチャットAIチームがWeKnoraを開発:知識ベースが「話す」だけでなく「実行」も可能に
ワイチャットAIチームは知識管理フレームワークWeKnoraをオープンソース化しました。最新バージョンの0.8.0では、すべての機能が公開されています。WeKnoraの目的は、知識ベースが「答えを検索する」だけでなく、「実行する」こともできるようにすることです。anydoc解析とGraphRAG技術を用いて、雑多なドキュメントを知識グラフに変換し、Skill Sandbox Runtimeと組み合わせて知識を安全に実行し、検証可能な結果を返します。このシステムは、解析、整理、検索、実行、記憶のプロセスを一貫した解決策として提供しています。

【AiBase要約:】
🧠 anydoc解析:複数の形式のドキュメントを直接インポートし、構造化された知識体系に自動的に整理します。
🔗 GraphRAG:エンティティと関係を基に知識グラフを構築し、関連性のある質問への回答精度を向上させます。
⚙️ Skill Sandbox Runtime:知識をスキルにカプセル化し、サンドボックス内で安全に実行し、検証可能な結果を返します。
2. ZhiPu AIがZCodeのコードアップロード問題に対応:不具合を修正し、コードをオープンソース化
ZhiPu AIのコードアシスタントZCodeが「コードデータベースインデックス」機能によりユーザーのデータアップロードに関する議論を引き起こしました。公式が状況説明と謝罪を発表し、問題の原因と改善計画を明らかにし、不具合の修正、コードのオープンソース化、第三者評価の依頼などの対応を行いました。

【AiBase要約:】
📌 ZCodeの「コードデータベースインデックス」機能はデフォルトで有効になっているため、一部のユーザーのデータがアップロードされました。
💡 オフィシャルはクラウドでWikiを作成した後、データはすぐに破棄され、保存されないと述べています。
🔒 信頼を再構築するために、ZCodeはコードをオープンソース化し、第三者の独立審査を依頼する予定です。
3. ChatGPTがWordに正式登場:無料ユーザーも利用可能、オフィス文書で3つのAIが同台競争
OpenAIはChatGPTの公式Wordプラグインをリリースし、グローバルすべてのアカウント(無料ユーザーも含む)に開放しました。このプラグインは、ノートの整理、要約の生成、文体の調整などの機能をライターに提供し、課金ユーザーおよび企業ユーザーにはより高度な機能が提供されます。しかし、プラグインの使用には階層制限があり、Codexなどのツールとクォータを共有しています。また、Word内にはすでに複数のAIツールが共存しており、AIの利用門檻がさらに下がっています。

【AiBase要約:】
✅ OpenAIはChatGPTの公式Wordプラグインをリリースし、グローバルすべてのアカウントに開放しました。
💡 プラグインはノートの整理、要約の生成、文体の調整など、ライターの日常的なニーズを満たす多くの機能を提供します。
🔄 WordにはマイクロソフトCopilot、AnthropicClaude、OpenAIChatGPTの3つのAIツールが共存しており、オフィスソフトがAIによって再構築されています。
4. 階歩星辰がStep5Previewをリリース:単一タスクコストがClaude Opus5の1/8
階歩星辰は新しいエリートベースモデルStep5Previewをリリースしました。このモデルはAIプログラミング、ソフトウェアエンジニアリング、専門知識作業、金融などのシーンに重点を置き、現実世界でのAgenticタスクにおける総合的なパフォーマンスを向上させました。AA総合知能指数において、Step5Previewは世界のオープンソースモデル上位3位にランクインし、単一タスクコストはClaude Opus5の1/8に過ぎません。10月15日に正式にオープンソース化する予定です。Step5Previewは疎なMoE構造を使用し、総パラメータ数は600B、アクティブパラメータは27Bであり、100万トークンのコンテキストウィンドウをサポートし、テキストと視覚入力をネイティブにサポートしています。ソフトウェアエンジニアリング、専門的なワークフロー、金融などのシーンで複雑なタスクを最適化しています。

【AiBase要約:】
🚀 階歩星辰がStep5Previewをリリースし、AIプログラミング、ソフトウェアエンジニアリングなどのシーンでモデルのパフォーマンスを最適化しました。
🧠 Step5PreviewはAA総合知能指数で世界のオープンソースモデル上位3位にランクインし、単一タスクコストはClaude Opus5の1/8に過ぎません。
📊 このモデルは疎なMoE構造を採用し、100万トークンのコンテキストウィンドウをサポートし、テキストと視覚入力をネイティブにサポートしています。
5. SpaceXAIがGrok Voice Transcribe 2.0をリリース:誤字率半減、価格は変更なし、リアルタイム音声認識がランキング首位に
SpaceXAIがリリースしたGrok Voice Transcribe 2.0は、音声からテキストへの変換技術において大きな進歩を遂げました。誤字率は約半分になり、価格は変更されていません。このモデルは、カスタマーサービス電話やテスラ車載システムなど、実際のビジネスシーンに深く統合されており、多数のテストで優れた性能を示しています。

【AiBase要約:】
🚀 新世代の音声からテキストへの変換モデルGrok Voice Transcribe 2.0は誤字率を約半分に削減しました。
💰 定価は維持され、発話者分離や正確なタイムスタンプなどの強力な機能を提供しています。
📊 公開ランキングで正確率第1位を獲得し、優れた性能を示しています。
6. BilibiliがAI無限竞技場評価リストをリリース:100以上のモデルが同一ステージで戦い、GPT-6が首位を獲得
BilibiliはAI無限競技場評価リストをリリースし、100以上の大規模モデルを真実のシナリオでテストしました。GPT-6は最初の順位で首位を獲得し、トップを記録する回数も多くなりました。このリストは固定された評価項目を設けておらず、UP主が独自のテーマを設定し、モデルの実際の応用能力を示すことを目的としています。

【AiBase要約:】
🔥 BilibiliはAI無限競技場評価リストをリリースし、100以上の大規模モデルを真実のシナリオでテストしました。
🏆 GPT-6は最初の順位で首位を獲得し、トップを記録する回数も多くなりました。
🌐 このリストは固定された評価項目を設けていません。UP主が独自のテーマを設定し、モデルの実際の応用能力を示すことを目的としています。
7. QwenがQwen3.8-LiveTranslateをリリース:同時通訳遅延が2.3秒に低下し、あなたの声色を保持
新たな同時通訳モデルQwen3.8-LiveTranslateは、翻訳品質、遅延、発話者識別、音声合成の4つの面で全面的なアップグレードを実施しました。平均文字遅延は2.8秒から2.3秒に短縮され、三大主要機能が追加されました。それは、リアルタイム発話者分離、元の文章と翻訳後の文章の同時に表示、長文脈の解消です。このモデルはHybrid MoEのThinker–Talker二モジュール設計を採用し、14語種の多発話者長音声評価セットOmnilingua-MSpeaker上で優れたパフォーマンスを示しています。現在、60言語をサポートしており、APIはQwen AIプラットフォームに同時にリリースされています。

【AiBase要約:】
🎙️ リアルタイム発話者分離により、多人数が交互に発言する場合、各文の所有者が明確になります。翻訳後の音声は元の発話者の声色を安定して保持できます。
📺 元の文章と翻訳後の文章の同時に表示により、両方の言語の即時の理解と原文の照合が可能です。
🧠 長文脈の解消は、輪ごとの履歴文脈を関連付けることで、固有名詞や指代による翻訳の曖昧さを減らします。
8. DeepSeekが休日料金計算ルールを明確化、中秋・国庆節が10日間の半額期間に
DeepSeekは休日と祝日のAPI料金計算ルールを明確化し、開発者向けに10日間の半額期間を提供しました。同時に、新たにリリースされたV4.1 Flashモデルは性能と価格の点で優れた表現を示し、さらにコストパフォーマンスを向上させました。

【AiBase要約:】
📅 休日と祝日は24時間低コストで計算され、開発者は割引を享受できます。
🚀 DeepSeek V4.1 FlashモデルはエリートV4Proを上回るパフォーマンスを持ち、価格はより手頃です。
💰 空き時間では、V4.1 Flashの入力と出力コストは非常に低いです。
VIP会員