中国中央テレビ経済チャンネルの新メディアでは、AIアナウンサー2名が全国人民代表大会(全人代)期間中に勤務し、経済、産業、観光などの分野に関する質問に24時間体制で対応しました。この2名のアナウンサーは、アリババ傘下のAnt Groupのデジタルヒューマンプラットフォーム「螞蟻霊境」が技術支援を行い、高いモデリング精度、細部まで精緻な動き、自然な発音、高い再現度などを特徴としています。同プラットフォームは、昨年開催された杭州アジア競技大会のデジタル聖火リレーにも技術支援を提供しており、中央テレビは聴覚障碍者向けにAI手話アナウンサーによる年中無休のサービスも開始しています。朱广権アナウンサーは、AI手話アナウンサーに対し、高度な難度のジョークを使った「面接」も行いました。
関連推奨
ポーランドのラジオ局OFF Radio Krakow、AIによる完全司会制導入で業界に衝撃
ポーランドのラジオ局OFF Radio Krakowが最近、大胆な決定を発表しました。社会におけるAIの影響を探るため、全番組で人工知能(AI)による司会制を導入すると発表したのです。同局の編集長Marcin Pulit氏はこれを社会実験と表現していますが、コスト削減のためとの見方が一般的です。Radio KrakowのオンラインおよびDAB+子会社であるOFF Radio Krakowは今週、AIによる完全司会制導入を発表。3人のAIアナウンサー「Emi」、「Ku…
云知声、24時間無休AI自動ライブ配信システム「藍藻AI智播」を発表
云知声智能科技股份有限公司は、AI技術を活用しライブ配信業界の課題解決を目指す自動ライブ配信システム「藍藻AI智播」を発表しました。同システムは、云知声の山海大模型と高精度AI音声技術に基づき、24時間無休のライブ配信を実現。大幅なコスト削減と、インタラクティブ性の向上、視聴者体験の改善に貢献します。
科大訊飛がSpark-Audio-1.0-Previewを発表:国内産の演算力によるトレーニング、99言語、202種類の関西弁に対応
科大讯飞が音声基盤大規模モデルSpark-Audio-1.0-Previewを発表。国産計算力で訓練し供給リスクを低減。テキスト・音声入力とテキスト出力に対応し、音声文字起こし、多言語翻訳、多方言認識、環境音認識、話者認識、感情分析、音声QAなどの能力を備える。....
アシックス・スパーク音声ベース大モデルがリリース:0.65Bエンコーダーと30B MoEの完全国内産業向け計算能力で訓練
科大訊飛は音声ベース大モデルのSpark-Audio-1.0-Previewをリリースしました。これは全国産業向けの計算能力によってトレーニングされています。従来の音声処理では、通常、音声をテキストに変換してから理解するという段階的なアプローチが用いられ、情報の損失(感情や背景音など)や処理フローの分断(音声認識や声紋識別などの手順が分離している)という2つの欠点がありました。これらはシナリオ判断の完全性に影響を与えています。
千問 Qwen3.8-27B が Hugging Face を頂点に、同プラットフォーム史上最高の人気オープンソースモデルとなる
9月16日、アリババのQwen3.8-27BがHugging Faceで最も人気のあるオープンソース大規模モデルランキング1位となり、FLUX.1やDeepSeek-R1、Kimi-K3、Meta-Llama-3などを超えた。同ランキングは開発者の「いいね」を基準に実際の好みを反映し、ベンチマークやパラメータ数ではない。コミュニティ史上最も人気のあるオープンソースモデルとなった。....
VIP会員