アリババの通義实验室XR实验室は、テキストによる3Dモデルとテクスチャの生成を可能にする新しい文生成3Dモデルをオープンソース化しました。オープンソース化されたモデルには、Text-to-NDとText-to-ND-MVの2つの大規模モデルが含まれています。通義实验室XR实验室は、Text-to-NDの基本バージョンとマルチビューバージョンを公開し、様々な粒度のアルゴリズム開発ニーズに対応しています。さらに、大規模モデルから蒸留された(Score Distillation Sampling)3Dモデルの最適化コードも同時に公開されており、これらを組み合わせることで、テキストから直接3Dモデルを生成することができます。
関連推奨
騰訊混元がオープンソースの旗艦モデルHy4previewを発表、総パラメータ数は770B、コンテキストは1M
騰訊混元は8月28日にオープンソースの旗艦大モデルHy4previewを発表しました。総パラメータ数は770B、アクティブなパラメータは49Bで、コンテキストは1Mです。実用的な生産性を目的としています。モデルはHuggingFace、GitHub、ModelScopeなどにオープンソースされており、騰訊雲のTokenHubとOpenRouterにも上陸しています。WorkBuddy/CodeBuddy、元宝、imaなどで体験できます。このモデルはソフトウェア工学、ゲーム、金融、セキュリティなどの分野の専門家のデータによって共同構築されています。
アリババが2.4兆パラメータの巨大モデルを大幅にオープンソース化 性能はFable 5と匹敵
アリババ千問は初めてMaxエントリーモデルQwen3.8-2.4T-A95Bの重みを完全にオープンソース化しました。このモデルの総パラメータ数は2.4兆で、1トークンのアクティブ化には950億のパラメータが必要です。ネイティブに26万トークンのコンテキストをサポートし、拡張可能で最大101万トークンまで対応可能です。アーキテクチャはQwen3.5の利点を継承しており、プログラミング、オフィス作業、研究開発および長期間の知能タスクにおいて優れています。
NVIDIA初のオープンソース双方向音声モデルVoiceChat 11Bが正式リリース
NVIDIAは、初めてのオープンソースのエンドツーエンド型双方向音声会話モデルであるNemotronLabs VoiceChat 11Bをリリースしました。単一のネットワークでストリーミング音声認識と生成を直接行い、従来のASR、LLM、TTSの分離構造に代わって、リアルタイムの音声インタラクションの突破を実現しました。
アリババ新世代の大規模モデルQwen3.8が登場:プレビュー版がアリ云とQoderに先行公開、公式版は近日オープンソース化予定
国内大規模モデルのオープンソース化が加速。アリババが次世代「通義千問3.8」を近日公開、プレビュー版は体験可能。正式版も近くリリース。通義千問のオープンソース展開が加速。....
アリババグループがオープンソースAvernetを公開:マルチエージェント協力に新たなインフラストラクチャー
アリババグループがマルチエージェント協力インフラストラクチャーであるAvernet V0.1をオープンソースとして公開し、大規模モデルの応用においてマルチエージェント協力の効率性を低下させるという重要な課題を解決しました。このプロジェクトは協力層の構築に焦点を当てており、エージェント自身の推論能力を置き換えるものではなく、複雑なタスクの自動処理に基礎的なサポートを提供します。
VIP会員