騰訊は今日、混元 Hy4 preview モデルをリリースしました。パラメータ数は合計770B、アクティブパラメータは49Bで、コンテキスト長は1Mに達しています。公式によると、このモデルはサイズ、コンテキスト、データ規模において大幅に拡張されており、プレトレーニングとポストトレーニングが同時に進歩し、知能レベルが再び向上しており、オープンソースモデルの第一線に位置しています。現在、モデルはオープンソースであり、HuggingFace、GitHub、ModelScope、Gitcodeで同時に公開されています。また、騰訊クラウドのTokenHubおよびOpenRouterにも接続されています。

生産性シーンの全面的なアップグレード、盲測でGLM-5.3とKimi K3を上回る
騰訊内のソフトウェアエンジニアリング、ゲーム、金融、セキュリティなどの分野の専門家との高品質なデータ共同構築により、Hy4 previewは実際のタスクにおいて顕著な進歩を遂げました:ソフトウェアエンジニアリングでは、長期間の開発理解、計画、検証が強化され、オフィス分析ではデータ処理から文書や表のプレゼンテーションまでの完全な納品が可能になりました。ゲーム開発では、一つの要望で遊べるプロトタイプが生成でき、研究分野では分子動力学や凝縮系物理学などにおいても大きな進歩を遂げています。

騰訊は163人の内部専門家と203のエンジニアリングタスクを用いて盲測を行いました。Hy4 previewの平均得点は2.99(満点4.00)で、GLM-5.3の2.92とKimi K3の2.94をわずかに上回りました。Hyraと組み合わせて、このモデルは100年間未解決の幾何学的難問である3次元Blaschke–Lebesgue問題で突破を遂げ、体積下限を0.380799から0.41104に引き上げ、Meissner四面体の仮説で示された0.41986との差は約2%にまで縮まりました。
公式はHy4 previewがHy4の初期バージョンであり、プレトレーニングとポストトレーニングにはまだ向上の余地があり、複雑なタスクにおける長時間の思考や過度な自己検証といった既知の問題もあることを認めています。継続的なアジャイルなイテレーションが行われます。モデルはCodeBuddy、WorkBuddyと深く協調しており、ユーザーは元宝、imaなどの製品で直接体験できます。
VIP会員