関連推奨
NVIDIAがNemotron 3 Embedシリーズの8Bバージョンを発表し、RTEB検索基準でトップに立ちました
NVIDIAが生産レベルのRAGやエージェント検索向けにNemotron3埋め込みモデルを発表。8B版がRTEBで1位、最強のオープンソース埋め込みモデルに。3種類のチェックポイント: 精度重視の8B-BF16、軽量1B-BF16、Blackwell最適化1B-NVFP4(4ビット)。双方向アテンション採用。....
グーグルのTPU戦略転換:内部ツールから外部商用へ、直接的にNVIDIAのAIチップ支配地位を挑む
グーグル独自開発のTPUが外部商用化へと転換し、ボーンズと提携してAnthropicなどの顧客にAIインフラを提供。NVIDIAの86%の市場占有率を直撃する。コストとシステムの優位性を活かし、商業化の進展が加速し、AIチップの競争構図を再構築する。
エヌビディアの収益が千億円に近づく ウォン・ファン・フエン氏がアーキテクチャ遅延のうわさに直接反応
NVIDIAの黄仁勳CEOは業界交流会で、四半期売上高が1000億ドルに迫り成長加速と述べた。経営陣はASIC競争激化や製品ロードマップへの疑問に対し、AI計算能力がコア競争力と再強調。次世代旗艦アーキテクチャ「Rubin Ultra」の2028年延期説を否定した。....
NVIDIAが2タワーアイアモデルをオープンソースでリリース、テキスト生成速度が2.42倍向上、画質保持率は98.7%
NVIDIAはNemotron-Labs-TwoTowerの離散拡散言語モデルを発表しました。このモデルは大規模なモデルにおける1トークンずつ生成する遅さという課題を解決し、重みパラメータはHuggingfaceでオープンソースとなっています。このモデルは既存のバックボーンネットワークの予トレーニングされた重みを再利用しており、再度トレーニングすることなくコストを大幅に削減しています。60Bのツーワーク構造を採用しており、2つの30Bネットワークが並列で協働し、それぞれ3Bのパラメータを活性化して128個のルーティング可能なエキスパートモジュールを搭載し、生成効率を向上させています。
AIクラウドプラットフォームのTogether AI、8億ドルのCラウンドを完了。評価額は83億ドル、年間予約額は11億ドルを突破
AIクラウドのTogether AIが8億ドルのシリーズC調達、評価額83億ドル。リード投資家はサウジアラムコVC、NVIDIAなども参加。2022年設立でNVIDIA GPUクラスタのレンタル提供。....
