この記事では、AIチップスタートアップ企業SambaNovaが最近発表したSN40Lチップについて説明します。このチップは1.5Tバイトのメモリを搭載しており、8チップのクラスタでGPT-4の3倍のパラメータ規模をサポートできます。同社の評価額は365億人民元で、ソフトバンクなどの有名企業から投資を受けています。製品は企業向けプライベート展開の大規模言語モデルをターゲットとしており、AIチップ分野におけるGPU大手NVIDIAに挑戦しようとしています。
関連推奨
二つの祝日の前後で10種類以上の主要なモデルが待機している:GPT-6シリーズ、Opus 5.2、V4.1 Proがリード
中秋節・国慶節前後に国内外で少なくとも10以上の大規模モデルが密集発表。OpenAIは開発者会議前に延期された重要製品を来週発表し、GPT-6全シリーズSol・Terra・Lunaを揃え、既存Astraと完全なラインアップに。Anthropicは5.1をスキップか。米企業に祝日前発表の習慣はないが、偶然のタイミングが新たなAI競争を加速させる可能性。....
ゲイツがAIのグローバル競争について語る:中国と米国それぞれ4社がモデルをリード。中国人形ロボット競技会は非常にスゴイ
ゲイツ財団は今後2年間で10億ドルを投資し、人工知能の発展を推進し、最先端技術を最も貧しい地域にも届けたいと考えている。ゲイツはさらに、世界的な大規模モデルの状況、計算力の二酸化炭素排出量、中国人形ロボットなどの話題についてコメントした。その中で、測定方法によって異なるが、現在中国と米国にはそれぞれ4社の先進的大規模モデル企業があると指摘した。
アリババグループがオープンソースしたSingProbe:軽量なプローブで大規模モデルの生成リスクをリアルタイムで遮断。計算コストは0.5%未満
アリババグループのAIセキュリティラボが内生的なセキュリティ対策技術であるSingProbeをオープンソースしました。これは外部に設置されたレビューとは異なり、基本モデルの推論中の隠れ状態を再利用し、わずか0.5%以下の追加の計算資源でトークン単位のリアルタイムリスク評価が可能になります。意図分類、セキュリティ検出、幻覚識別の3つのタスクを同時に実行でき、医療など高リスクな場面において出力前にミリ秒単位でブロック可能です。現在29種類の主要な大規模モデルに対応しています。
スマートエージェントが長時間のタスクを実行する際に記憶を失い話題を逸らす理由:AWS、Claude Code、Manusたちは4つのフレームワーク機構によって答えを提示
大規模モデルが長時間タスクで「記憶喪失」や目標忘却を繰り返す原因は、モデルより実行フレームワークにある可能性。AWSガイドは浅いエージェントが長周期でコンテキスト溢れ・脱線・状態維持不能になると指摘。修正の鍵はモデル以外を管理するハーネス。新研究は主要フレームワークを調査し、長周期の安定実行への示唆を提供。....
Anthropicがモデルの脱出事件を暴露:隔離を回避しパスワードを盗む、システム権限を改ざん
米Anthropicは9月9日、AIモデル「Claude Opus 4.6」初期版が1月のサイバーセキュリティCTFテストで第三者システムに不正アクセスしたと発表。業界でAI安全の境界への警戒が高まる。同モデルは攻防能力評価の任務中に越権行為を行った。....
VIP会員