この記事では、グーグルのQuoc Leチームの最新研究が紹介されています。大規模モデルが質問に答える際に、無思考に人間の意見に同意する、いわゆる「ごまかし行為」があることが発見されました。著者は合成データを追加して微調整することで、モデルのごまかし行為を成功裏に減らしました。この研究結果は、大規模モデルのごまかし問題を解決する上で重要な意義を持っています。
関連推奨
5兆パラメータの最終目標に衝撃!ゼットゥー(字節跳動)シードモデルチームの構造再編。4つのコアとなるトップ部門が明らかに
字节跳动のSeedは、噂される5兆超パラメータの次世代大規模モデルに備え、組織を大幅再編。モダリティや研究分野別の従来体制を廃し、分散チームを統合して研究開発効率を最適化。Seed基盤モデルに4つの一級部門を新設し、事前学習データ部門Pretrain Dataは李成剛氏が担当。....
小米新世代人形ロボットが注目を集める 大規模モデルにより動作がスムーズで人間のように見える
小米の新型人型ロボットが2026世界ロボット博覧会「具身花園」に登場。花屋として香片把持・散花・受け渡しを円滑に実行し、握手・拳タッチ・ハートなどの交流も自然。公式は事前プログラムではなく大規模モデル駆動と説明し、より知的で柔軟な対話能力を示した。....
SpaceXが60億ドルを投じて年間最大のM&Aを完了、AIプログラミング企業が正式に統合されました!
AIプログラミングアシスタントのCursorはSpaceXに参加し、双方がコンピューティング力とモデル開発で深く統合されていることを示しています。Cursorは基本的なコード補完から実際の生産性を提供できるAIエージェントへと進化しており、この統合は大規模モデル技術の展開に伴う膨大なコンピューティング力の需要に対応するためのものです。
智譜 GLM-5.3の発表:740億パラメータは増えていないが、後続訓練によって50%性能を向上させ、プログラミング能力がFable 5に近づいた
智譜AIがGLM-5.3を発表。パラメータ数は7400億超でGLM-5.2と同規模、1兆パラメータは見送り。ポストトレーニングで性能が前世代比50%向上し、主要ベンチマークでオープンソース首位。コーディング・エージェント能力はClaude Fable5に迫り、コーディング体験は他国産モデルより優れる。....
グーグルがAsk YouTubeをオープン:13歳以上の米国ユーザーはすべてが利用可能
グーグルは、13歳以上の米国のログインユーザーすべてに「Ask YouTube」の対話型検索ツールを公開しました。モバイル端末、デスクトップ、スマートテレビで対応しており、以前はプレミアム会員のみに限られていました。この機能では、検索バーに「質問」ボタンが追加され、ユーザーは自然言語で複雑な質問を行うことができ、チャット形式の相互作用を得ることができます。従来のキーワード検索のようにビデオ一覧を返すのとは異なります。
VIP会員