DeepMindの最新研究によると、言語モデルは論理推論において依然として課題を抱えていることが明らかになりました。
研究では、タスクにおける前提条件の順序が、言語モデルの論理推論性能に著しい影響を与えることが示されました。
この発見は、専門家が基本的な推論タスクで言語モデルを使用する際の意思決定に役立つ可能性があります。
前提条件の順序を変えることは、言語モデルの推論能力を向上させるためのシンプルかつ効果的な方法かもしれません。

DeepMindの最新研究によると、言語モデルは論理推論において依然として課題を抱えていることが明らかになりました。
研究では、タスクにおける前提条件の順序が、言語モデルの論理推論性能に著しい影響を与えることが示されました。
この発見は、専門家が基本的な推論タスクで言語モデルを使用する際の意思決定に役立つ可能性があります。
前提条件の順序を変えることは、言語モデルの推論能力を向上させるためのシンプルかつ効果的な方法かもしれません。
グーグルは今週水曜日にも、プログラミング能力が大幅に向上した新しいモデル「Gemini 3.8 Flash」をリリースする予定です。このモデルの内部コードネームは「Skimaki」です。Jetskiプログラミングツールでの比較テストにおいて、エンジニアによる評価はAnthropicのOpusモデルを上回りました。これにより、グーグルがアンソロピックとの間に大きな開きを生じさせているコアなプログラミング能力において、その差が顕著に縮まっていることが示されています。
ロイター報道:グーグルAI部門が激震。共同創業者ブリン氏が現場復帰しモデル訓練に介入、ハサビス氏は会長職へ棚上げされ、Gemini創業技術責任者2人が離脱。2014年の買収以来、DeepMindの自主性は徐々に侵食。4月、ブリン氏は従業員会議でGeminiの優先度不足と加速を強調。....
WSJによると、DeepMind共同創業者ハサビス氏はCEO退任前、米政府当局者や複数のAI研究所責任者と独立したAI業界の安全機関の設立を協議。汎用AI向けの安全策とベストプラクティス策定に注力し、同機関をIAEAになぞらえた。....
グーグルDeepMindは多言語の手話からテキストへの変換モデル「SL2T」をリリースし、初めてPixel11スマートフォンに搭載することで、手話AIが消費者向け電子機器に登場しました。このモデルはGboardやLive Transcribeに接続されており、フロントカメラで手話をした場合、メッセージの編集やウェブ検索、Geminiとの会話が可能になります。キーボード入力の代わりになります。SL2Tは50種類以上の手話と10万時間の素材で訓練されており、その約四分の一はアメリカ手話データセットからのものです。複数言語間での統合学習により、認識の精度が向上しています。
Google DeepMindは新たな音楽生成モデルであるLyria 3.5を発表しました。音楽性、歌詞および人声の表現力、そして制作のコントロールにおいて大幅に向上しており、より複雑で自然なメロディー構造を構築できるようになり、AI音楽がプロフェッショナルな応用へと進展しています。