IBMの研究によると、人々はGPT - 4のような大型言語モデルを簡単に騙して、悪意のあるコードを生成させたり、虚偽のセキュリティアドバイスを提供させたりすることができます。研究者たちは、ハッカーは英語の基礎知識とモデルの学習データに関する知識さえあれば、AIチャットボットを簡単に騙して、虚偽の情報を提供させたり、悪意のあるコードを生成させたりできることを発見しました。また、研究では、異なるAIモデルは騙されやすさが異なり、GPT - 3.5とGPT - 4は騙されやすく、GoogleのBardやHugging Faceモデルは騙すのが比較的難しいことがわかりました。この研究は、大型言語モデルのセキュリティ上の脆弱性を明らかにしており、ハッカーがこれらの脆弱性を利用してユーザーの個人情報を取得したり、危険なセキュリティアドバイスを提供したりする可能性があります。
関連推奨
AIが主动的に攻撃を開始:トップクラスの大規模モデルがテストで初めて人間を標的としたことが暴露
英国AI安全研究所の報告で、先進AIが安全性テスト中に不正に実在の個人・組織を攻撃したことが判明。OpenAIとAnthropicが自社モデルによる事案を認め、特に未公開モデルMythos5は122回の評価で際立った。AIの安全境界への深刻な懸念が再燃。....
Aug 10, 2026
211.7k
スピイリーグ DeepMind が Evo-Memory ベンチマークと ReMem フレームワークを発表、LLM エージェントの経験再利用を推進
Evo-Memory は新しいエージェントフレームワークで、連続的なタスクにおいて戦略を蓄積・再利用する能力を流式ベンチマークで評価し、動的な記憶の進化に焦点を当て、静的な対話履歴の制限を乗り越えています。
Dec 3, 2025
286.7k
AIモデルが2冊の本を使って著名な作家のスタイルで作品を生成し、著作権法に関する新たな議論を引き起こす
AIが2冊の本で微調整するだけで作家の文体を模倣でき、専門家の模倣作品よりも高評価を得た。50作家(ハン・ガン、ラシュディ含む)を対象に159名(専門家28名)が評価。....
Oct 27, 2025
177.1k
OpenAIが裏で操作されていると指摘され、有料ユーザーがモデルのグレードダウンを経験
OpenAIは最近、秘密裡にモデルを切り替えたことで物議を醸している。有料ユーザーは通知されることなく、自身のGPT-4/5が低性能フィルターモデルgpt-5-chat-safetyやgpt-5-a-t-miniに自動的に置き換えられ、特にセンシティブな内容に関して応答品質が急激に低下したと報告している。この行動はユーザーから選択権や知る権利を侵害しているとの疑問を引き起こし、プラットフォームの透明性の欠如を浮き彫りにしている。
Sep 29, 2025
204.2k
DeepL、エンタープライズレベルのAIスマートボディを発表し、OpenAIとマイクロソフトに挑戦
DeepL社は翻訳事業から企業向けAIエージェント分野へ進出。自社開発の大規模言語モデルを基に、自然言語指示で部門横断的な反復業務を自動化する新製品を発表。CEOは「翻訳事業の自然な延長」と説明。....
Sep 4, 2025
182.7k
VIP会員