最近、スタンフォード大学などの研究機関の研究者らが、Nature、ICLRなどのトップ会議論文数千本をGPT-4に入力し、査読意見を生成、それを人間の査読者意見と比較しました。その結果、GPT-4による査読意見と人間の意見の一致率は50%を超え、82%の著者にとって非常に役立つことが分かりました。また、GPT-4は人間査読者と比べて、論文のインパクトファクターを重視し、補足実験やアブレーション実験などの詳細にはあまり注目しない傾向も明らかになりました。GPT-4による査読フィードバックは、査読の正確性を高め、人件費を削減できると、多くのユーザーが評価しています。この研究は、LLMを活用した学術論文査読の可能性を示唆しています。
関連推奨
AIの幻想からお別れ?Vectaraが精度の高いエラー修正を声称する守護エージェントをリリース
企業における人工知能(AI)の利用は日々拡大していますが、その固有の「幻想」リスク——つまり事実とは異なるまたは根拠がない情報を生成するリスク——は、大規模な展開を妨げる主要な課題となっています。業界内で減少させるための技術や方法が数多く登場していますが、それでも効果は限定的です。最近、Vectaraという会社が新たなソリューション、「Vectara 幻想補正装置」をリリースしました。これは監視エージェントを通じて解決を目指すものです。
xAI の安全に関する報告書が予定通りに発表されなかった
最近、エロン・マスク氏が設立した artificial intelligence(AI)企業 xAI は、予定していた AI 安全に関する最終的なフレームワークの発表を延期しました。この情報は監視機構「ミダス・プロジェクト」の注目を集めています。xAI の AI 安全に関するパフォーマンスはこれまで必ずしも良好とは言えませんでした。その AI チャットボットである Grok は、特定のリクエストを処理する際に、適切でない行動を取ることがあり、例えば女性の写真を意図せず扱うことがあります。また、Grok は Gemini や Cha などの競合製品と比べて言語表現能力も劣っているとされています。
アプルが革新的なAIモデルMatrix3Dを発表:わずか3枚の写真から3Dシーンを作成
アップルの機械学習チームは、南京市の大学と香港科技大学と協力し、高品質な3D出力をユーザーに提供するMatrix3Dという先進的なAIモデルを開発しました。このモデルは、ほんの数枚の2D写真から現実的なオブジェクトやシーンを再構築する能力を持っています。ユーザーはたった3枚の写真を提供するだけで、詳細な3D再構築結果を自動生成できるのです。このプロセスは3Dモデリングの手順を大幅に簡素化し、さまざまなアプリケーション分野で新しい可能性をもたらすとともに、AI技術の発展にも貢献しています。
無料で利用可能!通義千問Qwenが「深層研究」Deep Research機能をリリース
デジタル時代において、大量の情報や高い業務ストレスに直面し、複雑な問題を整理することは時間が多くかかり、集中することが難しくなります。この問題に対処するために、Qwenチームは「Deep Research」という知能アシスタントシステムを開発しました。このシステムは、ユーザーが複雑な問題を整理し、迅速に手順を立て、明晰で信頼性の高い研究レポートを作成できるように支援します。
DeepSeekの応答がクラッシュしました: 一部の機能は正常に復旧しています
多くのユーザーが、DeepSeekを使用中に重大な問題に直面していることを報告しています。多くの人は、DeepSeekを開くとページが一向にロードせず、全く使用できない状態だと述べています。さらに、そのような問題により、一部のユーザーは自分の履歴が奇妙にも消えてしまったことに悩まされています。この状況について、あるメディアはDeepSeekの内部スタッフに連絡し、状況を確認しました。相手は「現在問題が処理中であり、ユーザーにはもう少し時間が経ってから再度お試しいただくようお勧めします」と説明しました。
