最近,來自斯坦福大學等機構的研究者,將數千篇Nature、ICLR等頂會文章,輸入GPT-4生成評審意見,再與人類審稿人意見比較。結果顯示,GPT-4審稿意見與人類一致度超過50%,對82%作者來說也很有幫助。研究還發現,相比人類審稿人,GPT-4更關注論文的影響因子,而不太在意補充消融實驗等細節。用戶普遍認爲GPT-4生成的審稿反饋,可以提高評審準確性,降低人力成本。本研究表明,利用LLM輔助學術論文審稿,是可行的。
相關推薦
Glassdoor報告:美國員工AI好評率跌至43%,生成式AI引發職場不滿情緒
Glassdoor數據顯示,美國員工對企業引入AI的滿意度大幅下滑。2019年至2026年中,涉及AI、大語言模型等關鍵詞的評論佔比增長超240%,但積極評價從81%驟降至43%,負面評價升至53%,反映職場對AI落地態度已轉向消極。
Aug 31, 2026
221.1k
微軟推出 Critique 功能讓 GPT 與 Claude 協同科研
微軟爲Microsoft 365 Copilot推出Critique功能,首次整合GPT與Claude協同工作。GPT負責生成研究初稿,Claude則扮演審稿人角色,嚴格覈查內容準確性與完整性,實現多模型協作處理複雜學術任務。
Mar 31, 2026
219.2k
模型界“強強聯手”!微軟發佈深度研究智能體:GPT 負責草擬,Claude 負責審稿
微軟更新365 Copilot研究代理功能,允許用戶同時調用OpenAI的GPT和Anthropic的Claude模型,實現兩大AI模型協作。GPT負責主筆,Claude進行評審,展現AI時代巨頭間能力整合的新趨勢。
Mar 31, 2026
241.7k
OpenAI擬從客戶“AI輔助研發成果”中抽成,商業化模式再升級,引發行業關注
OpenAI正探索新商業模式,計劃從客戶利用其AI系統實現的研發成果中抽取分成。這一模式尚處內部討論階段,已引發科技、製藥等領域關注。
Jan 23, 2026
1,041.2k
李楠:錘子 TNT 如夢初醒,AI 時代爲羅永浩的預言翻盤
2018年羅永浩發佈堅果TNT工作站,主打觸控與語音交互,意圖革新桌面操作。七年後,產品被視爲“超前”,AI技術發展是關鍵。怒喵科技創始人李楠認爲,羅永浩當時的產品定義有誤,而GPT等大模型的出現,印證了其交互理念的前瞻性。
Dec 12, 2025
259.5k
VIP會員