在廣西南寧召開的第 32 屆全國大豆科研生產研討會上,安徽農業大學王曉波教授代表團隊發佈了大豆領域垂直大模型"豐菽"2.0。該模型實現了多模態數據融合、降低單一模型回答偏差,有助於推動大豆數據輔助育種落地。

多模型協同,壓低單一模型偏差

"豐菽"2.0 整合了大豆種質資源、基因組、蛋白質、轉錄本、病害樣本、育種試驗記錄及中外文獻資料,形成面向大豆科研的結構化知識體系。相較初代,2.0 新增多模型協同分析機制,並嵌入部分通用大模型接口,由不同模型分別回答同一專業問題。

隨後總結模塊結合領域知識、私有數據與結構化比對規則,對各模型回答的共識、差異及證據完整性進行綜合分析,形成更清晰可靠的專業結論。這一設計顯著提高了大豆專業知識服務的穩定性,避免單一模型"幻覺"帶來的誤導。

六大模塊構建育種知識底座

目前"豐菽"2.0 已能圍繞大豆重要農藝性狀,輔助開展病害診斷、育種親本篩選、虛擬組合設計、表型數據解析、分子標記輔助育種和候選基因功能分析。它集成了豆百科、豆分子、豆文獻、豆病害、豆表型、豆育種六大功能模塊,覆蓋知識圖譜到育種實踐的多維數據體系。

模型底層整合超 1000 萬字專業文本、1 萬篇以上科研文獻與專利,構建出含 2 萬實體、10 萬關係的領域知識圖譜。同時融合 8000 份基因組重測序數據、約 4 萬份種質資源與 3000 份以上品種表型數據,爲大豆智能育種提供了紮實的數據底座。