OpenAI發布LifeSciBench:衡量AI系統在真實科學研究場景中的能力
0
PANews 6月20日消息, OpenAI官方發布全新評測基準LifeSciBench,旨在衡量AI系統在真實科學研究場景中的能力。 據悉,LifeSciBench基於750道專家編寫任務,涵蓋7類科研工作流程與7個生物學領域,任務來源於173名具有博士背景並具備生物科技或製藥業經驗的科研人員,該基準強調複雜科研能力評估,包括證據整合、實驗設計、數據分析、科學推理與科研等能力,而非單一事實性問題。 超過79%的任務包含多步驟推理,平均每題需約4個推理步驟,並包含1,062個真實科學研究相關資料附件(如論文、圖表、序列資料及結構文件等)。
來源:
登入回覆
登入分享您的看法評論
相關文章
|Square
下載BTCC APP,您的加密之旅從這啟程
立即行動 掃描 加入我們的 100M+ 用戶行列