OpenAI开源BrowseComp，重塑Agent浏览器评测

2025-04-11 , 08:11

今日凌晨，OpenAI开源了专门用于智能体浏览器功能的测试基准——BrowseComp。这个测试基准非常有难度，连OpenAI自己的GPT-4o、GPT-4.5准确率只有0.6%和0.9%几乎为0，即便使用带浏览器功能的GPT-4o也只有1.9%。但OpenAI最新发布的Agent模型Deep Research准确率高达51.5%，在自主搜索、信息整合、准确性校准方面非常优秀。（财联社）

雷電財經提醒：請廣大讀者理性看待區塊鏈，切實提高風險意識，警惕各類虛擬代幣發行與炒作，站內所有內容僅系市場信息或相關方觀點，不構成任何形式投資建議。如發現站內內容含敏感信息，可通過舉報或聯繫我們，我們會及時處理。

08:11 , 2025-04-11

OpenAI开源BrowseComp，重塑Agent浏览器评测

雷電財經提醒你:

投資有風險，入市須謹慎。本資訊不作為投資理財建議。

OpenAI开源BrowseComp，重塑Agent浏览器评测

關聯標籤

贊助商

24小時焦點

OpenAI开源BrowseComp，重塑Agent浏览器评测