联系我们

新闻投稿:jingjing@enec.net

商务合作:coco@enec.net

搜索
下载亿恩app

OpenAI开源BrowseComp,重塑Agent浏览器评测

3周前

11日凌晨2点,OpenAI开源了专门用于智能体浏览器功能的测试基准——BrowseComp。这个测试基准非常有难度,连OpenAI自己的GPT-4o、GPT-4.5准确率只有0.6%和0.9%几乎为0,即便使用带浏览器功能的GPT-4o也只有1.9%。但OpenAI最新发布的Agent模型Deep Research准确率高达51.5%,在自主搜索、信息整合、准确性校准方面非常优秀。

更多精彩内容,请关注亿恩网微信公众号: (ENECNEWS

扫码关注二维码

) 每天为您推送最新,最热干货!
声明:亿恩网原创稿件,未经授权不得以任何方式转发。转载请联系:yujie@enec.net
分享:
7098 0 0
热门词条

Facebook

出口

账号被封

损失

健身

递四方

大卖

澳大利亚

德国

英国

爆单

销量

抖音

社交电商

社交平台

收购

广州

卖家

峰会

宁波

社群

扫码加入社群

公众号

扫一扫
关注亿恩公众号

顶部