首页 > 业界 > 关键词  > 国产大模型最新资讯  > 正文

DeepSeek-R1联网搜索能力首测:腾讯元宝

2025-03-11 20:12 · 稿源: 快科技

快科技3月11日消息,国产大模型DeepSeek-R1爆火后,许多第三方平台陆续接入了该模型,比如腾讯、阶跃星辰、蚂蚁集团、百度、字节跳动等等。

今日,中文大模型测评基准SuperCLUE发布DeepSeek-R1联网搜索能力首测,公布了10家第三方平台测评结果。

从结果来看,腾讯元宝是本次测评中唯一一个超过80分的第三方平台,以80.61分领跑联网搜索测评榜单,腾讯元宝在总分、基础检索能力和分析推理能力三个关键指标上均位列第一。

阶跃AI以74.49分的总分位居第二,支付宝百宝箱以73.47分位居第三,而其他平台在本次测评中则处于不同的梯队,性能存在一定的差异。

DeepSeek-R1联网搜索能力首测:腾讯元宝第一

各个第三方平台在基础检索能力上平均得分为95.45,而在分析推理能力上的平均得分仅有35.35,相差近60分。

同一平台在基础检索能力和分析推理能力两大维度上的表现也同样差异明显,所有平台的分析推理能力得分都明显低于基础检索能力。

SuperCLUE表示,这反映出在更高级的认知任务,例如理解、分析、推理和解决复杂问题方面,仍有很大的进步空间。

回复率上,飞书知识问答、阶跃AI、腾讯元宝和支付宝百宝箱在联网搜索回复率方面表现优秀,完整回复率均为 100%,截断率和无回复率均为零,成为第一梯队。

秘塔AI搜索、纳米AI搜索和天工AI紧随其后,构成第二梯队,其他平台也均有超过85%的完整回复率,都表现出了较强的稳定性。

耗时方面,总平均耗时从最少的字节火山引擎(17.12秒/题)到最多的MiniMax(73.51秒/题),差距非常显著。

整体来看,耗时分布范围较广,不同平台之间的搜索效率差异较大。

另外,所有平台在分析推理能力上平均耗时都明显高于基础检索能力。

DeepSeek-R1联网搜索能力首测:腾讯元宝第一

DeepSeek-R1联网搜索能力首测:腾讯元宝第一

DeepSeek-R1联网搜索能力首测:腾讯元宝第一

DeepSeek-R1联网搜索能力首测:腾讯元宝第一

举报

  • 相关推荐
  • ​你的品牌在豆包、DeepSeek里搜不到?这份GEO品牌监控攻略,3步把曝光拉满

    GEO指数是AI搜索时代的品牌可见度衡量指标,量化品牌被AI引用、推荐和对比的频率与深度。与传统SEO比拼搜索排名不同,GEO衡量的是品牌在AI回答中的提及率和好感度。数据显示,高GEO指数品牌在AI搜索中的转化率是传统SEO的3.4倍。文章通过案例说明,企业可通过监控竞品差距、补充缺失内容关键词、优化AI提示词等策略提升GEO指数。建议立即使用AIBase平台免费体验GEO监控,把握AI搜索新机遇。

  • DeepSeek崩了上热搜 页面显示“服务器繁忙”

    截至2025年11月3日,大量用户在微博话题#DeepSeek崩了#下集中反馈,DeepSeek平台出现服务异常状况,引发广泛关注。综合各方信息,此次故障呈现多方面表现,对用户使用造成显著影响。 众多用户表示遭遇服务全面中断问题,在尝试使用平台

  • 苹果悄然在iOS 26.1中引入新功能:第三方App可以后台备份照片了!

    苹果在iOS 26.1中引入用户期待已久的后台自动备份照片功能,允许第三方应用在后台自动上传图像。此前,Google相册、OneDrive等应用因系统限制只能在应用活动时上传,导致备份中断、体验糟糕。新功能通过PhotoKit框架支持,引入后台资源上传扩展协议,确保应用未活动或设备锁定时也能持续上传。系统会控制功耗和网络访问以保障备份一致性和电池效率。开发者需完成配置扩展目标、处理上传任务等步骤来集成此功能,部分操作需用户明确同意。

  • 全球跨境第三方收款服务市场快速增长,万里汇市占率第一

    全球跨境电商市场持续扩大,货物贸易占比稳步提升,中国稳居全球主力地位,出口导向格局强化。跨境支付进入实时支付、稳定 币与数字货币时代,小额高频场景推动结构重塑。第三方支付服务价值凸显,中国出口收款市场快速扩容。头部服务商优势扩大,万里汇市占率领先。行业集中化趋势明显,未来服务商将通过深化场景理解、拓展服务边界赋能跨境商家增长。

  • 品牌在deepseek、豆包里排第几?免费GEO排名查询工具帮你一键看清

    随着AI搜索普及,传统SEO正被GEO(生成式引擎优化)取代。GEO核心是提升品牌在AI生成答案中的可见度,而非获取点击流量。数据显示超60%用户已使用AI搜索,若品牌未被AI提及将失去流量入口。文章推荐免费工具AIBase,支持多平台一键检测品牌在主流AI助手的曝光排名、竞品对比及可视化报告,并提供内容权威性、语义化表达等GEO优化策略,帮助品牌在AI时代建立竞争优势。

  • 百度智能云这项开源,让 DeepSeek-V3.2 推理服务吞吐提升 2 倍

    10月28日,百度智能云联合SGLang社区开源针对DeepSeek-V3.2优化的多token预测(MTP)技术代码。该技术通过批量生成和集中验证机制,使模型解码吞吐量提升超2倍,突破传统自回归解码的序列化瓶颈。此次开源的MTP方案已完成与DeepSeek-V3.2稀疏注意力架构的深度适配,并经过百度内部业务验证,开发者可"开箱即用"获得稳定可靠的推理加速能力。

  • 全新开源的DeepSeek-OCR,可能是最近最惊喜的模型。

    ​AI圈虽然天天卷,但是很多的模型,真的越来越无聊了。 每天就是跑分又多了几个点。 直到昨天,DeepSeek久违的发了一个新模型。 DeepSeek-OCR。 这玩意,是真的有点酷。

  • 登榜LMArena!文心大模型5.0-Preview文本能力国内第一

    11月8日,文心全新模型ERNIE-5.0-Preview-1022在LMArena大模型竞技场排名中位列全球第二、中国第一。该模型在创意写作、复杂长问题理解和指令遵循方面表现突出,超越多款国内外主流模型。创意写作可高效生成文章、营销文案等内容;复杂长问题理解适用于学术问答、报告分析等任务;指令遵循能力支持智能助理、代码生成等场景,为多领域内容生产提供高效支撑。

  • GEO排名查询工具深度测评:AI搜索时代的品牌可见度优化指南

    随着ChatGPT等AI搜索平台兴起,用户不再点击传统搜索结果链接,而是直接获取AI生成的答案。这催生了生成引擎优化(GEO)概念,其核心是提升品牌在AI回答中的提及率和推荐顺序。本文通过实测AIBase工具,总结出四大GEO优化策略:优化产品信息的AI可读性、针对性回应用户问题、建立持续监控机制、制定跨平台差异化策略。专业排名监控工具可帮助品牌系统追踪AI搜索表现,在流量变革中抢占先机。

  • 深度测评AIBase GEO排名查询工具,实现AI搜索排名提升

    随着大语言模型和生成式AI普及,品牌可见度竞争已转向AI问答界面——这就是生成引擎优化(GEO)。传统SEO关注搜索列表排名,而GEO要求品牌被AI模型在回答用户问题时“推荐”或“提及”。AIBase推出的GEO排名查询工具,通过覆盖五大主流AI平台、模拟真实用户场景、精准统计推荐频次与排名,帮助企业监测品牌在AI问答中的表现,为提升AI搜索排名提供策略指导。

今日大家都在搜的词: