首页 > AI头条  > 正文

AI国际象棋大赛火热开战!Grok 4一骑绝尘,DeepSeek与 Kimi K2的冤屈

2025-08-07 11:17 · 来源: AIbase基地

近日,谷歌与 Kaggle 联合举办的首届 AI 国际象棋对战赛事备受瞩目。在这一场 “智力的较量” 中,马斯克旗下的 Grok4展现了非凡的实力,成为首日比赛的绝对焦点。

这场比赛聚集了多款顶尖 AI 模型,参赛选手包括 OpenAI 的 o3和 o4-mini、DeepSeek R1、Kimi K2Instruct、Gemini2.5Pro、Gemini2.5Flash、Claude Opus4和 Grok4。比赛于8月5日至7日每天下午10:30(太平洋时间)准时直播,国际象棋特级大师中村光(Hikaru Nakamura)也受邀担任解说。

马斯克、xAI、Grok

首日对决中,Grok4以超凡的战术表现和快速反应获得了最高评价,而 DeepSeek R1虽表现强劲,但不敌 o4-mini,Kimi K2则被认为惨遭不公,网友们纷纷为其鸣冤。马斯克对此次比赛的成功表现淡定回应:“我们并没有特别训练,这只是一个副产品。” 可见,他对此次比赛的宣传价值可谓深谙其道。

虽然比赛结果引起了热议,但其真正的意义在于测试 AI 的 “涌现能力”。国际象棋以其明确的规则和高复杂度(存在约10^120种可能局面)成为了评估 AI 决策能力的理想舞台。很多网友表示,这场比赛不仅仅是输赢的较量,更是 AI 综合能力的全面展示。

经过首轮较量,Grok4与 Gemini2.5Pro、OpenAI 的 o4-mini 和 o3晋级半决赛。各对决中,Grok4如猛兽般的表现让人惊叹,而 Kimi K2的频繁违规行为则让其面临被淘汰的境地,观众对此颇有微词。尽管如此,比赛仍在继续,大家期待后续的精彩对决。

为何选择国际象棋作为 AI 对战的舞台?这主要是因为国际象棋规则清晰但战略复杂,能够有效评估 AI 的决策能力。正如网友所说,这场比赛的结果不仅是对各模型能力的检测,更是对 AI 技术的一次深度探索。

  • 相关推荐
  • AI日报:京东物流推出超脑大模型2.0;DeepSeek V3.1终结版发布;Kimi 推出全新 Agent 模式

    本期AI日报聚焦多领域技术突破:京东物流发布“超脑大模型2.0”与“异狼具身智能机械臂系统”,推动物流行业迈向自主执行;DeepSeek推出V3.1终结版,修复漏洞并为V4架构铺路;Kimi上线Agent模式“OK Computer”,支持智能网站开发等复杂任务;ChatGPT新增个性化资讯功能,定制用户专属新闻;Exa Code发布代码索引工具,助力AI代理精准生成代码;Meta推出AI视频创作平台Vibes,简化短视频制作;蚂蚁数科发布隐私保护AI框架Gibbon,推理速度提升超百倍;OpenAI新基准测试显示GPT-5在多个行业逼近人类专家水平,覆盖九大行业44种职业。

  • DeepSeek-V3.2-Exp正式发布

    DeepSeek于9月30日正式发布实验性模型DeepSeek-V3.2-Exp,该模型基于V3.1-Terminus升级,引入创新的稀疏注意力机制DSA,首次实现细粒度稀疏注意力,在保持模型输出效果的同时显著提升长文本训练和推理效率。测试显示其表现与V3.1-Terminus基本持平。应用层面,官方App、网页端及小程序均已同步更新。同时宣布API价格大幅调整:输入缓存0.2元、输入未缓存2元、输出3元,开发者调用成本降低50%以上。模型已在HuggingFace和魔搭开源平台上线。

  • AI日报:豆包大模型1.6-vision发布;DeepSeek发布V3.2-exp模型;Claude Sonnet4.5发布

    本期AI日报聚焦多项技术突破:DeepSeek发布V3.2-exp模型,通过稀疏注意力机制降低API成本50%;Anthropic推出Claude Sonnet 4.5,在编码任务表现卓越;ChatGPT新增即时结账功能,实现对话界面直接购物;OpenAI将推出AI版TikTok,所有内容由Sora2模型生成;百度地图升级小度想想2.0,提供智能出行服务;蚂蚁集团开源万亿参数模型Ring-1T-preview;DeepMind提出“帧链”概念,推动视频模型实现全面�

  • 强强联手!深度求索、寒武纪同步发布DeepSeek-V3.2模型架构和基于vLLM的模型适配源代码

    2025年9月29日,深度求索公司发布新一代模型架构DeepSeek-V3.2,引发行业关注。寒武纪同步宣布适配该模型并开源vLLM-MLU推理引擎代码。新发布的DeepSeek-V3.2-Exp是实验性版本,在V3.1-Terminus基础上引入稀疏注意力机制,优化长文本训练和推理效率。目前官方应用端已同步更新,API大幅降价。此次模型体积达671GB,下载需8-10小时。业内专家指出,此次快速适配表明双方早有深度技术协�

  • DeepSeek更新至V3.1 Terminus版本:两大升级

    9月22日,深度求索宣布DeepSeek V3.1已更新至Terminus版本,官方App、网页端、小程序与API模型同步升级。本次更新在保持模型原有能力基础上,针对用户反馈进行改进:优化语言一致性,缓解中英文混杂、异常字符等问题;提升Code Agent与Search Agent表现。官方表示新版本输出效果更稳定,各领域评测表现优异。开源版本已在Hugging Face和ModelScope平台发布。

  • REDMI K90 Pro参数出炉 产品经理:影像大升级

    REDMI很快就会推出年度旗舰REDMI K90 Pro,该机对应的海外版本命名为POCO F8 Ultra。 据悉,REDMI K90 Pro将会配备一颗5000万像素1/1.3英寸超大底主摄,对比上代K80 Pro的1/1.55英寸主摄,K90 Pro搭载了REDMI史上规格最强的主摄,并且支持OIS光学防抖。 除此之外,REDMI K90 Pro还将配备潜望长焦镜头,这是REDMI K系列第一款拥有潜望镜头的旗舰,相较直立长焦,潜望长焦能够放下更大底更高质量�

  • 破解 AI “安全与性能” 难题!DeepSeek-R1-Safe 基础大模型在华为全联接大会2025正式发布

    9月18日,华为全联接大会2025在上海开幕。会上,华为与浙江大学联合发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型。该模型在安全防护能力上表现突出,对有害言论、敏感内容等14个维度的防御成功率近100%,同时通用能力测试性能损耗控制在1%以内。双方表示将继续深化合作,推动AI安全技术与产业生态协同发展,为我国人工智能高质量发展提供支撑。

  • Kimi付费会员服务上线:最高99元/月!可使用全新OK Computer

    9月25日,月之暗面旗下智能助手Kimi上线付费会员服务,分为三档:免费版Adagio提供有限使用次数;49元/月的Andante含适量使用次数及API兑换券;99元/月的Moderato支持更多次数和并发功能。此前打赏用户开通会员可获等值权益。同时推出的OK Computer为全新Agent模式,用户下达需求后,Kimi可操作虚拟电脑完成复杂任务。

  • 真我GT8 Pro正面首曝:2K 144Hz视觉四等边直屏

    真我GT8+ Pro曝光,采用视觉四等边2K直屏,为业内首款2K+144Hz屏幕,搭载BOE Q10+发光材料,峰值亮度达7000nit。配备第五代骁龙8至尊版芯片,采用台积电3nm工艺,搭配电竞独显芯片R1优化性能。影像方面搭载2亿像素潜望长焦,支持3倍光学变焦和120倍数码变焦,摄像头模组采用独特机器人形状设计。此外配备对称式双扬声器、120W快充、7K大电池及X轴线性马达等。真我高管称其为同价位最佳屏幕之一,预计节后公布更多信息。

  • 真我GT8 Pro蓄势待发 徐起:唯一骁龙8至尊5+2K直屏+2亿长焦

    真我中国区总裁徐起表示,真我GT8 Pro定位性能影像双擎旗舰,拥有性能旗舰才有的骁龙旗舰电竞双芯和2K直屏,同时拥有性能旗舰没有的2亿潜望长焦,让性能影像不必二选一。 徐起强调,真我GT8 Pro是目前行业唯一的骁龙8至尊5 2K直屏 2亿长焦组合,更多惊喜期待和你分享。 据悉,真我GT8 Pro配备5000万像素1/1.5英寸大底主摄,同时配备2亿像素1/1.56英寸大底潜望长焦,这是同期�

今日大家都在搜的词: