首页 > 业界 > 关键词  > 大模型最新资讯  > 正文

中科院和汪军团队发布 大模型玩星际争霸秀到起飞

2023-12-29 09:17 · 稿源:站长之家

要点:

1、中国科学院自动化研究所与伦敦大学学院合作,将最近兴起的LLMAgent技术应用于星际争霸II的AI研究。

2、团队通过LLM理解与分析能力来提高星际AI的长期战略规划与可解释性决策。

3、在测试中,LLMagent涌现出了超越AlphaStar的危险预测和兵种转型能力,以及前期快攻、前期侦察等类人策略。

站长之家(ChinaZ.com) 12月29日 消息:面对星际争霸II这一巨大挑战,团队开发了TextStarCraftII——一个全新的交互环境。TextStarCraftII基于python-sc2框架,将游戏中的状态信息和动作空间映射到文本空间。宏观战略动作被转化为LLMAgent能够理解并执行的具体语义动作,而微观操作则交由一套固定的规则式方法处理。LLMagent能够在全新的战场上与游戏内置的AI展开较量。

image.png

论文地址:https://arxiv.org/pdf/2312.11865.pdf

项目地址:https://github.com/histmeisah/Large-Language-Models-play-StarCraftII

在星际争霸II的战场上,进行有效决策需要及时处理大量复杂信息,进行合理的战略分析与长期规划,最终制定宏观战略决策。团队创新性地提出了「ChainofSummarization」方法。

该方法通过单帧总结和多帧总结,提高了LLM在复杂环境中的理解和决策能力。在验证ChainofSummarization方法的有效性方面,团队选择了GPT-3.5-turbo-16k作为LLM。结果表明:ChainofSummarization不仅将LLM与游戏端的交互速度提升了十倍,还显著增强了模型对游戏情境的理解及决策能力。

团队精心设计了一套复杂的提示词系统,包括游戏状态总结,状态分析,策略建议,最终决策。模型能够全面理解游戏的当前局势,分析敌我双方的策略,并提出具有战略深度的建议,最终做出多步的合理决策。这极大地提高了LLM的实时决策能力和长期规划能力,也极大提升了决策的可解释性。

举报

  • 相关推荐
  • GEOBase全链路AI洞察指南:让你的品牌被大模型“看见”

    文章指出超60%用户改用AI助手查询产品,品牌若未被AI推荐即彻底隐形。企业面临AI提及不可见、难追踪、无对策三大痛点。GEOBase提供12+平台监控、引用来源分析、业务洞察、竞品对标、提问挖掘、得分检测等功能,形成优化闭环。某美妆品牌借此三个月AI提及率从12%升至48%,转化增2.3倍,说明GEO已成企业必修课。

  • 企业AI落地:从大模型走向本体驱动的超级组织

    企业部署大模型后仍难落地,根因是缺乏统一业务语义与执行闭环。文章提出,企业AI真正的底层是“本体论+大模型+智能体AI”三层架构:本体定义业务对象与关系,让AI理解企业;大模型负责推理;智能体在治理框架内执行动作。以Orion AIP为例,通过构建统一本体、融合数据与规则,可实现风险分析等场景下的“感知-分析-决策-行动”闭环,让AI从对话工具进化为能工作、可追溯、可信赖的组织核心。

  • 2026年AI音乐生成大模型怎么选?音潮V4.0、Suno V5.5、Udio能力解析

    2026年AI音乐生成大模型竞争转向指令理解、语种覆盖、合规与接口生态。音潮V4.0重构语义理解,支持10语种,开放纯音乐和API,限时免费、成本低且已备案;Suno V5.5仍是英文技术标杆,但中文与版权存短板;Udio强在音质编辑,Mureka偏接口化生产。选型应结合中文/多语种、纯音乐、合规与成本等场景。

  • 全栈AI巨头盘点:联想、阿里、华为、百度贯通算力‑大模型‑终端‑行业方案‑生态

    中国AI正加速推进算力、大模型与终端协同。联想以万全异构智算平台与问天超节点为训练推理底座,通过词元中枢统一调度模型,天禧AI连通PC、手机与平板,并以城市、制造智能体落地行业。阿里以平头哥芯片和阿里云为核心,千问模型贯通应用与终端。华为依托昇腾与盘古模型,连接鸿蒙终端与行业场景。百度则以昆仑芯和文心大模型,延伸至小度与智能驾驶。四家企业全栈路径各异,但均在真实业务中持续交付。

  • 予非知识图谱大模型完成生成式人工智能服务备案!潍坊市首个

    “予非知识图谱大模型”获国家生成式AI服务备案认证,系潍坊首例。模型聚焦非结构化数据治理,具备知识建模、实体对齐、动态图谱等全链能力,内置知识分级与访问控制,适配政务、金融等高合规场景。作为“予非·睿知”平台底座,通过“模型+平台”模式破解知识分散、检索难等痛点,赋能政企业务协同与决策。此举为区域生成式AI合规应用与数字经济发展树立新标杆。

  • 忆联AM6B0:为端侧AI提速,UMA时代的大模型存储“标配”!

    NVIDIA统一内存架构让PC可运行千亿大模型,但对存储性能提出严苛要求。忆联AM6B0 SSD凭借满血性能、高低延迟与可靠设计,成为UMA时代大模型存储“标配”。实测加载千亿大模型仅需14.6秒,顺序读写达7100/6500 MB/s,综合性能领先同级竞品,有效缩短等待、释放生产力,全面补齐算力落地的关键一环。

  • 特斯拉车机系统更新:首次接入豆包大模型

    特斯拉中国今日发布2026.14.13版本车载系统更新,即日起面向Model 3、Model Y、Model S、Model X 四款车型分批推送。 总体上看,本次升级囊括智能大模型接入、车载场景实用功能、交互体验优化以及多项系统安全漏洞修复,改动覆盖用车全场景。 值得一提的是,本次更新最大亮点,是特斯拉国内车载系统首次搭载第三方大模型字节跳动豆包大模型正式入驻车机,接替原有语音体系�

  • 阿里发布 Qwen-Audio-3.0-ASR-Flash 语音识别大模型

    阿里发布新一代语音识别大模型 Qwen-Audio-3.0-ASR-Flash,重点优化了专业词汇的识别表现。该模型已在医疗等垂直场景中展现出较高准确率,相关听写准确率突破九成五。 语音识别在通用对话中已相对成熟,但在医学、法律、工业等专业领域,由于术语密集且发音相近词多,模型常常出现误判。此次新模型强化了对专业词的处理能力,使其更贴合真实行业场景的需求。

  • 智谱GLM-5.3大模型发布:开源中最强、编程/智能体性能接近Fable 5

    智谱创始人几个小时前才说GLM-5.3很快发布,没想到中午就发了,相比当前的GLM-5.2提升50%,是开源最强的,编程与智能体性能接近Fable 5。 与之前传闻的不同,GLM-5.3跟GLM-5.2基座模型还是一样的7400多亿参数量,升级到万亿参数是没有的,有可能是留给GLM-5.5了,但这也没有妨碍GLM-5.3通过后训练来提升性能水平。 根据智谱说法,在多项主流基准测试中GLM-5.3是当前排名最高的开源�

  • 能生成MV/音乐视频的AI音乐模型推荐:音潮V4.0、Suno、Udio 音乐模型、视频模型边界厘清

    文章澄清“能生成MV的AI音乐模型”易误解:Suno、Udio等只出音频,可灵、Runway等只出画面;真正音画同源一体化产品很少,音潮是国产落地较完整代表,其V4.0升级指令理解、纯音乐开放、十大语种覆盖,并支持一键MV与商用。选购需先分清三类边界,按需求匹配。

今日大家都在搜的词: