首页 > 热点 > 关键词  > 正文

元象开源高性能大模型XVERSE-65B-2底座版 提升代码和数学能力

2023-12-19 08:31 · 稿源:站长之家

站长之家(ChinaZ.com)12月19日 消息:元象宣布开源高性能大模型 XVERSE-65B-2底座版,专项提升其代码和数学能力,并保持了上一代强大的生成创作、角色扮演与工具使用等能力,为生态献上了一个 “文理兼修、大有可为” 的大模型。

XVERSE-65B-2在上一代基础上通过综合优化器状态、学习率调节策略和采样比进行了 Continual Pre-Training,训练 token 总量达3.2万亿;模型支持中、英、俄、法等40多种语言,上下文窗口为16K。

元象大模型系列坚持 “高性能” 定位,在研究人员参考一系列权威学术测评制定的六个维度、11项主流测评标准中,XVERSE-65B-2在八成测评中超越了 GPT3.5,并全面超越开源标杆 Llama2-70B 和 Falcon-180B;与 GPT4仍有差距。

最新发布的 SuperCLUE 中文通用大模型综合测评,在1052道多轮简答题和3213道客观选择题测试中,XVERSE-65B 在国内开源模型中总分第一,展现了出众实力。

微信截图_20231219083140.png

与7B、13B 相比,65B 显著提升大模型的理解、生成、逻辑和记忆等能力,可处理更多样、更困难的任务,如构建智能体(AI Agent),也通过高质量数据与搜索增强,极大降低了模型幻觉问题。

至此,元象共开源70亿、130亿、650亿参数的3款大模型,其中 XVERSE-65B 为国内最早开源、最大参数的免费商用模型。

项目地址:

  • Github:https://github.com/xverse-ai/XVERSE-65B

  • Hugging Face:https://huggingface.co/xverse/XVERSE-65B-2

  • ModelScope魔搭:https://modelscope.cn/models/xverse/XVERSE-65B-2

举报

  • 相关推荐
  • 智谱GLM-5.3大模型发布:开源中最强、编程/智能体性能接近Fable 5

    智谱创始人几个小时前才说GLM-5.3很快发布,没想到中午就发了,相比当前的GLM-5.2提升50%,是开源最强的,编程与智能体性能接近Fable 5。 与之前传闻的不同,GLM-5.3跟GLM-5.2基座模型还是一样的7400多亿参数量,升级到万亿参数是没有的,有可能是留给GLM-5.5了,但这也没有妨碍GLM-5.3通过后训练来提升性能水平。 根据智谱说法,在多项主流基准测试中GLM-5.3是当前排名最高的开源�

  • 零数区块链TPS超23万、代码自主率99.74%,数据流通底座是如何炼成的?

    零数科技深耕数据流通,自研区块链TPS超23万、代码自主率达99.74%。公司构建区块链、隐私计算、可信数据空间、数智工厂等全栈底座,落地政务、汽车、能源、文旅、医疗、金融等20余城及百余机构,已实现盈利,并获多家权威报告认定专业厂商第一。

  • 极光旗下 Modellix 接入 PixVerse V6:一次请求生成接近成片级的视频内容

    极光旗下AI媒体模型聚合平台Modellix.ai正式接入PixVerse V6。该模型面向生产级创作,可一次生成最长15秒1080p视频,支持同步音频、多镜头调度与精准控制,覆盖文生视频、图生视频、首尾帧过渡、视频延展及参考图融合五类工作流。通过统一API按秒计费、透明定价,并推出限时20%折扣,降低开发者与企业测试、集成门槛,推动AI视频生成走向可直接交付的规模化生产。

  • 智谱发布 GLM-5.3,自称编程最强的开源模型

    智谱在8月14日正式推出 GLM-5.3。有意思的是,这一版的基座模型跟 GLM-5.2其实是同一个,提升全靠后训练 Scaling 把智能上限往上拉,用了几十倍的长程任务环境、更丰富的环境类型,还有超长的后训练时间。 编程是这次最被拿来当卖点的能力。智谱称 GLM-5.3是编程能力最强的开源模型,内部体感评测比上代提升50%,在 Terminal Bench3.0、Agents' Last Exam(CLI)这些公开基准上拿到开

  • 京东开源JoyAI-Video-Edit模型!实现视频边播边改:综合性能全球领先

    京东正式开源自研实时流式视频编辑模型JoyAI-Video-Edit,打破传统视频先成片再剪辑的固有模式,实现播放画面同步实时修改,在流式实时视频编辑方向的各项指标全面领先,达到世界一流水平。 依托JoyAI基础大模型底座,设备在720P分辨率下可稳定实现30帧实时运算,画面处理无明显延迟卡顿,适配常规视频播放同步修改需求。模型摒弃行业只能剪辑短视频片段的短板,支持超

  • 全球最大2.8万亿参数大模型 Kimi K3今晚正式开源:性能坐稳前三

    国产大模型公司月之暗面本月16日发布新一代旗舰大模型Kimi K3,官方表示会在7月27日正式开源,今晚就要登台了。 Kimi在Hugging Face官方账号创建了Kimi K3模型页面,并开启权重发布倒计时,页面显示该模型预计将在北京时间7月27月23时上线,也就是今晚11点。 这个时间点也比较适合美国当地时间,显然是想给刚上班的美国人一点震撼。

  • 企业AI落地:从大模型走向本体驱动的超级组织

    企业部署大模型后仍难落地,根因是缺乏统一业务语义与执行闭环。文章提出,企业AI真正的底层是“本体论+大模型+智能体AI”三层架构:本体定义业务对象与关系,让AI理解企业;大模型负责推理;智能体在治理框架内执行动作。以Orion AIP为例,通过构建统一本体、融合数据与规则,可实现风险分析等场景下的“感知-分析-决策-行动”闭环,让AI从对话工具进化为能工作、可追溯、可信赖的组织核心。

  • 全栈AI巨头盘点:联想、阿里、华为、百度贯通算力‑大模型‑终端‑行业方案‑生态

    中国AI正加速推进算力、大模型与终端协同。联想以万全异构智算平台与问天超节点为训练推理底座,通过词元中枢统一调度模型,天禧AI连通PC、手机与平板,并以城市、制造智能体落地行业。阿里以平头哥芯片和阿里云为核心,千问模型贯通应用与终端。华为依托昇腾与盘古模型,连接鸿蒙终端与行业场景。百度则以昆仑芯和文心大模型,延伸至小度与智能驾驶。四家企业全栈路径各异,但均在真实业务中持续交付。

  • 到底提升多少!小米官方晒澎湃OS4优化效果 流畅提升明显

    今天小米正式对外发布了全新的澎湃OS4操作系统,在核心基础体验维度,小米这次一口气带来了三项重磅升级,专门给澎湃自研内核Xiaomi HyperCore加入了负载精算、内存预载两项底层技术,同时从零搭建了全新的小米澎湃OS专属应用运行环境。 这次新系统发布之后,用户关注度最高的问题还是小米新系统的流畅度表现,官方也直接放出了全链路优化后的实测数据,把实际优化效

  • 忆联AM6B0:为端侧AI提速,UMA时代的大模型存储“标配”!

    NVIDIA统一内存架构让PC可运行千亿大模型,但对存储性能提出严苛要求。忆联AM6B0 SSD凭借满血性能、高低延迟与可靠设计,成为UMA时代大模型存储“标配”。实测加载千亿大模型仅需14.6秒,顺序读写达7100/6500 MB/s,综合性能领先同级竞品,有效缩短等待、释放生产力,全面补齐算力落地的关键一环。

今日大家都在搜的词: