智源等机构发布LM-Cocktail模型治理策略低成本高性能

2023-12-11 13:58 · 稿源：站长之家

要点:
大语言模型（LLM）微调通常导致在目标任务上性能提高，但通用能力下降，而开源社区中存在多个模型，选择和管理成为问题。
智源研究院发布的LM-Cocktail策略通过融合多个模型，计算不同模型的重要性，实现在目标任务上提升性能的同时保持通用能力。
LM-Cocktail通过手动或自动计算加权权重融合模型，实验证明在目标任务上维持竞争力的同时提高通用性能，适用于无法微调的场景。

站长之家（ChinaZ.com）12月11日消息:随着大模型技术的发展，模型治理成为关注焦点。研究者在微调大语言模型时，往往面临性能提高与通用能力下降的问题。智源研究院提出LM-Cocktail模型治理策略，通过融合多个模型，计算不同模型的重要性，并在目标任务上提升性能的同时保持通用能力。这一策略不仅能手动选择模型配比，还能通过极少量样例自动计算加权权重，使模型在不重新训练的情况下融合优势。

项目地址:https://github.com/FlagOpen/FlagEmbedding/tree/master/LM_Cocktail

实验结果表明，LM-Cocktail能够在目标任务上提高准确度，同时保持通用性能。对于无法微调的场景，LM-Cocktail通过混合已有模型，实现了新任务上的性能提升，避免了对大量数据和计算资源的需求。LM-Cocktail的灵活性和高效性为大模型开发者提供了一种低成本持续提升模型性能的途径。

这一模型治理策略的创新之处在于其核心思想是将微调后的模型与其他模型的参数融合，通过加权求和整合各模型的优点，实现在特定任务上的性能提升，同时保持通用性能。LM-Cocktail通过计算融合比例，进一步融合其他微调模型，进一步提升通用性能。

该策略的应用不仅限于微调，对于缺乏目标任务标签数据或计算资源的开发者，LM-Cocktail通过构造极少量的数据样例融合社区中已有的大语言模型，生成适用于新任务的模型，提高了目标任务的准确度，同时无需进行繁重的模型训练。LM-Cocktail的实用性体现在其对于数据和资源的限制下，仍能有效提升模型性能。

LM-Cocktail模型治理策略为大模型开发者提供了一种灵活而高效的选择，通过巧妙融合现有模型，解决了在模型治理中的挑战，为模型性能提升提供了低成本、可行的途径。

（举报）

相关推荐
大家在看

关键词：

模型

【腾讯云】11.11云上盛惠！云服务器首年1.8折起，买1年送3个月！

11.11云上盛惠！海量产品 · 轻松上云！云服务器首年1.8折起，买1年送3个月！超值优惠，性能稳定，让您的云端之旅更加畅享。快来腾讯云选购吧！

Docker容器镜像
去看看

Docker容器镜像 60元/15天

爆款产品组合购
去看看

爆款产品组合购低至1元

腾讯云x NVIDIA加速计划
去看看

腾讯云x NVIDIA加速计划最高获赠10万元扶持基金

2核2G云服务器
去看看

2核2G云服务器 112元/1年

查看更多相关信息>>

腾讯云 12-20

广告
Stability AI发布Stable LM2模型更新，参数增至120亿

站长之家（ChinaZ.com）4月9日消息:Stability AI在最新的Stable LM2模型更新中，宣布将参数增至120亿，以提升性能与可访问性。该更新为用户提供了更强大、更精确的文本内容生成能力。Stability AI指出，该模型在特定基准测试下表现优异，超过了Llama270B等更大型模型。新的Stable LM212B模型包括基础版本和经过指导调整的变体，旨在增强七种语言（英语、西班牙语、德语、意大利语、法�

StabilityAI StableLM2 AI头条
Stability AI发布CosXL模型图像处理能力更精细

StabilityAI最近推出了CosXL模型，这是一项包括基础版CoXL和增强版EditCosXL的创新技术。这些模型的发布，标志着图像生成和编辑技术的新里程碑，为用户提供了更加强大和精细的图像处理能力。特别是ComfyUI，它还为用户提供了详细的工作流程和指导，帮助用户更加高效和便捷地使用CosXL模型。

CosXL AI头条
多模态大模型Reka Core发布性能与GPT-4相媲美

RekaCore是一款最新发布的多模态大型语言模型，其性能可与GPT-4相媲美，甚至在某些方面超越了现有的前沿模型。这一技术突破为人工智能领域带来了新的里程碑，特别是在图像、视频和音频的上下文理解能力方面。随着Core的进一步优化和应用，我们有理由相信，它将在多个领域产生深远的影响，推动人工智能技术的进步和社会的发展。

多模态大模型 AI头条
国产自主架构！中兴AxonStation高性能台式机官宣：4月11日发布

今天中兴宣布了一台拥有自主架构的高性能台式机中兴AxonStation。新机将会在4月11日的中兴行业终端春季新品发布会正式登场。中兴AxonStation显然是会搭载国产处理器搭配国产系统，具体详细信息还要等待官方在发布会上揭晓了。

中兴AxonStation 高性能台式机自主架构
谷歌发布新代码模型Code Gemma：参数小、性能强，硬件要求低！

谷歌最近发布了面向企业、开发人员的全新代码模型CodeGemma，该模型参数小、性能强，同时对硬件要求较低。CodeGemma共有基础预训练、指令微调和快速推理三个版本，在基准测试中展现出优异的性能表现。以上为谷歌发布的CodeGemma模型的相关内容，更多详细信息可参考开源地址和技术报告。

CodeGemma AI头条
元象大模型开源30款量化版本可更低成本部署

元象大模型开源了30款量化版本，支持vLLM和llama.cpp等主流框架的量化推理，无条件免费商用。对量化前后的模型能力、推理性能进行评估，以XVERSE-13B-GPTQ-Int4量化版本为例，量化后模型权重压缩了72%，总吞吐提高了1.5倍，同时保留了95%的能力。元象大模型的开源量化版本提供了方便快捷的部署方式，可以根据需求选择不同的框架和精度模型进行部署和推理。

元象大模型量化版本推理性能
荐个人商家如何在小红书低成本起盘？附低成本打法案例

如何在小红书低成本起盘?是很多个人商家经常问的问题，个人商家是小红书最多的商家，她们有产地、货源、价格等优势，但没有充足的预算投达人和广告。对个人商家言，核心是拿到更多的自然流量，小红书站内转化，全域外溢。看你当前的实际情况，如你一直以付费打法做，就完全可专业号千帆/聚光，若你自然流量获取能力强，有专门的运营人员，就可以批量薅官方自然流量，矩阵化批量化进行。

小红书小红书运营
畅玩3A游戏，这款高性能PCIe4.0固态了解一下！

当今3A游戏制作越来越精良，画画效果堪比好莱坞大片，带来震撼的视觉享受。可瞅一眼推荐配置清单，3A游戏对于硬件性能要求水涨船高。选择一款适合自己需求的高性能固态硬盘，让游戏体验感拉满。

3A游戏游戏硬件配置 PCIe4.0SSD
ToDesk云电脑开启公测！支持AIGC、高性能渲染等场景，价格低至0.98元

在云计算和人工智能技术飞速发展的今天，云电脑作为一种新型的计算模式，正逐渐改变着传统电脑的使用方式。ToDesk云电脑宣布开启公测，以其支持AIGC、高性能配置等特性，引起广大用户的热烈关注。随着云计算技术的不断发展和普及，相信ToDesk云电脑将会在未来成为更多用户的首选计算平台。

云电脑 ToDesk 云计算
Jamba官网体验入口最新高性能开源AI语言模型下载使用地址

Jamba是一款基于SSM-Transformer混合架构的开放语言模型，提供顶级的质量和性能表现。它融合了Transformer和SSM架构的优势，在推理基准测试中表现出色，同时在长上下文场景下提供3倍的吞吐量提升。作为基础模型，Jamba旨在供开发者微调、训练并构建定制化解决方案。

Jamba

TravAI:是一款AI驱动的旅行培训产品，提供交互式AI培训、模拟、评估和智能助手，为旅行行业人员提供最新的技能和知识。

TravAI是一款旅行行业的AI驱动培训产品，通过注入AI技术，为培训注入活力。它能创建引人入胜、交互式的培训课程，进行逼真的角色扮演模拟，并设计能够真正起作用的测验。同时，TravAI利用您的数据为旅行团队量身定制个性化学习体验，让培训不再是通用的、一刀切的。它是培训旅行业专业人员的更智能、更快速的方式。

旅行培训 AI

Nextminds:是一家提供在线辅导服务的平台，为所有科目和学术水平的学生提供个性化辅导。

Nextminds是一个提供在线辅导服务的平台，通过与经验丰富的导师在线互动，为学生提供个性化的学习经验。平台提供ICSE、CBSE和州委员会等多种教育体系的辅导。Nextminds的主要优点是学生可以在舒适的家中与专业的导师进行一对一的在线学习，为学生提供高质量的辅导服务。

在线辅导学习个性化

Pedagogue.io:每天花费10分钟，提升您的AI技能。

Pedagogue是一款AI技能培训平台，旨在帮助个人和企业提升AI技能。通过该平台，用户可以学习AI工具、技术和策略，并获得40%的生产力提升。Pedagogue的优势在于更新及时的内容库、个性化的技能培养、有趣的学习方式以及具有商业价值的数据驱动洞察。

AI 技能培训教育

LexiGym:你的语言学习伴侣。🚀 # #HinkouLabs

LexiGym是一款语言学习应用，帮助用户提升语言技能。它具有离线和多语言支持的创新功能，是最强大的语言学习伴侣。用户可以根据自己的预算选择免费使用或付费订阅，灵活选择学习方式。LexiGym还提供易于创建字典和智能学习等功能，以及详细的训练统计数据。

语言学习词汇训练多语言

Alevels.ai:A Levels AI是一个利用人工智能提高A Levels学习成绩的工具。

A Levels AI利用人工智能技术，提供个性化的学习计划和辅导资源，帮助学生在A Levels考试中取得优异成绩。它通过分析学生的学习情况和弱点，为其提供针对性的学习建议和练习题。A Levels AI还提供实时答疑和学习进度跟踪功能，帮助学生更好地掌握知识。

教育考试辅导人工智能

MailReply:是一款AI助手，可生成专业且人性化的邮件回复，节省时间。

MailReply通过AI生成邮件回复，帮助用户节省时间。它可以在保持人类写作风格的同时，根据邮件内容生成上下文相关的回复。MailReply适用于Windows和macOS，并兼容多种邮件客户端。

邮件回复 AI助手工具

Notification harbor:高性能团队的电子邮件营销平台

Notification harbor是一个为电子邮件营销团队提供AI优化的电子邮件内容和自动化流程的平台。通过使用LLM技术，我们可以在短短5分钟内创建高性能的电子邮件营销内容，并且随着时间的推移，产品甚至可以自我优化。我们的平台简化了电子邮件营销活动的方式，确保每个活动都能精准地与您的目标受众建立联系。AI生成的电子邮件模板根据您提供的信息和要求选择最合适的模板。实时个性化电子邮件可以提高用户参与度和转化率，并根据每个用户实时定制内容。AI驱动的电子邮件营销使您的团队在创建电子邮件模板和文本方面节省了60％的时间。

电子邮件电子邮件营销 AI优化

Magic Loops:通过结合ChatGPT自动化与代码，创建简单的自动化任务

Magic Loops是一种基于ChatGPT的自动化工具，可以连接数据、发送电子邮件、接收短信、爬取网站等功能。它能够帮助用户自动化生活中的各种任务，提高工作效率。Magic Loops的主要优点是可以与各种数据源和应用程序集成，轻松实现个性化的自动化需求。

自动化工具 ChatGPT

ReplyAuto:Reply Auto是一款AI邮件助手，能够根据上下文理解邮件内容，并提供智能回复。

Reply Auto是一款使用AI技术的邮件助手，它能够自动分析邮件内容，根据上下文提供智能回复。它的主要优点是提高工作效率，减轻用户的邮件负担，并能够个性化定制回复。Reply Auto定位于帮助用户更高效地处理电子邮件，提高工作效率。

邮件智能回复工作效率

Mailman Workcation:智能邮递员 - 自动化影响力的智能Twitter机器人

AI Mailman利用最新的人工智能技术创建世界上最准确的邮件，比人类更快速和高质量。它提供简单的用户界面，能够创建世界上最强大的邮件模板，打开率更高。使用AI Mailman创建的邮件打开率是其他方式的10倍，生成时间只需10秒。

邮件自动化影响力

Inpost:一款AI驱动的移动应用程序，可以改善个人电子邮件体验。

Inpost.ai是一款基于AI的移动应用程序，可以优化个人电子邮件体验。它帮助用户智能地组织和清理收件箱，专注于重要的电子邮件。它提供无缝的邮件交互，提供增强的安全性和独家功能。通过高级AI模型分析邮件内容，而不暴露用户的敏感信息。用户可以轻松追踪支出、管理发票，并利用促销优惠来优化个人预算。Inpost.ai还提供定制的收件箱分类，让用户能够个性化和高效地管理和优化收件箱。

电子邮件 AI 个人化

Leadog:AI驱动的冷邮件营销、线索跟踪和互动

Leadog.io是一款AI驱动的冷邮件营销平台，提供冷邮件发送、线索跟踪和互动等功能。它采用先进的AI技术来优化冷邮件营销策略，提供精确的邮件投递和跟踪，帮助用户更好地了解和转化潜在客户。

冷邮件线索跟踪营销工具

Prospect AI:一键查找网站上的电子邮件地址和联系人信息

Prospect AI是一款插件，可以帮助销售团队、数字营销人员和公关专业人员免费查找公司的联系人。它使用人工智能技术，快速获取所需的联系人信息，帮助用户拓展业务关系。

市场营销销售潜在客户

Email whisperer:写作完美邮件，让你的电子邮件沟通更上一层楼！

Email Whisperer是一个用于Gmail和Outlook的AI电子邮件编写工具。它可以帮助你轻松地写出完美的电子邮件，提供重新表达、拼写检查和修正功能。它能够提高你电子邮件的清晰度和风格，并确保邮件无错误。Email Whisperer是一个提高电子邮件写作效率的工具，让你的邮件专业而准确。

生产力电子邮件 AI工具

Humanize AI by AI Text Converter:将AI生成的文本转换为与人类写作相匹配的内容。

Humanize AI Text是一个免费在线的AI文本人性化转换工具，能够绕过AI检测，并将AI生成的文本转换为与人类写作相匹配的内容。

AI转换工具文本人性化 AI检测绕过

Happily.ai:使用，超越传统调查。我们的AI平台分析员工情绪，提供可操作的见解，为健康、投入、高绩效的团队提供支持。

Happily.ai是一个AI工具包，帮助人力资源和经理人通过无忧无虑的参与、认可和绩效管理来提高人才留存和团队生产力。

员工参与度人力资源绩效管理

ChatKPI:是一款基于AI的数据分析工具，可以通过文本消息跟踪销售趋势、识别热门产品、了解客户行为，提供图表、定制CSV等功能。

ChatKPI是一个AI数据分析工具，旨在帮助Shopify商家做出更明智的数据驱动决策。它可以提供实时洞察力，跟踪销售趋势，识别热门产品，了解客户行为，并通过自然语言对话提供个性化的商业洞察。ChatKPI可以通过文本消息或在Shopify商店内安装的应用程序使用。

数据分析销售趋势热门产品

Limodify.AI | Email Marketing Design Meets AI:Limodify.AI通过AI技术提供电子商务邮件创建服务。

Limodify.AI革新了电子商务邮件的创建过程，只需点击几下，选择格式，输入关键信息，即可在30秒内获得准备好发送的AI设计的邮件。节省时间，利用先进技术，精确实现您的营销目标。立即免费开始使用。

电子商务邮件营销 AI

PurplePro:使用AI技术，只需两个点击即可启动您的忠诚度俱乐部。

PurplePro是一个使用AI技术的插件，它可以帮助您在短短两个点击的时间内启动您的忠诚度俱乐部。PurplePro通过游戏化和动态的积分规则增加用户参与度，并奖励他们。它还提供了强大的推荐、挑战、问卷和可变奖励功能，帮助您将首次用户转化为忠实的客户。

忠诚度俱乐部用户参与度奖励

LISUTO:株式会社は、eコマースのセラーやマーケットプレイスが売上を増やし、時間を節約し、コアビジネスに集中できるスマートデータ構造化ソリューションのリーダーです。

LISUTO株式会社は、eコマースのセラーやマーケットプレイスが売上を増やし、時間を節約し、コアビジネスに集中できるスマートデータ構造化ソリューションのリーダーです。LISUTO AIは、AIタッガーやイメージタッガーなどのサービスを提供し、商品のタグ登録やナビゲーション改善などを自動化し、効率を向上させます。

智源等机构发布LM-Cocktail模型治理策略 低成本高性能

今日大家都在搜的词：

热文

站长商机

智源等机构发布LM-Cocktail模型治理策略低成本高性能