首页 > 业界 > 关键词  > 大模型最新资讯  > 正文

一行代码提高大模型10%性能,开发者:免费午餐

2023-10-23 08:58 · 稿源: ​量子位公众号

大模型微调有“免费的午餐”了,只要一行代码就能让性能提升至少10%。在7B参数量的Llama2上甚至出现了性能翻倍的结果,Mistral也有四分之一的增长。虽然这种方法用在监督微调阶段,但RLHF模型也能从中受益。来自马里兰州大学、纽约大学等机构的研究人员提出了名为NEFT(une)的微调

......

本文由站长之家合作伙伴自媒体作者“​量子位公众号”授权发布于站长之家平台,本平台仅提供信息索引服务。由于内容发布时间超过平台更新维护时间,为了保证文章信息的及时性,内容观点的准确性,平台将不提供完全的内容展现,本页面内容仅为平台搜索索引使用。需阅读完整内容的用户,请查看原文,获取内容详情。

举报

  • 相关推荐
  • 大家在看

今日大家都在搜的词: