首页 > 业界 > 关键词  > HelpSteer最新资讯  > 正文

英伟达发布HelpSteer:一个用于构建有用LLM的开源数据集

2023-11-28 11:19 · 稿源:站长之家

站长之家(ChinaZ.com)11月28日 消息:英伟达最近宣布了NVIDIA NeMo SteerLM技术作为英伟达 NeMo框架的一部分。这项技术使用户能够在推断过程中控制大型语言模型(LLM)的响应。

英伟达 NeMo团队现在正在开源一个名为HelpSteer的多属性数据集。这个新资源使开发人员能够快速开始使用SteerLM技术并构建最先进的自定义模型。HelpSteer是我们团队与Scale AI合作的成果。结合SteerLM技术,它提高了响应的事实性和连贯性。开发人员现在可以在复杂性和冗长度等其他属性上引导LLM的响应,增强响应对最终用户的整体可控性。

image.png

项目地址:https://huggingface.co/datasets/nvidia/HelpSteer

通过使用这个新的数据集和SteerLM技术,英伟达训练了一个名为Llama270B的基础模型,其表现优于Llama2-70B聊天模型。

为了构建这个数据集,NeMo团队收集了约10,000个高质量提示,并使用内部LLM为每个提示生成了四个响应。然后,团队请人工专家根据0-4的评分来评估每个响应。Scale的生成式AI数据引擎将自动化和人工智能相结合,快速生成与特定AI目标和数据需求相适应的训练数据。

image.png

数据集中的所有响应都以五个属性进行了注释,包括:响应在整体上满足了提示的要求程度、响应是否包含事实准确、相关的信息而没有幻觉或虚假信息、响应的清晰度、逻辑性和自洽性以及响应的词汇和句子结构的复杂程度(从基础到专家级)、响应相对于提示所要求的是简洁还是冗长。

通过这个数据集和SteerLM技术的应用,英伟达取得了令人满意的结果,为构建自定义的LLM提供了更大的灵活性和可控性。这个新的开源数据集为开发人员提供了一个有用的工具,帮助他们更好地理解和应用NVIDIA NeMo框架中的SteerLM技术。

举报

  • 相关推荐
  • 稳住基本盘的小米,紧追DeepSeek

    ​小米一季度财报发布后第二天,MiMo先有了新动作。 就在刚刚,小米宣布MiMo-V2.5系列API永久降价,最高降幅99%,Token Plan同价位用量提升至5至8倍。几天前,DeepSeek刚把V4-Pro的2.5折优惠改成永久价。小米这次跟进,意味着MiMo正在以更低门槛加速参与大模型竞争。 “从短期来看,我们面对成本周期、需求周期和竞争周期三重周期叠加的挑战;长期来看,我们正进入AI重构人车家全

  • DeepSeek预告将大幅涨价:整体上调API服务定价

    DeepSeek今天在用户后台发布提示,平台计划在近期对全部API接口服务进行整体调价,预计涨幅较大。 平台建议企业与个人开发者合理规划调用量、控制充值金额,最终调价细则与生效时间以官方正式公告为准。 目前DeepSeek采用峰谷定价模式,工作日高峰时段(北京时间9:0012:00、14:0018:00)全部价格直接翻倍,凌晨00:3008:30、周末及法定节假日执行平峰原价。

  • DeepSeek-V4-Flash公测炸场,网易智企帝王蟹已无缝升级接入!

    7月31日,DeepSeek-V4-Flash正式版上线。其Agent能力覆盖终端操作、代码开发等多环节,性能超越V4-Pro预览版和GLM-5.2,逼近Opus4.8,且保持原价,是“又强又便宜”、专为Agent而生的高性价比引擎。 企业级平台“帝王蟹”的经济档已无缝升级至此,用户无需迁移即可享受。该平台不仅聚合多种大模型,更通过内置AI员工、专属知识库和安全管控体系,让模型真正融入业务流程,解决企业AI落地难题。目前平台推出9.9元得3亿Token的限时福利。

  • AI日报:DeepSeek将上调API价格;美图上线AI平台MeituHub;小红书将全面加码 AI

    DeepSeek宣布上调API服务价格,进入商业化动态调整期;美图推出AI影像全链路生产平台MeituHub;小红书全面加码AI社交,成立一级部门加速布局;MiniMax纳入港股通并涨超17%,开源新一代多模态生成模型;百度整合AI办公智能体,推进知识沉淀与流程执行;达摩院启动“阿里星”招募,开放15项前沿课题;OpenAI披露智能体可自主越权并协同攻击;字节张一鸣强调AI研发坚持长期主义,拒绝“AI蒸馏”。

  • 天下苦闭源模型久矣,MiniMax H3要做多模态领域的Deepseek

    2026年8月3日,港股MINIMAX-W(00100.HK)报HK$249.4,涨幅超10%。当日早盘,MiniMax盘前正式宣布发布新一代多模态生成模型H3。市场用真金白银为这次产品发布投了一票。 A 天下苦闭源模型久矣,视频生成赛道此前由Seedance、可灵等头部模型主导,价格、算力、生成时间也一直是行业关注比较高的的话题。 MiniMax发布的H3,正是视频生成市场的一个全新选择。 官方博客中表示,定位H3

  • 火山引擎上线 Seedance2.5,视频直出时长拉到30秒

    字节跳动旗下的火山引擎今天宣布,Seedance2.5的视频出片 API 服务正式对外上线。这个版本距离上一代 Seedance2.0推出并没有隔太久,但能力上的变化不小,官方口径是指令遵循、长叙事、真人感、声画质感这几个方向都有明显提升。 最直观的改动在于时长。Seedance2.5原生支持30秒视频直出,不需要分段拼接;素材参考数量上限提到50个,且支持全模态输入。编辑能力也做了加强,�

  • V4 Pro正式版黄金搭档 DeepSeek官方AI编程工具Harness内测

    DeepSeek赶在7月最后一天发布了V4-Flash正式版,性能表现很惊艳,接近Opus 4.8的能力,但这还不是DeepSeek的大招,后面还有V4 Pro正式版,以及官方配套的Harness软件。 前两天网上就传出了DeepSeek Harness工具的内测消息,说是本周末开始,但没有官方证实,现在该项目的负责人崔添翼已经面向全球征集内测用户,特别是有过Agent Harness项目经验的开发者,发自己的Github ID和代表作就可以

  • 火山引擎正式上线豆包Seedance 2.5:电影级细腻质感

    今天,火山引擎正式上线豆包视频生成模型Seedance 2.5 API服务。 相比Seedance 2.0,Seedance 2.5在指令遵循、长叙事、真人感、声画质感等能力上大幅提升。 模型原生支持30秒视频直出、最高50个全模态素材参考,具备更精准、稳定的编辑能力,并兼容支持十余种语言。 指令遵循能力的大幅提升,以及对Prompt中秒级时间戳的高效响应,使得企业和创作者可以进一步把控长镜头的生成

  • AI视频创作选哪个省钱省Token?从成本账看4款Seedance产品差异

    AI视频创作成本远不止显性的Token或会员费,更关键的是时间、试错、返工、学习等隐形成本。文章从创作者经济视角,解析了接入Seedance模型的四款主流工具的四种成本模式:1)沉淀型,前期投入高但复用后边际成本递减;2)按需型,门坎低但无规模效应;3)混合制,功能拆分易产生切换成本;4)捆绑型,功能轻量化。不同模式匹配探索期、成长期、成熟期创作者的需求。行业竞争正从功能比拼转向成本结构竞争,谁能帮助创作者建立高效、可复用、低成本的工作流,谁就能赢得未来。

  • 这次不等太久 DeepSeek V4正式版新证据:目标8月3日

    月中DeepSeek V4正式版的跳票让很多人失望,但官方的动作一直没停,好消息这次不会等太久了,可能8月3日就能看到。 从7月中旬开始,DeepSeek V4正式版的灰度测试就有各种爆料了,最近一周消停一些,DeepSeek官方也非常低调,没有再公布正式版发布的时间,现在的新证据暗示了8月3日会是个重要节点。 这个时间点是硅基流动发布的短信通知,该公司将于8月3日起调整DeepSeek V4 Pro

今日大家都在搜的词: