首页 > AI头条  > 正文

快手祭出“内容净化器”KuaiMod!让多模态AI帮你过滤烂片

2025-05-09 13:47 · 来源: AIbase基地

最近,短视频领域又迎来了一项重大技术突破 —— 快手推出的 KuaiMod,这一基于大模型的内容审核框架,有望彻底改变短视频生态的现状。今天,咱们就深入剖析一下,KuaiMod 到底有哪些厉害之处。

image.png

短视频的 “烦恼”:不良内容泛滥

现在的短视频平台,像快手、TikTok 这些,那发展速度简直像坐火箭一样!每天都有海量的视频上传,其中不乏很多优质内容,给大家带来知识和欢乐。但问题也来了,有些不良视频也趁机混入其中,对平台生态造成了不小的威胁,尤其是对未成年人的身心健康可能产生危害。

为了拦住这些不良内容,内容审核环节就变得至关重要。传统的审核方式,就像让一群 "人工裁判" 按照既定的规则去判断每个视频是否合规。但这种方式问题不少:

  • 人工审核成本超高,而且人嘛,总会有主观偏见
  • 随着短视频数量的暴增,人工审核的速度根本跟不上
  • 早期AI方法准确率不高,只能在特定场景下勉强使用
  • 大语言模型面对复杂的短视频内容也有点力不从心

KuaiMod 来 “救场”:借鉴法律智慧打造审核神器

面对这些难题,快手的研究人员灵机一动,从法律体系里找到了灵感。大家知道,法律分为民法体系和普通法体系,传统的审核方式就像民法体系,依赖固定的规则。而快手这次借鉴的是普通法体系,它不依赖死板的条文,而是根据以往的案例来做判断,更加灵活。KuaiMod 就是基于这个思路诞生的!

打造审核 “题库”:KuaiMod 基准数据集

在正式介绍 KuaiMod 之前,得先说说它的 “秘密武器”——KuaiMod 基准数据集。研究人员从快手平台收集了大量视频,精心挑选出1000个,有健康积极的,也有包含各种不良内容的。这些不良内容被细分成15个类别,像危害社会安全与法律、违反内容伦理、禁止的商业行为、侵犯知识产权等等。

image.png

这些数据可不是随便找的,积极的视频来自人工审核过的高质量视频队列,而且用户反馈都很好;不良视频则来自高举报、高差评和负面评论多的视频。收集好之后,30位经验丰富的标注员仔细标注,最终确定了这个涵盖各种类型的测试集。这可是第一个开源的短视频平台内容审核基准数据集,意义非凡!

KuaiMod 的 “修炼秘籍”:三步走策略

image.png


1. 数据构建:给模型 "喂" 好料

训练数据的来源和标注过程和基准数据集类似,但规模更大。研究人员从快手平台的四个视频队列里采样了50000个视频,还利用元启20B 模型来帮忙标注。遇到标注员不好分类的视频,就让元启20B 模型生成补充标签,然后人工审核后再加入分类体系。现在这个分类体系已经扩展到100多个违规类别了,而且还在不断更新。

image.png

2. 离线适配训练:打磨模型 "基本功"

有了数据,接下来就是训练模型。这一步分为两个关键环节:

  • 大规模监督微调(SFT):让模型在大量案例中学习如何分析视频内容
  • 基于错误的直接偏好优化(DPO):专门揪出模型犯的错误,通过对比正确和错误的输出,让模型不断改进

3. 在线部署与优化:让模型 "与时俱进"

短视频平台的内容变化太快了,静态的审核模型根本跟不上节奏。所以,KuaiMod 设计了一个基于用户反馈的强化学习(RLUF)机制,让模型能根据平台的实时反馈不断优化审核策略。

效果惊人:KuaiMod 实力大展示

离线评估:碾压一众 “选手”

研究人员找了好多其他的审核方法来和 KuaiMod 对比,有基于 API 的,像谷歌的 Perspective API;有基于小模型的,比如 RoBERTa;还有基于大模型的,像 Intern-VL。结果发现,KuaiMod 在各项指标上都表现得超级出色!

从召回率、精确率和准确率这些指标来看,KuaiMod 在判断视频是否违规以及违规类别上,都比其他方法更准确。就算是和强大的 GPT-4o 相比,KuaiMod 在多类别分类任务上也毫不逊色,甚至更胜一筹。而且,通过消融实验发现,KuaiMod 的每个组件都很重要,少了谁都不行,这也证明了它设计的合理性。

在线应用:平台的 “救星”

KuaiMod 在快手的多个场景中都进行了部署,像 NEBULA、Featured 和 Main Site,这些场景每天都有上千万的活跃用户。

在综合生态治理方面,KuaiMod 把违规视频找出来并处理掉,大大降低了用户举报率,同时还让平台的日活跃用户数(DAU)和总应用使用时间(AUT)保持稳定甚至上升,这说明它让用户在平台上的体验更好了。

image.png

在个性化推荐方面,KuaiMod 根据不同用户对不良内容的接受程度,调整推荐策略。结果 DAU 和 AUT 都增加了,这表明它不仅能保证平台的 “绿色健康”,还能提升平台的收益。

未来可期:短视频 “净化大师” 的展望

KuaiMod 的出现,给短视频平台的内容审核带来了新的希望。它用创新的方法解决了传统审核方式的难题,通过独特的数据构建、训练和优化机制,成为了一个高效、准确的内容审核框架。

不过,技术总是在不断发展,未来还有很多挑战等着。但有了 KuaiMod 这个好的开始,相信在它的基础上,短视频平台的内容审核会越来越智能、越来越高效,咱们以后刷短视频的时候,看到的不良内容会越来越少,享受的优质内容会越来越多!家人们,是不是很期待呢?

  • 相关推荐
  • UniToken:多模态AI的“全能选手”,一次编码搞定图文理解与图像生成

    复旦大学与美团研究者提出UniToken框架,首次在统一模型中实现图文理解与生成任务的"双优表现"。该方案融合连续和离散视觉编码,有效解决了传统多模态建模中的"任务干扰"和"表示割裂"问题。通过三阶段训练策略(视觉语义对齐、多任务联合训练、指令强化微调),UniToken在多个基准测试中性能超越专用模型。其创新性体现在:1)统一的双边视觉编码

  • 业界唯一!百度网盘上线多模态AI笔记 效率提升10倍

    快科技5月2日消息,过往,用户在通过视频学习并记录笔记时,总免不了要不停切换平台软件,暂停、截屏、记录、插图、批注、切换返回视频过程繁琐而低效。为了应对这种情况,百度网盘和百度文库联合研发上线了AI笔记”,支持全自动学习、半自动学习、辅助学习三种模式。如今只要在网盘里面任意打开一个学习视频,在右侧就能看到AI笔记”功能,用户可以自主输入内容,也可以让其直接生成图文并茂、结构清晰的笔记。而且每个重要知识点旁会有时间戳,点击时间戳即可跳转到视频中对应位置,实现视频和笔记内容的顺滑关联。此外AI笔记”还可以帮

  • 多模态和Agent成为大厂AI的新赛 点

    这是《窄播Weekly》的第52期,本期我们关注的商业动态是:当大厂的AI竞争策略开始倾斜向应用场景,多模态能力和代理执行成为两个焦点。大模型落地C端场景的核心,就是让大模型的能力越来越接近人。沿着这个主旋律,可以划分出两个进化方向:一个是持续降低用户与大模型进行有效沟通的难度;另一个则是让大模型具备执行更复杂任务的能力。前者的实现,需要给到大模型多

  • 多模态和Agent成为大厂AI的新赛点

    本期《窄播Weekly》聚焦AI大厂竞争策略向应用场景倾斜的趋势,重点分析了多模态能力和代理执行两大发展方向。文章指出,大模型落地的核心在于让人机交互更自然,具体表现为:1)通过多模态技术降低用户使用门槛,如阿里夸克新推出的"拍照问夸克"功能;2)通过代理执行提升复杂任务处理能力,如字节、百度等推出的通用Agent产品。国内外厂商路径差异明显:国�

  • 可灵AI发布全新2.0模型:上线多模态视频编辑功能

    快科技4月16日消息,据报道,可灵AI在北京举行灵感成真”2.0模型发布会,正式发布可灵2.0视频生成模型及可图2.0图像生成模型。据介绍,可灵2.0模型在动态质量、语义响应、画面美学等维度保持领先;可图2.0模型在指令遵循、电影质感及艺术风格表现等方面显著提升。3月27日,全球AI基准测试机构Artificial Analysis发布了最新的全球视频生成大模型榜单,快手可灵1.6pro(高品质模

  • AI日报:国内首个多模态AI程序员上岗;字节启动Top Seed计划招募AI人才;DeepSeek R1T Chimera上线OpenRouter

    【AI日报】今日AI领域重要动态:1.百度发布文心快码3.5及多模态AI程序员"文心快码Comate Zulu",提升开发效率;2.字节跳动启动"Top Seed"计划,招募30名AI博士人才;3.DeepSeek开源R1T Chimera模型上线OpenRouter平台;4.阿里AI工程师余亮获"全国劳动模范"称号;5.开源图像编辑工具Step1X-Edit登陆Hugging Face,性能媲美GPT-4o;6.谷歌被曝每月向三星支付巨额资金预装Gemini应用

  • 十大除甲醛净化器哪个牌子好 真正净化甲醛效果好品牌

    新装修房屋入住时,甲醛污染是主要健康隐患。文章推荐使用高效空气净化器去除甲醛,并介绍了几款优质产品:英国品牌斯帝沃采用纳米分解技术,甲醛去除率达98%;奥司汀专为家庭设计,能净化PM2.5和异味;Airx A10配备双重分解系统;飞利浦采用德国活性炭技术;阿卡驰Z01适合母婴家庭,覆盖120㎡空间;3M拥有专利静电滤网;西屋空气净化器CADR值高达7.1m³/分钟;瑞典Dustie DAS150兼具除菌功能;富士通新型产品可捕捉PM0.1微粒。选购时需关注CADR值、CCM值和滤芯寿命等参数。

  • 紫东太初多模态RAG全新发布:端到端问答准确率提升33%

    在产业智能化进程中,如何高效融合企业专有知识资产,构建领域专属认知引擎,是企业迈向智能决策与高效运营的关键。然而,传统检索增强生成(RAG)技术受限于语言单模态处理能力,仅能实现文本知识库与文本查询之间的浅层理解,难以满足复杂业务场景的需求,在实际应用中暴露出两大缺陷:信息表征缺失:忽略知识库中多模态富文档的视觉语义信息,如版面结构、图表关�

  • 空气净化器哪家好?2025年空气净化器品牌排行前十名

    本文介绍了2025年十大知名空气净化器品牌选购指南。重点分析了斯帝沃、IQAir、艾奥尼克、LIFAair、松下、惠而浦、大金、博世、小米和百朗等品牌的核心技术和产品特点。文章建议消费者根据自身需求选择:新房装修需除甲醛功能,污染严重地区需高效去除PM2.5,有老人小孩家庭需关注除菌功能。同时强调选购时要考虑CADR值、滤芯寿命、噪音水平等参数,并推荐了各品牌明星产品,如斯帝沃的NAMI纳米分解技术、IQAir的HyperHEPA过滤技术等。最后指出智能控制已成为行业标配,消费者可通过APP远程监控空气质量。

  • 开源即支持!基于昇腾MindSpeed MM玩转InternVL3多模态理解最新模型

    多模态理解领域当前已成了各家AI大模型公司“军备竞赛”的关键点之一,国内外知名AI大模型公司都争相通过发布最先进的多模态大语言模型展现其在多模态理解领域的前沿能力。近期,上海AI实验室推出了其最新的多模态大语言模型InternVL3 系列,相比上一代InternVL2. 5 模型,该模型展现出卓越的多模态感知和推理能力,同时进一步扩展了其工具使用、GUI代理、工业图像分析等

今日大家都在搜的词: