首页 > 业界 > 关键词  > AI视频生成最新资讯  > 正文

AI视频应用迈入双位数增长期,小影科技居收入下载榜

2026-07-08 14:51 · 稿源: 白鲸出海公众号

声明:本文来自于微信公众号 白鲸出海,作者:张凯然,授权站长之家转载发布。

根据 Sensor Tower 发布的《2026年全球 AI 应用趋势洞察》,2026年第一季度,全球 AI 图像视频生成 App 的内购收入达到1.5亿美元,环比增长20%,下载量达到1.7亿次,环比增长12%,均超双位数。

与 Web 端更重生产力属性不同,移动端的 AI 视频产品,更偏向以模板设计为用户提供娱乐体验,这一商业模式本存疑虑的赛道,从数据看,已经验证市场需求。

图片1 (2).png

图片来源:Sensor Tower

而赛道的另一转折点也异常明显,与大模型市场 ChatGPT、Claude、Gemini 占据绝大份额不同,视频大模型正变成“基础设施”。

赛道发展之初,站在台前的始终是背靠自研模型的团队,从 runway、Pika,到后来的 Sora、Kling AI。直觉上,他们更具天然优势,模型更可控,对第三方的依赖也更低。

但是,现在无论是 web 还是 App 端,集成多家模型、通过工程化去对准市场需求的产品,更多占据靠前的位置,如 web 端流量目前处于 Top1的 Higgsfield,又如 Sensor Tower 这次发布的移动端收入榜单中,Top10中有7款产品无自研模型。

图片2 (2).png

收入榜排名前10中,只有 Kling、

即梦和 Hailuo AI 有自研视频模型

这让 AI 视频赛道看起来更具活力,当然竞争也尤其激烈。

这7款产品中,有擅长流量与变现的土耳其厂商,有在 AI 浪潮之初即快速反应入局的华人创业团队,同时,也看到了长年深耕图片与视频赛道,在 AI 时代找到自己位置的小影科技,位列全球收入榜单第6位。

一、关系与猎奇是 C 端用户核心动机

仔细观察排名靠前产品的热门功能,会发现一个共同点,没有一款主打专业剪辑或者精细控制,它们主做同一件事——模板。

图片3 (2).png

「AI Catch」(左)、AI Video(中)、Pose(右)

从「AI Catch」、AI Video、Pose 等上榜且排名靠前的产品落地页看,基本都是用图片或动图展示模板效果,用户点进去、上传图片、一键生成,全程不需要调参数、不需要写提示词,门槛几乎为零。

这两个信号叠在一起,用户画像清晰,不是创作者,是普通消费者。

从内容倒推普通消费者使用 AI 视频产品的动机,可以归为两类:一类是关系驱动,把身边最亲密的人变成视频主角,在互动中制造笑点、情感共鸣与共同回忆;另一类是视觉效果驱动,用户通常被模板本身吸引,随即产生自己试试或者转发给朋友的冲动。

翻看 AI Video、Pose、「AI Catch」三款产品在 App Store 的用户评论,高频出现的词汇里,一类是 laugh、hilarious、happy 等体现情绪的词汇,另一类是 family、friend、husband 等关系词汇。

2222.jpg

「AI Catch」的母亲节玩法素材封面(左),AI Video

舞蹈玩法素材(右)|图片来源:小影科技,广大大

广告素材也同样印证了这一点,左图中展示的是「AI Catch」的母亲节玩法,而右图中的文案“My husband will hate me for this”,展示妻子用“AI 舞蹈”整蛊丈夫的场景。

而在关系链中,婴儿/宠物2个主体始终拥有超高热度,这类玩法将“不可能发生”的画面用 AI 做出来,用户被意料之外的视觉效果击中,产生制作和转发的冲动。

图片7 (1).png

「AI Catch」近期投放的小狗踢球的

广告素材封面|图片来源:广大大

上述动机指向同一个结论:普通用户要的不是创作工具,而是一次可以在社交场景里制造和共享的情绪时刻。

二、相同的大方向,迥异的触发点

掌握了用户的底层驱动力,只是找到了大方向。真正能让一个模板火起来,还要同时做对三件事,模板方向的长期积累与验证、市场需求方向判断,以及精准找到情绪触发点。而要做到这些,靠的是开发者的方法论和对市场文化的深度观察。

图片8 (1).png

3月中旬「AI Catch」登顶巴西总榜|图片来源:小影科技

以今年3月让「AI Catch」登顶巴西总榜的家庭照玩法为例,小影科技团队曾与我们复盘背后的原因。

首先是模板方向的长期积累。最早,在「AI Catch」中被验证的玩法是“美人鱼写真”,数据跑通之后,团队沿着“专业写真门槛高、一键生成对用户吸引力大”的底层逻辑,陆续裂变出“生日写真”“照相馆写真”等系列“写真”玩法。经过多次验证,“写真”已经成为「AI Catch」长期稳定跑量的模板方向,团队将它称为“1-10的积累”。

然后是对巴西市场的判断。团队在社媒上观察到家庭照相关内容的传播信号,同时发现家庭照此前曾在巴西曾多次走红,是被市场验证过的需求方向。两个信号叠在一起,团队判断“家庭写真”在巴西有爆发潜力,于是在已经验证的写真大类里,推出了“家庭写真”的具体方向。

有写真大类的技术和运营积累做基础,加上社媒信号和历史数据做验证,成为了“家庭写真”此次登顶的前提。

方向验证只是一半,情绪触发点也同样关键。即便同样是家庭照,不同市场的偏好差异很大:在巴西以及其他西语葡语市场,有效触发点是“小家庭、叠叠乐”风格,搭配黑白艺术照光影、突出高级感;而亚洲市场,更喜欢“多代同堂、正襟危坐”风格。

图片10.png

AI Catch 在巴西市场的下载量

数据|图片来源:点点数据

踩准细节后,「AI Catch」巴西市场下载量从2月的21万,增长到了3月的168万,月流水增长也接近3倍(数据源:点点数据)。后续,团队快速把相关玩法做调整后,推广到其他西语葡语区、韩国、土耳其等市场,均取得了不错效果。

除此之外,在中东阿语区推舞蹈模板,以及元旦等特定节日期间推对应模板,「AI Catch」通过验证需求方法论+快速验模板效果+寻找情绪触发点的整套逻辑,实现了多次成功增长。

这套逻辑在多个产品中都能看到,如 AI Video、Pose 等产品的 AI Baby Dance、Korean Baseball Fan Cam 等等。但基于模板的热点特性,产品跑得更快的关键在于谁能做得更系统、迭代节奏更快、产品体验更佳,从而形成一个“投放-商业化-继续扩展更多用户”的正向循环。

三、速度与体验才是 toC 产品的命门

某种程度上,普通用户其实比 Pro 用户“要求”更高。

Pro 用户有明确的创作需求与目标,哪怕工具复杂、生成慢,他们也愿意等待结果;而普通用户的需求本就是被情绪触发,非刚需,一旦模板效果不合心意、或生成慢,用户即会流失。这对开发者来说意味着双重压力,既要快速上线热点模板抢先获客,又要在整个使用过程中保持好用和流畅,两者缺一不可。

就此,我们也向「AI Catch」了解了他们的解决方案:他们内部为此搭建了一套完整的可视化工作流,打通了热点预判、玩法确认、流程开发、模型选择,到效果测试、上线模板的整个链路。

靠着这套机制,「AI Catch」目前平均每周能产出40到50个不同玩法的模板。爆款本身也有增长和回落的生命周期,团队会以天甚至更短的时间维度观察投放趋势,快速匹配素材上线,在生命周期回落时及时控制成本,对于深耕视频 App 出海14年的小影科技来说,这类节奏管理方式,算是“老本行”。

生成效果方面,不同玩法、风格,不同用户偏好的模板,对底层模型的要求完全不同,只用单一模型往往顾此失彼,要么效果不稳定,要么成本失控。「AI Catch」的做法是多个模型进行动态组合、调优,并配置兜底模型,在效果与成本之间找平衡点,同时力求将延迟压到行业优秀水平。

图像方面,小影科技从场景出发,基于自研 LoRA 实现模板特效上线,逐步积累不同场景的 LoRA 模板,大幅降本增效,未来也将会自研垂类场景的视频模型。从用户数据看,「AI Catch」付费用户的次日留存率约为30%,显著高于整体用户水平。(注:「AI Catch」提供免费积分体验,后续需付费才能使用)

小影团队告诉我们,这些开发出来的模板玩法还会被沉淀到“工具池”当中,满足后续 Agent 相关产品的建设、可视化流程的迭代、与垂类视频模型的研发等,之后也能反哺优化热门玩法效果,同时大幅降本。

对面向普通用户的产品来说,工程化能力或许比模型更重要,因为用户只关心视频好不好看,生成快不快。这条路看起来没有“自研大模型”那么性感,但在商业化成绩上,已经拿到了答案。

写在最后

回头看那7款无自研模型产品在收入榜上的表现,可以提炼出一个共同的竞争逻辑。当 AI 生成能力逐渐成为可以调用的基础设施,移动端的竞争核心已经从“谁的模型更好”转向了“谁能更快找到用户的情绪触发点”,并把它工程化后推向市场。

而现实情况来看,在产品都追逐 Agent 形态、但 AI 图像、视频应用的渗透率仍在30% 左右的当下,大众用户市场远未饱和,在 Agent 时代真正到来之前,用模板承载表达的产品形态,或许是 toC AI 图像视频应用更现实的商业选择。

举报

  • 相关推荐
  • 蚂蚁灵波定义视频生成第二赛道,开源LingBot-Video,融合7万小时具身数据

    蚂蚁灵波开源全球首款基于MoE架构的具身智能视频生成模型LingBot-Video。该模型围绕机器人需求设计,在推理效率与物理合理性等维度系统提升,在RBench评测中以0.620总分超越Wan2.6等主流模型。它采用DiT+MoE架构,30B总参仅激活3B实现高效推理,并引入7万小时具身数据与多维强化学习,从数字创作转向物理交互,现已正式开源。

  • 从向佐到papi酱、马宁,为何越来越多人愿意录视频播客?

    ​视频播客已经快成热搜常客了。 孙杨刚因参与录制易立竞的视频播客登上多平台热搜,papi酱和窦文涛两人又因为对原生家庭、流量焦虑、如何接纳自己等话题的交流,引发诸多网友的围观讨论。 有人和窦文涛共鸣了,说他拧巴又真诚,也有人欣赏papi酱的通透,觉得她简直是视频播客界的心理咨询师。这大概就是视频播客的魅力所在,即便是已经被大众熟知的公众人物,�

  • 9条破亿视频,新号涨粉百万,过去半年谁在制造AI爆款?

    ​2026上半年,可谓是AI爆款的井喷期。 短短6个月内,不仅出现了全网曝光量2.3亿、被央视新闻、人民日报先后转发的现象级AIGC短片《纸手机》,以及《纸手机》过后批量涌现的AI爆款短片。

  • 2026自媒体修图APP选型指南:AI精修3分钟出片,覆盖从拍摄到排版全链路

    2026年自媒体修图APP已呈现代际分层:商业级精修首选像素蛋糕,主打批量化AI精修与拍摄修图全链路联动;专业调色推Lightroom,可多端同步Raw处理;免费精细化修图选Snapseed,“指划”交互结合蒙版精准调控。轻量快出图用醒图,人脸美颜与流行滤镜资源丰富;图文排版与氛围感选黄油相机,适合日常内容制作;设计修图一体化用Canva可画,海量模板覆盖多平台物料需求。选型核心在于匹配自身创作场景——商业创作者需兼顾精度与效率,个人创作者则根据内容品类、操作便捷度及预算精准选择。

  • AI如何重构音视频行业?行业协会专家与itc保伦股份给出这些新思考

    广州电子音响协会与ITC保伦股份联合举办“AI时代音视频产业革新”座谈会。会前专家团参观了ITC智慧展厅等场景。ITC总经理张柏龙系统梳理了产业现状、痛点与战略路径。与会专家围绕AI重塑产品逻辑与商业模式、多领域智慧场景破局路径、校企协同三大议题深入探讨,达成四项共识:主动拥抱AI技术变革;依托广州硬件优势,补齐AI能力短板;聚焦细分场景打造增量市场;深化校、企、协协同育人,构建产学研一体化生态。

  • 可灵AI估值千亿,快手“母凭子贵”:国产视频模型三强争霸

    ​AI正在重写每个行业、每家公司的估值逻辑。 7月2日晚间,快手发布公告,旗下独立运营主体北京可灵智能科技有限公司(以下简称“可灵AI”)敲定总额上限30亿美元的外部增资,目前已签约近28亿美元,创下全球视频大模型公司单轮最高融资纪录。可灵AI投后估值达180亿美元,约为当天母公司快手估值的80%。

  • 荣耀MagicOS 11首发YOYO Next:AI能直接操作App

    荣耀打造的YOYO Next将支持App操控、复杂任务处理、记忆功能、技能商店、自定义模型以及YOYO控虾等多种能力。 覆盖用户日常所需的各类操作场景,相比现有的YOYO助手,YOYO Next在智能化水平和任务执行能力上都有了大幅升级。 据悉,YOYO Next将在荣耀MagicOS 11上首发搭载,这将是荣耀史上智能化程度最高的手机操作系统。从YOYO Next的进化方向不难看出,2026年手机行业正在经历一

  • 四款APS-C画幅视频微单同台:轻便、画质、对焦、散热,谁更全面?

    2026年视频创作已入精细化时代,需兼顾便携、画质、对焦等六维能力。本文对比佳能R50V、索尼ZV-E10 II、尼康Z30和富士X-S20四款APS-C热门微单:佳能R50V极致轻便,视频规格全面,竖拍与色彩直出讨喜;索尼对焦及镜头群占优;尼康最亲民但缺Log与4K 60P;富士胶片模拟风格鲜明且防抖好。选择无绝对答案,应根据最常拍场景和核心需求理性取舍。

  • 从短视频矩阵三强到AI营销三强,今立智能靠什么延展生态能力

    企业营销正从单一短视频流量转向“短视频矩阵+AI搜索推荐”双入口阶段。今立智能作为观察样本,从超级智剪等矩阵产品起步,通过“AI工具+私教课+托管代运营”模式沉淀交付力,再快速布局GEO业务,将能力延伸至AI搜索推荐。其核心在于产品、交付、复制三大能力的组合,并正通过区域合作、OEM贴牌、API接入等方式,将自身能力开放为可被合作伙伴复制的AI营销生态。

  • 视频播客的「3亿时代」,抖红B谁能先创造

    没有人能逃过原生家庭的痛,哪怕是被称为中国最会聊天的人之一的窦文涛。 当窦文涛在他的视频播客《自然光》聊起自己父亲时,papi酱点出他在无意识中给自己带来的枷锁,让窦文涛晃了神,也让他感叹这样的对话很治愈。 这期时长两个半小时的视频播客完整版虽首发于B站,视频播放量达330万,但真正的讨论场却聚焦在抖音和小红书。 不少网友将节目中的高光段落制成

今日大家都在搜的词: