首页 > 传媒 > 关键词  > OpenAI最新资讯  > 正文

成都汇阳投资关于Sora 正式上线,多模态模型的里程碑

2024-12-16 14:40 · 稿源: 站长之家用户

 事 件

  12 月 10 日,OpenAl正式上线 Sora,并向包括美国在内的多数国家用户开放,用户可在OpenAI官网上体验Sora。同时,Sora 被包含在ChatGPT Plus 和ChatGPT Pro 的会员订阅方案中, 用户无需额外付费。 其中,订阅Plus方案的用户可使用 Sora 生成最多 50 个分辨率达720p、时长为 5 秒的高 级视频而Pro方案能生成最多 500 个分辨率达1080p、时长为 20 秒的高 级视频,并且提供去水印功能。

新 Sora 视频再创作能力大幅提升

 相较于 OpenAI2 月份发布的版本, 此次上线的新 Sora 新增 Storyboard、Remix、Re-cut 等功能 ,视频再创作能力大幅提升 ,并且优化了视频生成速度及生成方式。新 Sora 的新功能包括 1)Storyboard:类似于电影里的分镜,即用户只需借助文字设计几段视频帧或直接上传图片作为静态视频帧, 并在视频帧之间预留一些时间供Sora 发挥,Sora 便能自动把这些视频帧串联起来形成一段完整的视频:2)Remix:通过不同的文字描述对视频中的元素进行替换、删除或重构, 比如可以把图书馆变成宇宙飞船:3)Re-cut:智能识别并剪切出视频中的最 佳帧,并将其导入 Storyboard 中 ,拓展该视频帧:4)Loop:用于创建无限循环的视频:5)Blend:将两个视频无合并为一个视频:6)Style presets:为视频预设风格 , 比如黑白电影、纸片人等。 此外,借助 Sora Turbo,新Sora 的视频生成速度显著提升, 同时,新 Sora 将视频生成方式扩展为文/文+图/文+视频生成视频。

 国内企业开始加速研发并选代A I 视频生成产品

 今年以来 , 国内企业开始加速研发并选代 AI 视频生成产品 ,产品能力不断提升 ,应用场景持续拓宽。1)今年 6 月,快手 AI 团 队发布可灵 AI 视频生成大模型 ,可生成长达 2 分钟 、分辨率达 1080p 的视频 ,可灵 AI 主要功能包括文生视频 、 图生视频 、 视频续写等;2)今年 7 月 ,智谱 AI 上线视频生成产品智谱清影 ,并在 11 月 进行全新升级 ,支持生成时长为 10 秒的 4K 超高清视频 ,除常规的文生视频和图生视频功能外 ,智谱清影引 入 CogSound 模型 , 可以对为 生成的视频添加背景音乐:3)今年 8 月 , 字节推出即梦 AI 一站式创作平台, 随后在 11 月 宣布即梦 AI 两大视频模型 S2.0 Pro 和 P2.0 Pro 正式全量上线,其中, S2.0Pro 在图生视频场景具有较高的首一致性,能够保持视频与用户输入图像的 色彩 、 风格等保持一致 ,P2.0Pro 具有极 高提示词遵循能力, 能够在一句提示词内实现多个镜头切换及多镜头组合, 同时保持视频内形象主体、 风格和氛围的一致性 。此外 ,Minimax、 阿里云等初创企业及大模型厂商也在布局 AI 视频生成赛道, 整体来看,视频生成工具今年以来, 国内企业开始加速研发并选代 AI 视频生成产品,产品能力不断提升 ,应用场景持续拓宽 。 1)今年 6 月 ,快手 AI 团队发布可灵 AI 视频生成大模型, 可生成长达 2 分钟、分辨率达 1080p 的视频,可灵 AI 主要功能包括文生视频、 图生视频、 视频续写等;2)今年  7 月,智谱AI 上线视频生成产品智谱清影 ,并在11 月进行全新升级 ,支持生成时长为 10 秒的 4K 超高清视频 , 除常规的文生视频和图生视频功能外,智谱清影引 入 CogSound 模型 , 可以对为生成的视频添加背景音乐:3)今年 8 月, 字节推出即梦AI 一站式创作平台, 随后在 11 月宣布即梦 AI 两大视频模型 S2.0 Pro 和 P2.0 Pro 正式全量上线 , 其中 ,S2.0Pro 在图生视频场景具有较高的首一致性 , 能够保持视频与用户输入图像的色彩 、 风格等保持一致 ,P2.0Pro 具有极 高提示词遵循能力, 能够在一句提示词内实现多个镜头切换及多镜头组合 , 同时保持视频内形象主体、风格和氛围的一致性。此外 ,Minimax、 阿里云等初创企业及大模型厂商也在布局 AI 视频生成赛道 , 整体来看 ,视频生成工具的能力不断提升 , 未来有望渗透更多应用场景。

相关公司

 三六零 (601360) : 目前 360 搜索是中国搜索引擎的 Top2 , 市场份额为 35%,公司的人工智能研究院从 2020 年开始一直在包括类 ChatGPT 技术在内的 AIGC 技术上有持续性的投入 ,但截至目前仅作为内部业务自用的生产力工具使用 ,且投资规模及技术水平与当前的 ChatGPT3 相比还有较大差距 , 各项技术指标只能做到略强于 ChatGPT2 。 由于训练数据源及应用方向的原因 ,在中文环境下的实际效果强于 ChatGPT2 。360 在数据资源端有丰富的多模态大数据积累和相关语料 、尤其是中文语料 ,相较于国外同行落后的是预训练大模型和有效的多模态数据清洗与融合技术 。公司有充足的资金储备可用于购买大规模算力 ,在继续深入自行研发的同时 ,不排除寻找强有力的合作伙伴 , 以开放的心态搭建多方共享平台 、补足短板 ,快速缩小差距 。公司也计划尽快推出类 ChatGPT 技 术的 demo 版产品 。

 中科曙光 (603019):伴随宁夏 “ 算力交 易平台 ” 的上线 , “ 东数西算 ” 工程迎来重要里程碑 。 2 月 24 日 ,由宁夏回族自治区联合中科曙光 、中国电信宁夏公司 、北京国际大数据交易所等打造的国内头个一体化算力交易调度平台——东数西算一体化算力服务平台正式上线 。该平台上线后将整合宁夏地区零散算力资源 ,解决算力输出、应用 、交易等难题 ,赋能宁夏“ 六新六 特 ”等产业数字转型升级。

 参考资料:20241212- 山西证券-计算机行业点评: Sora正式上线, 多模态模型的里程碑

 免责声明:以上信息出自汇阳研究部,内容不做具体操作指导,客户亦不应将其作为投资决策的唯 一参考因素。据此买入,责任自负,股市有风险,投资需谨慎。

推广

特别声明:以上内容(如有图片或视频亦包括在内)均为站长传媒平台用户上传并发布,本平台仅提供信息存储服务,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任,相关信息仅供参考。站长之家将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。任何单位或个人认为本页面内容可能涉嫌侵犯其知识产权或存在不实内容时,可及时向站长之家提出书面权利通知或不实情况说明,并提供身份证明、权属证明及详细侵权或不实情况证明(点击查看反馈联系地址)。本网站在收到上述法律文件后,将会依法依规核实信息,沟通删除相关内容或断开相关链接。

  • 相关推荐
  • 成都汇阳投资关于固态电池核心股

    文章概述了固态电池作为未来动力电池发展方向的优势,包括更高能量密度、更好热稳定性和更宽工作温度区间。预计2030年市场规模将达251.1GWh,产值200亿元。重点介绍了8家相关企业:科恒股份(电极设备核心供应商)、海科新源(电解质研发)、湘潭电化(锰基材料)、滨海能源(硅基负极)、兴业股份(电池材料)、诺德股份(集流体产品)、上海洗霸(电解质研发)和金龙羽(电解质材料)。投资建议分为进攻组合(确定性最高)、弹性博弈和回避方向,并提示需关注2025年半固态电池量产数据。(140字)

  • 成都汇阳投资关于芯片+AI 眼镜核心公司

    AI眼镜芯片作为核心部件,2025年全球市场规模预计达570万台,同比增长110%。芯片算力决定处理速度与效率,低功耗特性延长续航时间。多家公司布局该领域,如韦尔股份(全球第三大CMOS厂商)、中科蓝讯(无线音频SoC芯片)、恒玄科技(AIoT芯片龙头)等。AI眼镜有望替代手机、电脑,成为元宇宙入口。投资建议关注短期市场情绪和资金流向,长期可布局具备核心竞争力的公司,如韦尔股份、恒玄科技等。投资需分散风险,谨慎决策。

  • 成都汇阳投资关于IP 经济核心股梳理

    泡泡玛特旗下LABUBU系列产品火爆热销,导致工厂产能紧张。中国二次元周边衍生品市场规模从2016年的53亿元增长至2023年的1024亿元,复合年增长率达52.7%。2024年中国"谷子经济"市场规模预计达1689亿元,同比增长40.63%。文章梳理了十家IP/谷子经济产业链相关企业,包括柏星龙、奥雅股份、德艺文创等,这些企业在IP衍生品开发、授权运营等方面各具特色。其中泡泡玛特与元隆雅图合作的品牌营销项目,2025年Q1华为客户收入占比超30%。IP经济市场潜力巨大,但投资者需谨慎评估企业基本面、财务状况及行业竞争态势。

  • OpenAI 提升o3多模态模型推理实力,微美全息(WIMI.US)加速引领产业新变革征程

    OpenAI推出突破性的o3推理模型,首次实现图像直接融入推理过程,在多模态基准测试V* Bench上准确率达95.7%。DeepSeek完成R1模型升级,上下文窗口从12K扩展至23K,幻觉率降低45%-50%。行业呈现开源趋势,DeepSeek开源策略促使多家企业跟进,OpenAI也考虑开源。微美全息加速布局多模态大模型,计划提供实时多模态AI体验。专家指出AI发展重心正从大模型向智能体演进,开源技术显著降低训练门槛,提升泛化能力,为多模态智能探索开辟新路径。企业需紧跟趋势把握机遇,在大模型驱动的新时代找准定位。

  • 成都汇阳投资关于原厂推动减产+AI 需求刺激,存储价格有望上涨

    全球五大NAND闪存厂商(三星、SK海力士、美光、铠侠与西部数据)计划在2025年上半年同步减产10%-15%,以应对供过于求的市场局面。预计第二季度存储芯片价格将出现超预期反弹。同时,北美云服务商持续加大AI投资,将带动企业级SSD需求在2025年第三季显著增长,预计价格季增幅可达10%。国内存储厂商正通过差异化策略在利基市场实现突破,预计随着海外厂商减产,国内厂商市场份额有望提升。AI需求持续增长,预计2025年HBM出货量同比增70%,并带动DDR5等产品增长。国内互联网大厂纷纷加码AI投资,将进一步推动存储市场需求。

  • 成都汇阳投资关于光储逆变器,大储企业非美市场拓展可期

    文章分析了中国大型储能企业的基本面与市场表现,重点比较了阳光电源、上能电气等6家代表性企业。2025年Q1行业呈现营收增长但利润分化的特点,海外市场成为主要增长点,欧洲、中东等地需求旺盛。各企业业务布局差异明显:阳光电源和上能电气以大型光伏逆变器为主,海外业务占比高;科华数据覆盖逆变器和数据中心;盛弘股份专注充电桩和储能逆变器。毛利率方面,海外业务占比高的企业表现更优,阳光电源达36.7%。预计2025年全球储能市场规模将持续扩大,国内企业需提升技术实力和服务能力把握机遇。(140字)

  • 算力赋能营销革新,东信云与华为云签约共建多模态大模型应用标杆

    6月21日,东信云与华为云在HDC2025大会上签署合作协议,双方将基于昇腾AI云服务深化合作,重点布局多模态大模型应用与数字人技术。合作内容包括:1)构建智能营销系统,整合文本、图像、视频等多元数据,提升市场分析和消费者行为预测能力;2)通过大模型实现营销内容自动化生成,包括新闻稿、社交媒体帖子和广告文案;3)优化大模型架构,提升训练和推理效率。东信云6月发布的"数字人智能引擎"已实现分钟级生成逼真数字人,显著提升推荐转化率。双方还将联合行业伙伴共建营销大模型生态系统,推动营销行业智能化升级。

  • 成都汇阳投资关于5 月磷酸铁锂电池装车量同比保持快速增长

    5月新能源汽车产销同比保持快速增长 ,环比小幅增长根据中汽协数据 ,2025年5月新能源汽车产销分别完成127万辆和130.7万辆 , 同比分别增长35%和36.9% ,环比分别 增长1.52% 和6.61% 。其中 ,纯电动销量83.4万辆 ,同比增长43.1% ,环比增长1.46%;插电式混动销量47.3万辆,同比增长27.3%,环比增长17.37%。1-5月新能源汽车产销分别完成569.9万辆和560.8万辆 , 同比分别增长45.2%和44% 。其中

  • Meta拟百亿美元投资Scale AI,微美全息(WIMI.US)端侧多模态AI加速开启科技新局

    Meta正与AI初创企业Scale AI洽谈数十亿美元投资,估值或超100亿美元,有望创下私营企业融资纪录。Scale AI为微软、OpenAI等提供数据标注服务,是生成式AI热潮主要受益者。这将是Meta史上最大规模外部AI投资,标志其战略转向。Meta CEO扎克伯格宣布将AI确立为战略重心,2024年将投入650亿美元推进相关项目,重点打造Llama模型成为行业标准。同时,谷歌推出Gemini助手"计划操作"新功能,支持任务自动化管理。科技巨头纷纷重金布局AI,微软向OpenAI注资逾130亿美元,亚马逊投资Anthropic数十亿美元。行业观察认为AI技术普及将推动效率革命,微美全息等企业正通过技术创新赋能产业转型,共同探讨人工智能技术突破新动态。AI正以前所未有的速度重塑全球发展格局。

  • 视觉中国25周年 Getty CEO寄语共庆更多里程碑时刻

    视觉中国成立25周年之际,Getty Images CEO Craig Peters发表贺信,回顾双方自2005年建立的长期合作伙伴关系。合作促进了视觉中国产品服务的专业化进程,为全球客户提供优质视觉内容。Getty Images为视觉中国旗下cfp.cn提供覆盖国际、体育、文娱等多领域的资讯类图片和视频素材,同时汇聚全球摄影师和设计师的创意作品。过去20年,双方见证视觉艺术的影响力,未来将继续深化资源互通,挖掘视觉内容潜力,共建全球视觉内容桥梁,为用户呈现更具创意和高质量的视觉内容。